De un archivo a muchos
Un archivo MHT es un mensaje multipart/related: el HTML más todas las imágenes, hojas de estilo y scripts a los que la página hacía referencia, todo en un solo fichero. Esta herramienta lo vuelve a separar.
Cada parte se lista con su tipo MIME, su codificación de transferencia, su juego de caracteres declarado, su Content-Location, su Content-ID y ambos tamaños: el almacenado y el decodificado. Esos dos números uno junto al otro enseñan la decodificación en acción: una imagen en base64 pierde alrededor de una cuarta parte de su volumen, mientras que una parte de texto en quoted-printable apenas cambia salvo que esté llena de caracteres acentuados o líneas largas.
El ZIP es una carpeta que funciona, no un montón de trozos
Esta es la parte que casi todos los extractores se saltan. Dividir un mensaje en ficheros es fácil; producir algo que puedas abrir de verdad es lo útil.
- El HTML raíz se escribe como
index.html. - Todo lo demás va bajo
assets/, con nombre tomado de suContent-LocationoContent-ID, sin duplicados y con una extensión razonable si el original no tenía ninguna. - Las referencias
src,hrefyurl()de CSS del HTML —que siguen apuntando a las direcciones web absolutas originales— se reescriben a esas rutas relativas.
Descomprime el resultado, haz doble clic en index.html y la página aparece con sus imágenes y su estilo. Ese es justamente el sentido de extraerla.
El emparejamiento de referencias usa el mismo código que el visor MHTML, así que las referencias cid:, las coincidencias por Content-Location y las referencias relativas resueltas contra la dirección de la propia página se comportan igual en ambas herramientas.
Vistas previas y descargas sueltas
Cualquier parte se puede previsualizar en el sitio —el texto decodificado con su juego de caracteres declarado, las imágenes renderizadas— y descargar por separado. Nada se recodifica: una imagen sale con exactamente los bytes que guardaba el archivo.
Cuando el archivo está incompleto
Las referencias que el archivo nunca guardó se listan aparte. En el HTML extraído siguen apuntando a sus direcciones originales, y aquí no se descarga ninguna.
Privacidad
El archivo se abre en tu navegador. Nunca se sube, y no se hace ninguna petición de red por nada de lo que referencia.
Tiny Online Tools







