D'un seul fichier à plusieurs
Une archive MHT est un message multipart/related : le HTML plus toutes les images, feuilles de style et scripts que la page référençait, le tout dans un seul fichier. Cet outil les sépare à nouveau.
Chaque partie est listée avec son type MIME, son codage de transfert, son jeu de caractères déclaré, son Content-Location, son Content-ID, et les deux tailles : celle stockée et celle décodée. Ces deux nombres côte à côte montrent le décodage de transfert à l'œuvre : une image en base64 perd environ un quart de son volume, tandis qu'une partie texte en quoted-printable change à peine, sauf si elle est pleine de caractères accentués ou de longues lignes.
Le ZIP est un dossier qui marche, pas un tas de morceaux
C'est l'étape que la plupart des extracteurs sautent. Découper un message en fichiers est facile ; produire quelque chose que l'on peut réellement ouvrir, c'est l'utile.
- Le HTML racine est écrit sous le nom
index.html. - Tout le reste va dans
assets/, nommé d'après sonContent-Locationou sonContent-ID, dédoublonné, et doté d'une extension raisonnable si l'original n'en avait pas. - Les références
src,hrefeturl()CSS du HTML — qui pointent toujours vers les adresses web absolues d'origine — sont réécrites vers ces chemins relatifs.
Décompressez le résultat, double-cliquez sur index.html, et la page s'affiche avec ses images et sa mise en forme. C'est tout l'intérêt de l'extraction.
L'appariement des références utilise le même code que la visionneuse MHTML : les références cid:, les correspondances par Content-Location et les références relatives résolues contre l'adresse de la page se comportent identiquement dans les deux outils.
Aperçus et téléchargements isolés
Chaque partie peut être prévisualisée sur place — texte décodé avec son jeu de caractères déclaré, images affichées — et téléchargée seule. Rien n'est réencodé : une image sort avec exactement les octets que l'archive contenait.
Quand l'archive est incomplète
Les références que l'archive n'a jamais enregistrées sont listées à part. Dans le HTML extrait, elles pointent toujours vers leurs adresses d'origine, et rien ici ne va les chercher.
Confidentialité
L'archive est ouverte dans votre navigateur. Elle n'est jamais envoyée, et aucune requête réseau n'est faite pour ce qu'elle référence.
Tiny Online Tools







