Tiny Online Tools logoTiny Online ToolssearchRechercher des outils…grid_viewTous les outils
Accueilchevron_rightOutils documentschevron_rightExtracteur MHTMLExtracteur MHTML

Extracteur MHTML

Démontez une archive MHT en HTML, images, feuilles de style et ressources, et téléchargez-la comme un dossier qui s'ouvre encore dans un navigateur.

upload_file

Cliquez pour parcourir ou glissez-deposez des fichiers ici

MHT, MHTML ou EML

Accepte : .mht,.mhtml,.eml

Outils similaires

Visionneuse MHTML / MHT

Visionneuse MHTML / MHT

Ouvrez une page web archivée dans un seul fichier MHT ou MHTML et affichez-la avec ses images et ses feuilles de style.

Extracteur CHM

Extracteur CHM

Décompressez un fichier d'aide HTML compilée en ses pages, feuilles de style et images, dans un ZIP qui conserve l'arborescence d'origine.

Extracteur de ressources PPTX

Extracteur de ressources PPTX

Extrayez les images, vidéos, sons et polices incorporées d'origine d'une présentation PowerPoint, avec les diapositives où chacun apparaît.

Extracteur de fichiers joints PDF

Extracteur de fichiers joints PDF

Trouvez et téléchargez tous les fichiers joints à un PDF, y compris ceux cachés dans les annotations et les fichiers associés PDF 2.0.

Lanceur de Dés Avancé

Lanceur de Dés Avancé

Lancez des dés avec une notation complète : XdY+Z, conserver le plus haut/bas, dés explosifs.

Texte en PDF

Texte en PDF

Convertissez du texte brut en document PDF avec police, taille et mise en page personnalisables.

JSON Déaplatir

JSON Déaplatir

Développez les clés JSON à notation par points plats dans une structure d'objet imbriquée.

apps

Plus d'outils

Parcourez notre collection complète d'outils en ligne gratuits.

D'un seul fichier à plusieurs

Une archive MHT est un message multipart/related : le HTML plus toutes les images, feuilles de style et scripts que la page référençait, le tout dans un seul fichier. Cet outil les sépare à nouveau.

Chaque partie est listée avec son type MIME, son codage de transfert, son jeu de caractères déclaré, son Content-Location, son Content-ID, et les deux tailles : celle stockée et celle décodée. Ces deux nombres côte à côte montrent le décodage de transfert à l'œuvre : une image en base64 perd environ un quart de son volume, tandis qu'une partie texte en quoted-printable change à peine, sauf si elle est pleine de caractères accentués ou de longues lignes.

Le ZIP est un dossier qui marche, pas un tas de morceaux

C'est l'étape que la plupart des extracteurs sautent. Découper un message en fichiers est facile ; produire quelque chose que l'on peut réellement ouvrir, c'est l'utile.

  • Le HTML racine est écrit sous le nom index.html.
  • Tout le reste va dans assets/, nommé d'après son Content-Location ou son Content-ID, dédoublonné, et doté d'une extension raisonnable si l'original n'en avait pas.
  • Les références src, href et url() CSS du HTML — qui pointent toujours vers les adresses web absolues d'origine — sont réécrites vers ces chemins relatifs.

Décompressez le résultat, double-cliquez sur index.html, et la page s'affiche avec ses images et sa mise en forme. C'est tout l'intérêt de l'extraction.

L'appariement des références utilise le même code que la visionneuse MHTML : les références cid:, les correspondances par Content-Location et les références relatives résolues contre l'adresse de la page se comportent identiquement dans les deux outils.

Aperçus et téléchargements isolés

Chaque partie peut être prévisualisée sur place — texte décodé avec son jeu de caractères déclaré, images affichées — et téléchargée seule. Rien n'est réencodé : une image sort avec exactement les octets que l'archive contenait.

Quand l'archive est incomplète

Les références que l'archive n'a jamais enregistrées sont listées à part. Dans le HTML extrait, elles pointent toujours vers leurs adresses d'origine, et rien ici ne va les chercher.

Confidentialité

L'archive est ouverte dans votre navigateur. Elle n'est jamais envoyée, et aucune requête réseau n'est faite pour ce qu'elle référence.