Tiny Online Tools logoTiny Online ToolssearchRechercher des outils…grid_viewTous les outils
Accueilchevron_rightOutils PDFchevron_rightExtracteur de liens PDFExtracteur de liens PDF

Extracteur de liens PDF

Liste tous les liens d'un PDF — externes, internes, e-mail et les URL brutes du texte sans annotation — avec page, texte affiché et signalements de risque.

upload_file

Cliquez pour parcourir ou glissez-deposez des fichiers ici

Choisissez un PDF dont lister les liens

Accepte : .pdf,application/pdf

shieldAucun lien de ce document n'est jamais appelé. Tout est lu localement, donc un PDF suspect peut être inspecté sans contacter le serveur d'en face.

Outils similaires

Extracteur de tableaux PDF

Extracteur de tableaux PDF

Repère les tableaux d'un PDF et les exporte en CSV ou XLSX, en affichant la méthode de détection et la confiance de chaque tableau.

Extracteur de données structurées PDF

Extracteur de données structurées PDF

Transforme un PDF en JSON structuré — titres, paragraphes, listes, tableaux et images — depuis l'arbre balisé ou par inférence de mise en page.

Extracteur de fichiers joints PDF

Extracteur de fichiers joints PDF

Trouvez et téléchargez tous les fichiers joints à un PDF, y compris ceux cachés dans les annotations et les fichiers associés PDF 2.0.

Inspecteur de JavaScript PDF

Inspecteur de JavaScript PDF

Trouve tous les scripts d'un PDF — actions de document, événements de page et d'annotation, calculs de formulaire — et les affiche sans jamais les exécuter.

Outil d'Accentuation d'Image

Outil d'Accentuation d'Image

Accentuez les photos floues dans votre navigateur avec un filtre de convolution précis. Intensité réglable, 100% privé.

Pivoter une Image

Pivoter une Image

Faites pivoter des images selon des angles personnalisés.

Générateur de Booléens Aléatoires

Générateur de Booléens Aléatoires

Générez des listes de valeurs vrai/faux aléatoires avec probabilité et quantité configurables.

apps

Plus d'outils

Parcourez notre collection complète d'outils en ligne gratuits.

Deux sortes de liens, et la plupart des outils n'en voient qu'une

Un hyperlien dans un PDF est une annotation de lien : un rectangle sur la page auquel une action est attachée. Tous les outils qui « extraient les liens » lisent celles-là. Mais un document contient aussi des URL et des adresses e-mail simplement tapées dans le texte et jamais transformées en annotations : une note de bas de page citant https://example.org/docs, une adresse dans un bloc de signature. Pour le lecteur, ce sont des liens. Pour qui ne lit que /Annots, ils sont invisibles. Cet outil signale les deux et dit lequel est lequel.

Ce qu'il rapporte

  • Liens externes : cibles http et https.
  • Liens internes : sauts à l'intérieur du document. La destination est résolue en un vrai numéro de page, qu'il s'agisse d'un tableau de destination explicite ou d'une destination nommée dans l'arbre des noms.
  • mailto et tel : affichés sans leur schéma, pour que l'adresse ou le numéro se lisent.
  • Liens fichier : cibles qui ouvrent quelque chose hors du document.
  • Actions JavaScript : une URI javascript: qui exécute du code au clic.
  • URL et e-mails non liés : trouvés dans le texte, signalés à part, et écartés s'ils se trouvent déjà dans une annotation de lien.

Chaque entrée porte sa page, son texte affiché (reconstitué à partir des mots de la page situés dans le rectangle de l'annotation, car une annotation de lien ne stocke aucun texte) et sa cible.

Signalements

  • javascript : cliquer exécute du code dans la visionneuse.
  • mismatch : le texte visible est une URL pointant vers un hôte alors que le lien réel pointe ailleurs. C'est la forme classique de l'hameçonnage, et une visionneuse PDF n'affiche que le texte. À voir avant de cliquer.
  • no-target : une annotation de lien sans URL ni destination résoluble ; morte dans toutes les visionneuses.
  • relative : une cible sans schéma, qui se résout par rapport à l'endroit où le fichier est ouvert.

Rien n'est téléchargé

Aucune URL du document n'est jamais demandée. C'est important : un PDF suspect peut être inspecté ici sans toucher au serveur d'en face et sans révéler que vous l'avez ouvert. Le fichier est analysé entièrement dans votre navigateur et rien n'est envoyé.

Export

CSV — une ligne par lien avec page, type, texte affiché, cible, page de destination résolue et signalements — ou JSON avec les mêmes données plus les rectangles, si vous voulez bâtir dessus.