Tiny Online Tools logoTiny Online ToolssearchBuscar ferramentas…grid_viewTodas as ferramentas
Iniciochevron_rightFerramentas de PDFchevron_rightExtrator de anexos em PDFExtrator de anexos em PDF

Extrator de anexos em PDF

Encontre e baixe todos os arquivos anexados dentro de um PDF, inclusive os escondidos em anotações e em arquivos associados do PDF 2.0.

upload_file

Clique para procurar ou arraste e solte arquivos aqui

Selecione um PDF para procurar anexos

Aceito: .pdf,application/pdf

Ferramentas semelhantes

Extrator de links PDF

Extrator de links PDF

Lista todos os links de um PDF — externos, internos, de e-mail e os URL soltos no texto sem anotação — com página, texto visível e alertas de risco.

Extrator de dados estruturados de PDF

Extrator de dados estruturados de PDF

Converte um PDF em JSON estruturado — títulos, parágrafos, listas, tabelas e imagens — a partir da árvore etiquetada ou por inferência de layout.

Extrator de imagens PDF

Extrator de imagens PDF

Retira as imagens originais incorporadas num PDF — os JPEG byte a byte e o resto em PNG — com tamanho real, tamanho desenhado e PPP efetivos.

Inspetor de JavaScript em PDF

Inspetor de JavaScript em PDF

Encontra todos os scripts dentro de um PDF — ações de documento, eventos de página e anotação e cálculos de formulário — e permite lê-los sem executá-los.

Detector de PDF Digitalizado ou Pesquisável

Detector de PDF Digitalizado ou Pesquisável

Distinga texto real de uma digitalização e de uma digitalização com camada OCR, página a página.

PDF para JPG

PDF para JPG

Converta paginas PDF em imagens JPG de alta qualidade.

CSV para JSON

CSV para JSON

Converta arquivos CSV em dados JSON.

apps

Mais ferramentas

Explore nossa colecao completa de ferramentas online gratuitas.

O que este extrator encontra e os outros não

Um PDF pode carregar um anexo em três lugares completamente diferentes, e a maioria das ferramentas só olha o primeiro.

  1. A árvore de nomes /Names /EmbeddedFiles. É uma árvore balanceada, não uma lista. Assim que um documento passa de alguns poucos anexos, o produtor a divide em nós /Kids, e uma ferramenta que lê apenas o vetor raiz informa zero arquivos em um PDF que claramente tem vários.
  2. As anotações /FileAttachment. O clipe que você vê na página. O arquivo fica pendurado na anotação e muitas vezes não está registrado na árvore de nomes.
  3. Os arquivos associados /AF. Foram acrescentados no PDF 2.0 e é aí que está a relevância comercial: as faturas eletrônicas ZUGFeRD, Factur-X, XRechnung e Order-X transportam assim o seu XML legível por máquina. Se o seu sistema contábil rejeita uma fatura, é esse o conteúdo a examinar.

O mesmo fluxo costuma ser alcançável por duas dessas rotas, então os arquivos são identificados pela referência de objeto e mesclados, com todas as origens exibidas.

O que aparece de cada arquivo

Nome, descrição, tipo MIME declarado, tamanho declarado e real, datas de criação e modificação, a soma MD5 quando o produtor a gravou, o papel /AFRelationship e a página onde o anexo está.

A verificação de tipo

O tipo declarado é o que o PDF afirma. Esta ferramenta também lê os primeiros bytes do arquivo e informa o que eles realmente são. Um anexo chamado notas.txt que começa com PK é um arquivo ZIP; um que começa com MZ é um executável do Windows. Ambos são sinalizados, e vale saber disso antes de abrir qualquer coisa.

Pré-visualização e download

Texto, CSV, JSON e XML aparecem na própria página; PNG, JPEG, GIF, WebP e BMP são exibidos como imagens. O resto é apenas download. Nada é executado e nada é enviado pela rede.

Baixe um anexo isolado ou todos de uma vez em um ZIP.

Privacidade

O PDF é analisado no seu navegador com JavaScript. Ele nunca é enviado, então documentos confidenciais e seus anexos permanecem na sua máquina.