删除工具为什么必须自证
多数「删除 PDF 元数据」的程序清掉几个字段就把文件还给你。有两件事经常出错,而且不去核查根本看不出来。
对象在删除后仍然存活。 把 /Metadata 从目录里去掉,只是解除了对 XMP 包的引用,并没有删除它。大多数写出程序会把解析到的每个对象都序列化出去,无论是否仍被引用,于是这个包依然在文件里,任何逐个扫描对象、而不是顺着目录走的程序都能读到它。本工具在每次删除之后都会做一次可达性清扫,把再也无人指向的对象丢掉,包括文件里本来就有的孤儿对象。
保存是增量式的。 把清理后的目录追加到原始字节之后,旧目录及其中所有取值依旧完好地留在文件靠前的位置,取回它们只需要一条命令。本工具始终整份重写文件。
验证环节
写出之后,新字节会被重新打开、从头读取。你会看到每个字段的前后取值,然后是更深一层的核查:每个被删除的值都会在写出文件的所有字符串、所有字典键和所有可解码流中搜索一遍。
每个值由此得到三种诚实答案之一:
- 已消失 — 在输出中任何地方都找不到。
- 仍在文件中 — 作为错误报告出来,绝不遮掩。
- 出现在页面内容里 — 这个值是打在页面本身上的,任何元数据工具都删不掉。那需要真正的涂黑,工具会直说,而不是暗示文件已经干净。
可以删除的内容
整个 Info 字典(可选择保留标题)、自定义 Info 键、/Producer 与 /Creator、XMP 包、文档级与每页的 /PieceInfo(InDesign 和 Illustrator 会在这里留下大量痕迹)、结构树与 mark info、嵌入文件、藏在各处的 JavaScript、/OpenAction 与附加动作、注释,以及 trailer 中把每个修订版关联回原始文件的文档 ID。
删除结构树会摧毁屏幕阅读器用户的可访问性,因此该项默认关闭,开启时会给出警告。
隐私
文件在你的浏览器中读取并重写,从不上传——对于一个专门用来删除你不想外传的信息的工具来说,这是唯一合理的安排。
Tiny Online Tools







