提取图片,而不是图片的截图
多数“PDF 转图片”工具是把每一页渲染成位图。你得到的是整页——文字、背景全都在里面——分辨率还是你自己挑的。这和拿到作者放上去的那张照片完全是两回事。
PDF 里的图片是文件中的独立对象,常见情况下就是一个完整的 JPEG,按导入时的样子原封不动地压缩存放。这个工具遍历对象图,找到它们,然后把 JPEG 直接写出来:同样的字节、同样的画质,不做第二轮有损压缩。
会得到什么
DCTDecode(JPEG)与JPXDecode(JPEG 2000):拆掉传输过滤器之后,就是逐字节的原始文件,不做任何重新编码。FlateDecode、LZWDecode、RunLengthDecode位图:解码后写成 PNG,正确处理色彩空间(灰度、RGB、CMYK、基于 ICC、带调色板的索引色)、位深(每分量 1、2、4、8 或 16 位)、/Decode数组以及/SMask透明通道。/ImageMask蒙版:1 位模板输出为带透明通道的 PNG。JBIG2Decode与CCITTFaxDecode:它们不是独立的图片文件,浏览器也无法解码。工具会列出它们的尺寸、过滤器与所在页,并标注为无法提取,而不是悄悄丢掉。
有效 DPI 才是关键数字
一张 600 × 400 的位图,放进一英寸的框里是 600 DPI,铺满四英寸是 150 DPI,铺满八英寸只有 75 DPI。单看像素尺寸说明不了任何印刷质量问题。本工具解析页面内容流、跟踪其中的变换矩阵,为每张图报告它实际被绘制的尺寸以及由此得出的 DPI——低于 300 标琥珀色,低于 150 标红色。
于是它成了回答两个非常实际的问题的最快方式:这个 PDF 为什么有 40 MB?(一张没人需要的 1200 DPI 图片)以及为什么印出来这么糊?(一个 90 DPI 的标志被拉满整个封面)。
已去重
一个图片对象被画在十二页上,那是一张图用在十二页,而不是十二张图。卡片会列出用到它的每一页。
过滤
设置最小宽高,跳过文字处理软件到处散落的 1 × 1 占位图;也可以选择把存在于文件资源中但从未被绘制的图片一并列出。
隐私
PDF 的打开与解包全部在你的浏览器内完成。不上传任何内容,处理期间也不发起任何网络请求。
Tiny Online Tools







