自动检查能告诉你什么,不能告诉你什么
它能告诉你:这份 PDF 没有结构树、没有一张插图带替代文字、标题层级从 H2 跳到了 H4、某个表单字段没有提示文字。这些都是写在文件里的事实。
它无法告诉你:「image1.png」是不是对一张图表的有效描述、阅读顺序对看不见页面的人是否说得通、标题是否描述了紧随其后的内容。没有任何自动化工具能够认证 PDF/UA 或 WCAG 合规,本工具也不作此声称。它找出机器能看见的问题,好让人工审核从真正有价值的地方开始,而不是从显而易见的地方开始。
十四条规则
- 带标签 ——
/MarkInfo /Marked true且 存在/StructTreeRoot。二者缺一,辅助技术看到的就只是一串字形。 - 语言 —— 格式正确的
/Lang,否则屏幕阅读器会用中文语音去读英文。 - 标题 与 DisplayDocTitle —— 一个真正的标题,以及一项告诉阅读器使用它而非文件名的偏好设置。后者是一条几乎所有文档都不满足的 PDF/UA 要求。
- 插图替代文字 —— 每个
/Figure都要有/Alt或/ActualText。 - 标题层级 —— 从 H1 开始,且从不跳级。
- 表头单元格 —— 使用
/TH,最好再带上/Scope或/Headers。 - 列表 —— 真正的
/L、/LI、/Lbl、/LBody,而不是以项目符号开头的普通段落。 - 链接 —— 有替代文字、有
/Link元素,链接文字脱离上下文后仍然有意义。 - 表单字段 —— 每个字段都有
/TU提示文字。 - 阅读顺序 —— 大多数工具都会跳过的一项检查。结构顺序会与同一内容的视觉顺序逐栏比对,每一处分歧都会连同它在页面上的位置一起报告。
- 对比度 —— 页面被光栅化后,逐行采样文字。这是近似结果,并会明确标注。
- 未标记内容 —— 页面上不归属于任何结构元素的字形。
- 修饰元素 —— 处于阅读顺序之内、而非被标记为装饰的页眉页脚。
不适用的规则 —— 没有表格、没有表单 —— 会被排除在评分之外,而不是算作通过。因文档未带标签而无法检查的规则会被报告为无法检查,不计入任何分数。
隐私
PDF 的读取、渲染和评分全部在你的浏览器内完成,不会上传任何内容。
Tiny Online Tools







