术语

PDF 无障碍

PDF 无障碍是利用正确的结构、标签和文本层,让依赖屏幕阅读器、键盘导航或其他辅助技术的用户能够使用 PDF 文档。

PDF 无障碍为什么重要

PDF 是使用最广的文档格式之一,但并非天生支持无障碍访问。视觉上显示正常的 PDF,对使用屏幕阅读器或键盘导航的用户来说,可能完全无法使用。

屏幕阅读器会按顺序处理文档,依靠结构化标记判断阅读顺序、识别标题、说明图像并浏览表格。缺少这些结构时,屏幕阅读器可能按错误顺序朗读内容、完全跳过图像,或把表格读成无法理解的连续文字。

在许多场景中,无障碍也是法律要求。受 ADA、Section 508 或《欧洲无障碍法》约束的政府机构、教育机构和组织必须提供无障碍文档。不符合要求可能引发法律行动,也会让依赖辅助技术的用户无法获取信息。

哪些要素让 PDF 支持无障碍访问

无障碍 PDF 需要满足多项结构要求,它们共同帮助辅助技术正确呈现内容。

  • 标签——结构标签定义标题、段落、列表、表格和图形,为屏幕阅读器提供逻辑阅读顺序和层级;
  • 文本层——可选择、搜索和朗读的真实文字,而不是文字图像。基于截图的 PDF 需要通过 OCR 生成这一层;
  • 替代文本——附加在图像和图形上的说明,让屏幕阅读器可以向看不到图像的用户传达其内容;
  • 阅读顺序——与视觉版式一致的明确顺序。没有指定阅读顺序时,屏幕阅读器可能在分栏、页眉和页脚之间随意跳转;
  • 书签和导航——文档书签与带链接的目录,让键盘用户不必逐页滚动,也能跳转到不同章节。

带标签 PDF 与可搜索 PDF 的无障碍区别

这两个概念有重叠,但不能互换。可搜索 PDF 有文本层,可以选择和查找文字,却可能没有任何标签。带标签 PDF 有结构化标记,但如果创建方式有误,理论上也可能缺少文本层。

完整的无障碍访问需要两者兼备。文本层让机器能够读取内容,标签则把标题、列表、表格关系和图形说明等结构传达给辅助技术。

把截图转换为 PDF 的工具可以同时处理两项要求。OCR 生成文本层,自动标记则添加基本结构元素。两者结合后,扁平的图像导出文件就会变成可以搜索、浏览和无障碍使用的文档,不必全部手动修复。

对于大量使用截图的流程,最好在导出时检查无障碍,而不是以后再清理。扁平的纯图像 PDF 一旦已经分享出去,修复起来更慢,也更容易被跳过。

常见错误

  • 以为视觉清晰就代表无障碍。 即使 PDF 设计良好、视觉清楚,缺少标签和文本层时仍可能完全无法无障碍使用。无障碍取决于结构,而不是外观。
  • 事后添加标签,却不检查阅读顺序。 自动标记工具可以分配标签,但在多栏版式中尤其容易排错阅读顺序。添加标签后应始终核对阅读顺序。
  • 没有正确处理装饰性图像的替代文本。 装饰性图像应标记为非内容元素,让屏幕阅读器跳过;信息性图像则需要描述性替代文本。图像没有标签时,屏幕阅读器可能只读出文件名,也可能什么都不读。
  • 把截图导出为纯图像 PDF。 以扁平图像形式放入 PDF 的截图既没有文本层,也没有标签,屏幕阅读器无法读取。应在导出时应用 OCR 和标签,让文档支持无障碍访问。

常见问题

哪些问题会让 PDF 无法无障碍使用?

最常见的原因是缺少结构标签。没有标签,屏幕阅读器就无法判断阅读顺序、标题层级或图像替代文本。纯图像 PDF(例如扫描文档或没有文本层的截图导出文件)也无法无障碍使用,因为其中没有可选择或读取的文字。

可搜索 PDF 和无障碍 PDF 是一回事吗?

不是。可搜索 PDF 有文本层,可以查找和选择文字,但仍可能缺少屏幕阅读器浏览标题、列表、表格和阅读顺序所需的结构标签。无障碍 PDF 既需要文本层,也需要正确的标签。

内部使用的 PDF 也需要支持无障碍访问吗?

在许多司法辖区,需要。ADA、Section 508 和《欧洲无障碍法》等法规适用于政府机构和接受公共资金的组织所使用的内部文档。即使没有法律要求,无障碍文档也能帮助使用辅助技术的同事。

如何检查 PDF 是否支持无障碍访问?

Adobe Acrobat Pro 内置无障碍检查器,可以评估标签、阅读顺序、替代文本等项目。PAC(PDF Accessibility Checker)等免费工具也可以按照 PDF/UA 和 WCAG 标准进行验证。

可以让截图 PDF 支持无障碍访问吗?

可以,但需要添加文本层(截图中有文字时可使用 OCR)和结构标签。部分导出工具能从截图自动生成带标签、可搜索的 PDF,一次完成文本层和基本标签结构。

参考资料

相关资料

什么是 PDF 无障碍? | 术语表 | Shotomatic