PDF无障碍指南:让所有人都能使用文档的实用方法

· · · 阅读需 7 分钟

一份对你来说完全可读的PDF,对使用屏幕阅读器、纯键盘导航,或低视力放大工具的人来说,可能几乎无法使用。无障碍访问并不是一个小众议题——它常常是一项法律要求,而且始终是一种良好实践。以下是究竟什么让一份PDF真正具备无障碍性,以及如何借助你已有的工具更接近这个目标。

PDF的"无障碍"究竟意味着什么

一份具备无障碍性的PDF不仅仅是可读的——它是辅助技术能够使用的。具体来说,这意味着:

  • 屏幕阅读器能按正确的顺序朗读内容,而不是根据元素恰好的视觉位置而变得杂乱无章。
  • 文字是真正的文字,而不是文字的图片——屏幕阅读器无法读取像素,只能读取真实的字符数据。
  • 图片配有替代文字,描述图片展示的内容,供无法看到图片的用户使用。
  • 标题被标记为标题,而不只是被设置成看起来像标题的样式——这让屏幕阅读器用户能够按文档结构导航,而不是线性地滚动。
  • 颜色不是传达信息的唯一方式——一张纯粹依靠红绿对比来传达含义的图表,会把色盲读者排除在外。
  • 文档拥有合乎逻辑的Tab键顺序,供用键盘而非鼠标导航的用户使用。

一份PDF可以看起来完全正常,却在以上每一项上都不及格。

为什么这不仅仅关乎合规

Compress PDF Online — Free

Reduce your PDF file size instantly. No software needed.

Use Tool Now →

法律要求(比如美国的ADA、欧洲无障碍法案,或美国政府文档的第508条)是真实存在且日益被强制执行的——但无障碍工作也让文档对更多人更好用,而不仅限于具体规则所覆盖的范围:

  • 屏幕阅读器用户和低视力人群是最明显的受益者,但正确的结构也能帮助任何想在长文档中快速定位某个具体章节的人。
  • 真实文字(相对于扫描图片)是可搜索、可复制的,并且能与浏览器翻译工具配合使用——无障碍方面的改进与通用可用性的改进大量重叠。
  • 面向公众分发的文档——政府表格、发布的报告、教育材料——受众规模远大于仅供内部使用的文件,这使得无障碍方面的缺陷后果更严重。

最常见的无障碍失败:扫描文档

一份扫描页面——即便是一份完全清晰、高分辨率的扫描件——本质上是一张图片。它完全没有文字层,这意味着屏幕阅读器无从读取;它看到的只是一张图片。这是PDF中最常见、也最容易修复的无障碍问题。

解决办法是OCR PDF,它能识别扫描图像中的文字,并在其背后构建出真正可选中的文字层。仅凭这一点,就能让一份文档从完全不可访问变为至少能被辅助技术读取——不过请参阅下文的注意事项,因为OCR本身并不会添加正确的标题结构或阅读顺序。

让数字化创建的PDF更具无障碍性

Convert PDF to Word — Free

Turn any PDF into an editable Word document in seconds.

Use Tool Now →

对于从Word、Google文档或类似软件导出的PDF(而非扫描件),无障碍性主要取决于源文档最初是如何构建的:

  • 在源文档中使用真正的标题样式(标题1、标题2等),而不只是把文字加粗放大——大多数导出工具会把标题样式转换为正确的PDF标签,而手动设置样式的文字则不会获得这种标签。
  • 在导出前为源文档中的图片添加替代文字——这通常会一并保留到PDF的标签结构中。
  • 对表格数据使用真正的表格结构,而不是用制表符或空格伪造对齐——一个真正的表格导出后会带有屏幕阅读器可以导航的结构;手动排版的文字只会被读成一串令人困惑的词语。
  • 给链接添加具描述性的文字(用"阅读完整报告"而不是"点击这里")——屏幕阅读器用户经常通过调出页面上的链接列表来导航,其中"点击这里"重复出现多次时,脱离上下文毫无意义。

在转换之前,在源文档(Word、Google文档、你的CMS)中把这些做对,比事后在PDF本身里试图修复能节省得多的无障碍工作量。

一份PDF已经生成之后,你现实中能修复什么

一旦你手头有了一份成品PDF,你的选择就变窄了,但并非完全没有:

  • 如果是扫描件,运行OCR,至少让文档中拥有真正的文字。
  • 使用批注PDF添加文字批注,补充缺失上下文的内容,不过这无法替代正确的结构化标签。
  • 手动检查阅读顺序,尝试用光标从上到下选中文字——如果选中范围出现意外的跳跃,说明底层内容顺序与视觉布局不一致。

深层的结构性修复——正确的标题标签、表格结构,为一份从未做过这些的文档补全全部标签——通常需要回到源文档重新构建,或者使用超出基于浏览器的PDF工具能力范围的专业无障碍修复软件。如果你正在为大批量文档处理正式合规问题,最好提前了解这一点,而不是想当然地认为任何工具都能事后补全完整的标签。

常见问题

一份可搜索的PDF自动就是一份具备无障碍性的PDF吗? 不是——(通过OCR实现的)可搜索文字是必要条件,但并不充分。完整的无障碍性还需要正确的标题结构、替代文字、合乎逻辑的阅读顺序和正确的标签,而这些都不是OCR本身能添加的。

PDFlexa能让我的PDF完全符合PDF/UA之类的无障碍标准吗? PDFlexa的OCR工具解决了最常见的失败情况(扫描文档中没有文字层),但完整的PDF/UA合规涉及结构化标签,最好在源文档阶段处理,或者对已有文件使用专业的无障碍软件。

给PDF添加替代文字,和在Word文档中添加替代文字的方式一样吗? 概念是一样的,但直接在一份已有PDF中添加替代文字,通常需要在转换之前重新构建包含替代文字的源文档——事后在成品PDF中补充这一点局限性更大。

为什么我的扫描文档即使做了OCR之后,仍然无法通过无障碍检测? OCR会添加文字层,但不会自动添加标题结构、替代文字或标签——即便文字已经可读,一份扫描文档在本质上仍然是一份没有结构的PDF。

我需要专门的软件来检查我的PDF是否具备无障碍性吗? 存在免费的无障碍检测工具(包括Adobe Acrobat内置的工具,以及PAC——PDF无障碍检查器等独立工具),它们能标记出缺失的标签、替代文字和结构性问题。

总结

无障碍性最容易在源头做对——在你原始的Word或Google文档中使用正确的标题、替代文字和真正的表格——而在事后补救则最困难。如果你的起点是一份扫描件,OCR是必不可少的第一步,尽管它并非解决方案的全部。请把无障碍性当作构建文档过程的一部分,而不是事后添加的一个勾选项。

处理的是扫描文档?从OCR PDF开始——完全免费,并在你的浏览器中构建真正的文字层。

需要为已有文档补充缺失的上下文?批注PDF可以让你直接在页面上添加备注和文字。

试用这些免费 PDF 工具

压缩PDF → 合并PDF → PDF转Word → JPG转PDF →
Abdel B.

PDFlexa 团队创建实用指南,帮助您更快速地处理 PDF 文件。所有工具均可免费使用——无需账户。

觉得有帮助吗?分享一下: Facebook X LinkedIn