跳至内容
100% 本地 · 上传 0 KB压缩 PDF

PDF/UA 解析:什么让 PDF 可访问

PDF/UA(Universal Accessibility)是可访问 PDF 文件的 ISO 14289 标准。它定义了 PDF 必须包含什么,才能让辅助技术——屏幕阅读器、文本转语音、重排工具——能够阅读和导航。本页解释 PDF/UA 的要求、为什么"普通"PDF 通常不可访问,以及哪些工具能生成合规文件。

标准

什么是 PDF/UA?

PDF/UA 是定义可访问 PDF 的国际标准(ISO 14289-1:2014,针对 PDF 2.0 更新为 ISO 14289-2:2024)。它被许多司法管辖区的无障碍法律和采购要求引用,包括美国的 Section 508 和欧洲无障碍法案。通过 PDF/UA 验证的 PDF 可被依赖屏幕阅读器、键盘导航和高对比度模式的人群使用。

PDF/UA 是更广泛的 PDF 规范的一个 profile——它不添加新特性,而是要求现有特性被正确使用。PDF/UA 合规文件也是合法的 PDF,只是额外具有使其可访问的结构。

要求

PDF/UA 要求什么

可访问 PDF 的四大支柱:

  • 标签化 PDF。文件必须包含结构树——一组描述每段内容是什么的标签(Paragraph、Heading、List、Table、Figure 等)。没有标签,屏幕阅读器会把文件视为无意义字符流。这是最重要的要求,也是大多数 PDF 失败之处。
  • 阅读顺序。标签必须按读者阅读顺序排列。双栏布局必须这样标签化:屏幕阅读器先读第一栏从上到下,再读第二栏从上到下——而不是横跨页面。阅读顺序是结构树的一部分,但必须正确,而不仅仅是存在。
  • 图的替代文本。每张图片、图表和插图都必须有文本替代(Figure 标签上的 Alt 条目),描述图片传达的内容。装饰性图片应标记为 artifact(完全不读)。
  • 文档语言。PDF 必须声明其主语言(例如 en-US、fr-FR),以便屏幕阅读器使用正确的发音和 TTS 嗓音。对于混合语言的文档,也可以按 span 设置语言。

除这四点之外,PDF/UA 还要求:表格具有正确的表头/行/列结构,标题正确嵌套(H3 之前必须有 H2),结构树之外没有内容(artifact 除外),以及链接文本有意义(不是"点击这里")。

现实

为什么大多数 PDF 不可访问

用文字处理软件默认设置打印的 PDF 通常未标签化——它根本没有结构树。屏幕阅读器读这种文件得到的是按布局顺序排列的字符流,常常毫无意义(尤其是多栏或表格密集的文档)。扫描的 PDF 更糟:它们是页面的图像,完全没有文本,只能通过 OCR 访问。

生成标签化的可访问 PDF 需要创作应用输出结构树,且作者提供替代文本并使用语义标题样式。Word、Google Docs、LibreOffice 和 InDesign 都能生成标签化 PDF,但前提是源文档结构正确且导出设置正确。

制作

如何生成 PDF/UA 合规文件

  • Microsoft Word:使用内置标题样式,给图片添加替代文本(右键 > 编辑替代文本),设置文档语言,然后勾选"为无障碍使用文档结构标签"导出。
  • Google Docs:使用标题样式和替代文本,然后 文件 > 下载 > PDF 文档。Google Docs 默认输出标签化 PDF。
  • Adobe InDesign:使用文章面板和段落样式,在对象导出选项中添加替代文本,然后勾选"标签化 PDF"和"使用结构作为 Tab 顺序"导出。
  • 验证:使用 Adobe Acrobat Pro 的"使可访问"引导操作和完整检查工具,或独立验证器如 PAC(PDF Accessibility Checker)或 axesPDF。

IXPDF

IXPDF 在无障碍方面做和不做的事

IXPDF 的工具作用于 PDF 容器——合并、拆分、旋转、加水印、编辑元数据。当结构树存在时它们会保留它(标签化 PDF 经过合并 PDF 后仍是标签化的),但不会创建标签、修正阅读顺序或添加替代文本。从无标签 PDF 生成标签化 PDF 是一个难题,在我们的研究路线图上,目前不提供。

如果你需要可访问 PDF,正确做法是在源(Word、Docs、InDesign)处就生成标签化版本,而不是事后添加标签。IXPDF 适合做源导出之后的结构性编辑——合并章节、旋转横向页面、在元数据中设置文档语言。

继续阅读

相关资源