あなたにとっては完全に読みやすく見えるPDFでも、スクリーンリーダーを使う人、キーボードだけでのナビゲーション設定を使う人、あるいは弱視の拡大鏡を使う人にとっては、ほとんど使い物にならないことがあります。アクセシビリティはニッチな関心事ではありません——しばしば法的な要件であり、常に良い実践です。ここでは、実際にPDFをアクセシブルにするものは何か、そしてすでに持っているツールでそれに近づく方法を解説します。
PDFにとって「アクセシブル」とは実際に何を意味するか
アクセシブルなPDFとは、単に読みやすいものではなく、支援技術によって利用可能なものです。具体的には、次のことを意味します。
- スクリーンリーダーが、要素が視覚的にたまたま配置された順序ではなく、正しい順序でコンテンツを読み上げられること。
- テキストが実際のテキストであり、テキストの画像ではないこと。 スクリーンリーダーはピクセルを読むことができず、実際の文字データしか読めません。
- 画像に、それが何を示しているかを説明する代替テキストがあること。 画像を見ることができないユーザーのためです。
- 見出しが、単にそのように見えるようスタイルされているだけでなく、見出しとしてタグ付けされていること。 これにより、スクリーンリーダーのユーザーは、線形にスクロールする代わりに、文書構造でナビゲートできます。
- 色だけが情報を伝える唯一の手段ではないこと。 意味を伝えるのに純粋に赤対緑に依存するチャートは、色覚異常の読者を排除してしまいます。
- 文書が、マウスではなくキーボードでナビゲートする人のために、論理的なタブ順序を持っていること。
PDFは完全に普通に見えても、これらのすべてに失敗している可能性があります。
コンプライアンスを超えてこれが重要な理由
Reduce your PDF file size instantly. No software needed.
法的要件(米国のADA、欧州アクセシビリティ法、米国政府文書のためのSection 508など)は現実のものであり、ますます強く執行されています——しかし、アクセシビリティへの取り組みは、特定の規則がカバーする範囲を超えて、より多くの人にとって文書を良くします。
- スクリーンリーダーのユーザーや弱視の人が最も明白な受益者ですが、適切な構造は、長い文書の中で特定のセクションを流し読みする誰にとっても役立ちます。
- 実際のテキスト(スキャンされた画像ではなく)は検索可能でコピー可能であり、ブラウザの翻訳ツールとも連携します——アクセシビリティの改善と一般的な使いやすさの改善は大きく重なり合っています。
- 一般に配布される文書——政府のフォーム、公開されたレポート、教育資料——は、社内限定のファイルよりもはるかに多くの読者を持つため、アクセシビリティの欠如がより重大な結果を招きます。
最も一般的なアクセシビリティの失敗:スキャンされた文書
スキャンされたページは——たとえ完全に鮮明で高解像度のスキャンであっても——画像です。テキストレイヤーがまったくないため、スクリーンリーダーには読むものが何もなく、単に絵として認識されます。これは、PDFにおいて最も一般的で、かつ最も修正しやすいアクセシビリティの問題です。
修正方法はOCR PDFであり、スキャンされた画像内のテキストを認識し、その裏に本物の選択可能なテキストレイヤーを構築します。これだけで、文書は完全にアクセス不可能な状態から、少なくとも支援技術で読める状態へと変わります——ただし、OCR単体では適切な見出し構造や読み上げ順序は追加されないため、以下の注意点も参照してください。
デジタルで作成されたPDFをよりアクセシブルにする
Turn any PDF into an editable Word document in seconds.
Word、Google Docsなどから書き出された(スキャンではない)PDFの場合、アクセシビリティはほとんどの部分で、元の文書がどのように作られたかにかかっています。
- 元の文書で本物の見出しスタイル(見出し1、見出し2など)を使用してください。単にテキストを太字で大きくするだけではいけません——ほとんどの書き出しツールは見出しスタイルを適切なPDFタグに変換しますが、手動でスタイルを設定しただけのテキストはそうなりません。
- 書き出す前に、元の文書で画像に代替テキストを追加してください。 これは通常、PDFのタグ付けにそのまま引き継がれます。
- 表形式のデータには、タブやスペースで整列を偽装するのではなく、本物の表構造を使用してください。 本物の表は、スクリーンリーダーがナビゲートできる構造とともに書き出されます。手動で間隔調整されたテキストは、単に混乱を招く文字の羅列として読み上げられます。
- リンクには説明的なテキストを付けてください。 (「ここをクリック」ではなく「レポート全文を読む」のように)スクリーンリーダーのユーザーは、しばしばページ上のリンクの一覧を呼び出してナビゲートしますが、「ここをクリック」が何度も繰り返されると、文脈から切り離されて意味をなしません。
元の文書(Word、Google Docs、CMS)でこれらを正しく行っておくことは、後からPDF自体を修正しようとするよりも、はるかに多くのアクセシビリティ作業を節約します。
PDFがすでに存在する状態で現実的に修正できること
完成したPDFがすでにある場合、選択肢は狭くなりますが、ゼロではありません。
- スキャンであれば、OCRを実行して、少なくとも文書に本物のテキストを取り込みます。
- PDF注釈でテキスト注釈を追加し、文脈が欠けているコンテンツを補いますが、これは適切な構造タグ付けの代わりにはなりません。
- カーソルで上から下へテキストを選択してみることで、読み上げ順序を手動で確認します。 選択が予想外に飛び回る場合、下地となるコンテンツの順序が視覚的なレイアウトと一致していません。
深い構造的な修正——適切な見出しタグ、表構造、それらを一切持たずに作られた文書への完全なタグ付け——は、一般的に元のソースに戻って再構築するか、ブラウザベースのPDFツールにできる範囲を超えた専用のアクセシビリティ修復ソフトウェアが必要です。大量の文書に対して公式のコンプライアンス対応に取り組んでいる場合、どんなツールでも事後的に完全なタグ付けを後付けできると想定する前に、これを知っておく価値があります。
よくある質問
検索可能なPDFは自動的にアクセシブルなPDFですか? いいえ——(OCRによる)検索可能なテキストは必要条件ですが十分条件ではありません。完全なアクセシビリティには、適切な見出し構造、代替テキスト、論理的な読み上げ順序、正しいタグ付けも必要であり、これらはOCR単体では追加されません。
PDFlexaは、PDF/UAのようなアクセシビリティ標準に私のPDFを完全準拠させられますか? PDFlexaのOCRツールは最も一般的な失敗(スキャンされた文書にテキストレイヤーがないこと)を解決しますが、完全なPDF/UA準拠には構造的なタグ付けが関わり、それは元の文書の段階か、既存ファイル向けの専用アクセシビリティソフトウェアで扱うのが最善です。
PDFに代替テキストを追加するのは、Word文書と同じように機能しますか? コンセプトは同じですが、既存のPDFに直接代替テキストを追加するには、通常、変換前に代替テキストを含めて元の文書を再構築する必要があります——完成したPDFへの後付けはより限定的です。
スキャンした文書がOCR後もアクセシビリティチェックに失敗するのはなぜですか? OCRはテキストレイヤーを追加しますが、見出し構造、代替テキスト、タグ付けを自動的には追加しません——スキャンされた文書は、テキストが読めるようになった後も、本質的には構造化されていないPDFのままです。
PDFがアクセシブルかどうかを確認するのに特別なソフトウェアは必要ですか? 無料のアクセシビリティチェッカーが存在します(Adobe Acrobatに組み込まれているものや、PAC——PDF Accessibility Checkerのようなスタンドアロンツールを含む)。これらは、欠落しているタグ、代替テキスト、構造上の問題にフラグを立てます。
まとめ
アクセシビリティは、元のWordやGoogle Docの段階で——適切な見出し、代替テキスト、本物の表を使って——正しく行うのが最も簡単で、事後的に後付けするのが最も難しいものです。スキャンから始める場合、OCRは不可欠な最初のステップですが、それだけで解決するわけではありません。アクセシビリティは、後から追加するチェックボックスではなく、文書を作る過程の一部として扱ってください。
スキャンされた文書から作業していますか?OCR PDFから始めましょう——無料で、ブラウザ内で本物のテキストレイヤーを構築します。
既存の文書に欠けている文脈を補う必要がありますか?PDF注釈で、ページに直接メモやテキストを追加できます。