PDF, który Tobie wydaje się idealnie czytelny, może być niemal bezużyteczny dla kogoś korzystającego z czytnika ekranu, nawigacji wyłącznie za pomocą klawiatury czy powiększalnika dla osób słabowidzących. Dostępność nie jest niszową sprawą — często jest wymogiem prawnym, a zawsze jest dobrą praktyką. Oto, co naprawdę czyni PDF dostępnym i jak zbliżyć się do tego celu, korzystając z narzędzi, które już masz.
Co „dostępny" naprawdę oznacza dla PDF
Dostępny PDF to nie tylko taki, który da się przeczytać — to taki, który można wykorzystać przy pomocy technologii wspomagających. Konkretnie oznacza to:
- Czytnik ekranu może odczytać treść w prawidłowej kolejności, a nie pomieszaną na podstawie tego, jak elementy akurat są rozmieszczone wizualnie.
- Tekst jest prawdziwym tekstem, a nie obrazem tekstu — czytniki ekranu nie potrafią odczytać pikseli, tylko rzeczywiste dane znaków.
- Obrazy mają tekst alternatywny opisujący, co przedstawiają, dla użytkowników, którzy ich nie widzą.
- Nagłówki są oznaczone jako nagłówki, a nie tylko stylizowane tak, by na nie wyglądać — to pozwala użytkownikom czytników ekranu nawigować po strukturze dokumentu zamiast przewijać go liniowo.
- Kolor nie jest jedynym sposobem przekazywania informacji — wykres, który polega wyłącznie na przeciwstawieniu czerwieni i zieleni, wyklucza czytelników z zaburzeniami rozpoznawania barw.
- Dokument ma logiczną kolejność tabulacji dla każdego, kto nawiguje za pomocą klawiatury zamiast myszy.
PDF może wyglądać całkowicie normalnie i mimo to nie spełniać żadnego z tych warunków.
Dlaczego to ma znaczenie poza samą zgodnością z przepisami
Reduce your PDF file size instantly. No software needed.
Wymogi prawne (jak ADA w USA, Europejski Akt o Dostępności czy Section 508 dla dokumentów rządowych USA) są realne i coraz bardziej egzekwowane — ale praca nad dostępnością po prostu sprawia też, że dokumenty są lepsze dla znacznie szerszej grupy osób, niż obejmują konkretne przepisy:
- Użytkownicy czytników ekranu i osoby słabowidzące są najbardziej oczywistymi beneficjentami, ale prawidłowa struktura pomaga też każdemu, kto przegląda długi dokument w poszukiwaniu konkretnej sekcji.
- Prawdziwy tekst (w przeciwieństwie do zeskanowanych obrazów) jest przeszukiwalny, można go kopiować i działa z narzędziami tłumaczenia w przeglądarce — poprawki dostępności i ogólne usprawnienia użyteczności w dużej mierze się pokrywają.
- Dokumenty rozpowszechniane publicznie — formularze rządowe, opublikowane raporty, materiały edukacyjne — mają znacznie większe grono odbiorców niż pliki wyłącznie wewnętrzne, co sprawia, że braki w dostępności mają poważniejsze konsekwencje.
Najczęstsza porażka dostępności: zeskanowane dokumenty
Zeskanowana strona — nawet perfekcyjnie czysty, wysokiej rozdzielczości skan — to obraz. Nie ma w ogóle warstwy tekstu, co oznacza, że czytnik ekranu nie ma czego czytać; widzi po prostu obrazek. To najczęstszy i zarazem najłatwiejszy do naprawienia problem dostępności w plikach PDF.
Rozwiązaniem jest OCR PDF, które rozpoznaje tekst na zeskanowanym obrazie i buduje pod nim prawdziwą, zaznaczalną warstwę tekstu. Samo to przenosi dokument ze stanu całkowicie niedostępnego do przynajmniej czytelnego dla technologii wspomagających — choć zobacz zastrzeżenia poniżej, ponieważ sam OCR nie dodaje prawidłowej struktury nagłówków ani kolejności czytania.
Zwiększanie dostępności cyfrowo utworzonego PDF
Turn any PDF into an editable Word document in seconds.
W przypadku PDF wyeksportowanego z Worda, Google Docs lub podobnego narzędzia (nie zeskanowanego), dostępność sprowadza się głównie do tego, jak zbudowano dokument źródłowy:
- Używaj prawdziwych stylów nagłówków (Nagłówek 1, Nagłówek 2 itd.) w dokumencie źródłowym, zamiast po prostu pogrubiać i powiększać tekst — większość narzędzi eksportu przekłada style nagłówków na właściwe znaczniki PDF, czego ręcznie stylizowany tekst nie otrzymuje.
- Dodaj tekst alternatywny do obrazów w dokumencie źródłowym przed eksportem — zwykle przenosi się to do znakowania PDF.
- Stosuj strukturę tabeli dla danych tabelarycznych, a nie tabulatory czy spacje udające wyrównanie — prawdziwa tabela eksportuje się ze strukturą, po której może nawigować czytnik ekranu; ręcznie rozstawiony tekst po prostu czyta się jako mylący ciąg słów.
- Nadawaj linkom opisowy tekst („przeczytaj pełny raport" zamiast „kliknij tutaj") — użytkownicy czytników ekranu często nawigują, wywołując listę linków na stronie, gdzie wielokrotnie powtórzone „kliknij tutaj" jest bez kontekstu pozbawione znaczenia.
Zadbanie o to wszystko już w dokumencie źródłowym (Word, Google Docs, Twój CMS) przed konwersją oszczędza znacznie więcej pracy nad dostępnością niż próba naprawienia tego później w samym PDF.
Co realistycznie da się naprawić, gdy PDF już istnieje
Gdy masz już gotowy PDF, Twoje opcje są węższe, ale nie zerowe:
- Uruchom OCR, jeśli to skan, aby przynajmniej wprowadzić do dokumentu prawdziwy tekst.
- Dodaj adnotacje tekstowe za pomocą Adnotuj PDF, aby uzupełnić treść, której brakuje kontekstu, choć to nie zastępuje właściwego znakowania strukturalnego.
- Sprawdź kolejność czytania ręcznie, próbując zaznaczyć tekst kursorem od góry do dołu — jeśli zaznaczenie nieoczekiwanie skacze, oznacza to, że kolejność treści leżącej u podstaw nie odpowiada układowi wizualnemu.
Głębokie poprawki strukturalne — prawidłowe znaczniki nagłówków, struktura tabel, pełne znakowanie dla dokumentu, który nigdy nie został z nimi zbudowany — zwykle wymagają powrotu do źródła i przebudowy albo specjalistycznego oprogramowania do naprawy dostępności, wykraczającego poza to, co potrafią przeglądarkowe narzędzia PDF. Jeśli pracujesz nad oficjalną zgodnością dla dużej liczby dokumentów, warto wiedzieć to z góry, zamiast zakładać, że jakiekolwiek narzędzie może po fakcie dodać pełne znakowanie.
Najczęściej zadawane pytania
Czy przeszukiwalny PDF jest automatycznie dostępnym PDF? Nie — przeszukiwalny tekst (dzięki OCR) jest konieczny, ale niewystarczający. Pełna dostępność wymaga też właściwej struktury nagłówków, tekstu alternatywnego, logicznej kolejności czytania i poprawnego znakowania, czego sam OCR nie dodaje.
Czy PDFlexa może uczynić mój PDF w pełni zgodnym ze standardami dostępności, takimi jak PDF/UA? Narzędzie OCR PDFlexy rozwiązuje najczęstszą porażkę (brak warstwy tekstu w zeskanowanych dokumentach), ale pełna zgodność z PDF/UA obejmuje znakowanie strukturalne, które najlepiej obsłużyć na etapie dokumentu źródłowego lub przy pomocy specjalistycznego oprogramowania do dostępności dla istniejących plików.
Czy dodawanie tekstu alternatywnego do PDF działa tak samo jak w dokumencie Word? Koncepcja jest ta sama, ale dodanie tekstu alternatywnego bezpośrednio do istniejącego PDF zwykle wymaga przebudowania dokumentu źródłowego z tekstem alternatywnym uwzględnionym przed konwersją — retrofitowanie go do gotowego PDF ma bardziej ograniczone możliwości.
Dlaczego mój zeskanowany dokument nie przechodzi kontroli dostępności nawet po OCR? OCR dodaje warstwę tekstu, ale nie dodaje automatycznie struktury nagłówków, tekstu alternatywnego ani znakowania — zeskanowany dokument pozostaje zasadniczo niestrukturalnym PDF nawet po tym, jak jego tekst stanie się czytelny.
Czy potrzebuję specjalnego oprogramowania, aby sprawdzić, czy mój PDF jest dostępny? Istnieją darmowe narzędzia do sprawdzania dostępności (w tym wbudowane w Adobe Acrobat, a także samodzielne narzędzia jak PAC — PDF Accessibility Checker), które oznaczają brakujące znaczniki, tekst alternatywny i problemy strukturalne.
Podsumowanie
Dostępność najłatwiej zapewnić już u źródła — dzięki prawidłowym nagłówkom, tekstowi alternatywnemu i prawdziwym tabelom w oryginalnym dokumencie Word czy Google Doc — a najtrudniej naprawić ją po fakcie. Jeśli zaczynasz od skanu, OCR jest niezbędnym pierwszym krokiem, choć nie jest całym rozwiązaniem. Traktuj dostępność jako część procesu budowania dokumentu, a nie pole do zaznaczenia na końcu.
Pracujesz na podstawie zeskanowanego dokumentu? Zacznij od OCR PDF — za darmo, i buduje prawdziwą warstwę tekstu w przeglądarce.
Musisz uzupełnić brakujący kontekst w istniejącym dokumencie? Adnotuj PDF pozwala dodać notatki i tekst bezpośrednio na stronie.