PDF ที่ดูอ่านง่ายสมบูรณ์แบบสำหรับคุณอาจใช้งานแทบไม่ได้เลยสำหรับคนที่ใช้โปรแกรมอ่านหน้าจอ การนำทางด้วยแป้นพิมพ์เพียงอย่างเดียว หรือแว่นขยายสำหรับผู้มีสายตาเลือนราง การเข้าถึงได้ไม่ใช่เรื่องเฉพาะกลุ่ม มันมักเป็นข้อกำหนดทางกฎหมาย และเป็นแนวปฏิบัติที่ดีเสมอ นี่คือสิ่งที่ทำให้ PDF เข้าถึงได้จริง และวิธีเข้าใกล้เป้าหมายนั้นด้วยเครื่องมือที่คุณมีอยู่แล้ว
"เข้าถึงได้" หมายความว่าอย่างไรจริง ๆ สำหรับ PDF
PDF ที่เข้าถึงได้ไม่ใช่แค่เอกสารที่อ่านได้ แต่เป็นเอกสารที่ใช้งานได้ด้วยเทคโนโลยีช่วยเหลือ พูดให้ชัดเจนคือ
- โปรแกรมอ่านหน้าจออ่านเนื้อหาตามลำดับที่ถูกต้อง ไม่ใช่สับสนตามตำแหน่งที่องค์ประกอบบังเอิญวางอยู่บนหน้าจอ
- ข้อความเป็นข้อความจริง ไม่ใช่ภาพของข้อความ โปรแกรมอ่านหน้าจออ่านพิกเซลไม่ได้ อ่านได้แค่ข้อมูลตัวอักษรจริง
- ภาพมีข้อความอธิบายทางเลือก (alt text) อธิบายสิ่งที่แสดง สำหรับผู้ใช้ที่มองไม่เห็นมัน
- หัวข้อถูกแท็กเป็นหัวข้อ ไม่ใช่แค่จัดสไตล์ให้ดูเหมือนหัวข้อ นี่ทำให้ผู้ใช้โปรแกรมอ่านหน้าจอนำทางตามโครงสร้างเอกสารแทนการเลื่อนดูทีละบรรทัด
- สีไม่ใช่วิธีเดียวที่ใช้สื่อความหมาย กราฟที่พึ่งพาเพียงสีแดงกับสีเขียวเพื่อสื่อความหมายจะกีดกันผู้อ่านที่ตาบอดสี
- เอกสารมีลำดับการกด Tab ที่มีเหตุผล สำหรับผู้ที่นำทางด้วยแป้นพิมพ์แทนเมาส์
PDF สามารถดูปกติสมบูรณ์แบบและยังคงล้มเหลวในทุกข้อข้างต้นได้
ทำไมเรื่องนี้สำคัญเกินกว่าแค่การปฏิบัติตามกฎ
Reduce your PDF file size instantly. No software needed.
ข้อกำหนดทางกฎหมาย (เช่น ADA ในสหรัฐฯ กฎหมาย European Accessibility Act หรือ Section 508 สำหรับเอกสารราชการสหรัฐฯ) เป็นเรื่องจริงและถูกบังคับใช้มากขึ้นเรื่อย ๆ แต่งานด้านการเข้าถึงได้ก็ทำให้เอกสารดีขึ้นสำหรับคนจำนวนมากกว่าที่กฎเฉพาะครอบคลุม
- ผู้ใช้โปรแกรมอ่านหน้าจอและผู้มีสายตาเลือนรางคือผู้ได้ประโยชน์ที่ชัดเจนที่สุด แต่โครงสร้างที่ถูกต้องยังช่วยใครก็ตามที่กำลังไล่ดูเอกสารยาว ๆ เพื่อหาส่วนใดส่วนหนึ่งด้วย
- ข้อความจริง (เทียบกับภาพที่สแกน) สามารถค้นหาได้ คัดลอกได้ และใช้งานได้กับเครื่องมือแปลภาษาในเบราว์เซอร์ การปรับปรุงด้านการเข้าถึงและการปรับปรุงการใช้งานทั่วไปทับซ้อนกันมาก
- เอกสารที่แจกจ่ายให้สาธารณะ เช่น แบบฟอร์มราชการ รายงานที่เผยแพร่ เอกสารการศึกษา มีผู้ชมมากกว่าไฟล์ใช้ภายในเท่านั้นมาก ทำให้ช่องว่างด้านการเข้าถึงได้มีผลกระทบมากขึ้น
ความล้มเหลวด้านการเข้าถึงที่พบบ่อยที่สุด: เอกสารที่สแกน
หน้าที่สแกน แม้จะเป็นสแกนที่คมชัดความละเอียดสูงเพียงใด ก็ยังคงเป็นภาพ มันไม่มีชั้นข้อความเลย ซึ่งหมายความว่าโปรแกรมอ่านหน้าจอไม่มีอะไรให้อ่าน มันเห็นแค่ภาพ นี่คือปัญหาการเข้าถึงที่พบบ่อยที่สุดและแก้ไขได้ง่ายที่สุดใน PDF
วิธีแก้คือ OCR PDF ซึ่งรู้จำข้อความในภาพที่สแกนและสร้างชั้นข้อความจริงที่เลือกได้ขึ้นมาเบื้องหลัง เพียงเท่านี้ก็ทำให้เอกสารเปลี่ยนจากเข้าถึงไม่ได้เลยไปเป็นอย่างน้อยก็อ่านได้ด้วยเทคโนโลยีช่วยเหลือ แม้ว่าจะยังมีข้อควรระวังด้านล่าง เนื่องจาก OCR เพียงอย่างเดียวไม่ได้เพิ่มโครงสร้างหัวข้อหรือลำดับการอ่านที่เหมาะสม
การทำให้ PDF ที่สร้างแบบดิจิทัลเข้าถึงได้มากขึ้น
Turn any PDF into an editable Word document in seconds.
สำหรับ PDF ที่ส่งออกจาก Word, Google Docs หรือคล้ายกัน (ไม่ใช่สแกน) การเข้าถึงได้ส่วนใหญ่ขึ้นอยู่กับวิธีที่เอกสารต้นฉบับถูกสร้างขึ้น
- ใช้รูปแบบหัวข้อจริง (Heading 1, Heading 2 เป็นต้น) ในเอกสารต้นฉบับ แทนที่จะแค่ทำให้ข้อความเป็นตัวหนาและใหญ่ขึ้น เครื่องมือส่งออกส่วนใหญ่แปลงรูปแบบหัวข้อเป็นแท็ก PDF ที่ถูกต้อง ซึ่งข้อความที่จัดสไตล์ด้วยมือไม่ได้รับ
- เพิ่ม alt text ให้ภาพ ในเอกสารต้นฉบับก่อนส่งออก ซึ่งโดยทั่วไปจะติดไปกับ PDF ด้วย
- ใช้โครงสร้างตารางสำหรับข้อมูลตาราง ไม่ใช่แท็บหรือช่องว่างเพื่อจำลองการจัดแนว ตารางจริงจะส่งออกพร้อมโครงสร้างที่โปรแกรมอ่านหน้าจอนำทางได้ ข้อความที่เว้นวรรคด้วยมือจะอ่านเป็นกลุ่มคำที่สับสน
- ให้ลิงก์มีข้อความอธิบายที่ชัดเจน ("อ่านรายงานฉบับเต็ม" แทนที่จะเป็น "คลิกที่นี่") ผู้ใช้โปรแกรมอ่านหน้าจอมักนำทางโดยเรียกดูรายการลิงก์บนหน้า ซึ่ง "คลิกที่นี่" ที่ซ้ำหลายครั้งจะไม่มีความหมายนอกบริบท
การทำสิ่งเหล่านี้ให้ถูกต้องในเอกสารต้นฉบับ (Word, Google Docs, CMS ของคุณ) ก่อนแปลง จะช่วยประหยัดงานด้านการเข้าถึงได้มากกว่าการพยายามแก้ไขทีหลังใน PDF เอง
สิ่งที่คุณสามารถแก้ไขได้จริงหลังจาก PDF ถูกสร้างขึ้นแล้ว
เมื่อคุณมี PDF ที่เสร็จสมบูรณ์แล้ว ตัวเลือกของคุณจะแคบลงแต่ไม่ใช่ศูนย์
- รัน OCR หากเป็นไฟล์สแกน เพื่ออย่างน้อยได้ข้อความจริงเข้ามาในเอกสาร
- เพิ่มคำอธิบายประกอบข้อความ ด้วย Annotate PDF เพื่อเสริมเนื้อหาที่ขาดบริบท แม้ว่านี่จะไม่ทดแทนการแท็กโครงสร้างที่เหมาะสม
- ตรวจสอบลำดับการอ่านด้วยมือ โดยลองเลือกข้อความด้วยเคอร์เซอร์จากบนลงล่าง หากการเลือกกระโดดไปมาโดยไม่คาดคิด แสดงว่าลำดับเนื้อหาที่ซ่อนอยู่ไม่ตรงกับเลย์เอาต์ที่มองเห็น
การแก้ไขเชิงโครงสร้างเชิงลึก เช่น แท็กหัวข้อที่เหมาะสม โครงสร้างตาราง การแท็กเต็มรูปแบบสำหรับเอกสารที่ไม่เคยถูกสร้างมาพร้อมสิ่งเหล่านี้ โดยทั่วไปต้องย้อนกลับไปที่ต้นฉบับและสร้างใหม่ หรือใช้ซอฟต์แวร์แก้ไขการเข้าถึงเฉพาะทางที่นอกเหนือจากเครื่องมือ PDF บนเบราว์เซอร์ทำได้ หากคุณกำลังทำงานเรื่องการปฏิบัติตามกฎระเบียบอย่างเป็นทางการสำหรับเอกสารจำนวนมาก นี่เป็นเรื่องที่ควรรู้ล่วงหน้า แทนที่จะสันนิษฐานว่าเครื่องมือใด ๆ สามารถแท็กย้อนหลังให้เต็มรูปแบบได้
คำถามที่พบบ่อย
PDF ที่ค้นหาได้คือ PDF ที่เข้าถึงได้โดยอัตโนมัติหรือไม่ ไม่ใช่ ข้อความที่ค้นหาได้ (ผ่าน OCR) จำเป็นแต่ไม่เพียงพอ การเข้าถึงได้เต็มรูปแบบยังต้องการโครงสร้างหัวข้อที่เหมาะสม alt text ลำดับการอ่านที่มีเหตุผล และการแท็กที่ถูกต้อง ซึ่ง OCR เพียงอย่างเดียวไม่ได้เพิ่มให้
PDFlexa สามารถทำให้ PDF ของฉันสอดคล้องกับมาตรฐานการเข้าถึงอย่าง PDF/UA อย่างเต็มรูปแบบได้หรือไม่ เครื่องมือ OCR ของ PDFlexa แก้ปัญหาความล้มเหลวที่พบบ่อยที่สุด (ไม่มีชั้นข้อความในเอกสารที่สแกน) แต่การสอดคล้องกับ PDF/UA อย่างเต็มรูปแบบเกี่ยวข้องกับการแท็กเชิงโครงสร้างที่จัดการได้ดีที่สุดในขั้นตอนเอกสารต้นฉบับ หรือด้วยซอฟต์แวร์การเข้าถึงเฉพาะทางสำหรับไฟล์ที่มีอยู่แล้ว
การเพิ่ม alt text ใน PDF ทำงานเหมือนกับใน Word หรือไม่ แนวคิดเหมือนกัน แต่การเพิ่ม alt text โดยตรงใน PDF ที่มีอยู่แล้วมักต้องสร้างเอกสารต้นฉบับใหม่โดยรวม alt text ไว้ก่อนแปลง การใส่ย้อนหลังใน PDF ที่เสร็จแล้วมีข้อจำกัดมากกว่า
ทำไมเอกสารที่สแกนของฉันถึงผ่านการตรวจสอบการเข้าถึงไม่ได้แม้หลังจากทำ OCR แล้ว OCR เพิ่มชั้นข้อความ แต่ไม่ได้เพิ่มโครงสร้างหัวข้อ alt text หรือการแท็กโดยอัตโนมัติ เอกสารที่สแกนยังคงเป็น PDF ที่ไม่มีโครงสร้างโดยพื้นฐาน แม้ว่าข้อความจะอ่านได้แล้ว
ฉันต้องใช้ซอฟต์แวร์พิเศษเพื่อตรวจสอบว่า PDF ของฉันเข้าถึงได้หรือไม่ มีเครื่องมือตรวจสอบการเข้าถึงฟรี (รวมถึงตัวที่มีอยู่ใน Adobe Acrobat และเครื่องมือแยกต่างหากอย่าง PAC หรือ PDF Accessibility Checker) ที่ระบุแท็กที่ขาดหาย alt text และปัญหาเชิงโครงสร้าง
สรุป
การเข้าถึงได้ทำได้ง่ายที่สุดตั้งแต่ต้นฉบับ ด้วยหัวข้อที่เหมาะสม alt text และตารางจริงใน Word หรือ Google Doc ต้นฉบับของคุณ และยากที่สุดที่จะแก้ไขย้อนหลัง หากคุณเริ่มจากไฟล์สแกน OCR คือขั้นตอนแรกที่จำเป็น แม้ว่าจะไม่ใช่ทางออกทั้งหมด ปฏิบัติต่อการเข้าถึงได้เป็นส่วนหนึ่งของวิธีสร้างเอกสาร ไม่ใช่รายการที่ต้องเช็คภายหลัง
กำลังทำงานจากเอกสารที่สแกนอยู่หรือไม่ เริ่มด้วย OCR PDF ฟรีและสร้างชั้นข้อความจริงในเบราว์เซอร์ของคุณ
ต้องการเติมบริบทที่ขาดหายในเอกสารที่มีอยู่แล้วหรือไม่ Annotate PDF ให้คุณเพิ่มบันทึกและข้อความโดยตรงบนหน้าเอกสาร