OCR — Optical Character Recognition — แปลงภาพข้อความใน PDF ที่สแกนให้กลายเป็นตัวอักษรที่เลือก ค้นหา และคัดลอกได้จริง คู่มือนี้อธิบายว่า OCR ทำงานอย่างไร เมื่อไหร่ที่คุณต้องใช้ และวิธีใช้ฟรีในเบราว์เซอร์ของคุณ
ทำไม PDF ที่สแกนถึงต้องการ OCR
เมื่อคุณสแกนเอกสารกระดาษ เครื่องสแกนจะสร้างภาพของหน้ากระดาษ — ไม่ใช่ไฟล์ข้อความ PDF ที่สแกนโดยพื้นฐานแล้วคือไฟล์ JPEG หรือ TIFF ที่ฝังอยู่ในคอนเทนเนอร์ PDF คุณสามารถดูมันได้ แต่:
- คุณ ไม่สามารถ เลือกหรือคัดลอกข้อความ
- Ctrl+F (ค้นหา) จะไม่พบผลลัพธ์ใดๆ
- โปรแกรมอ่านหน้าจอ ไม่สามารถอ่านมันได้ (เข้าถึงไม่ได้)
- เสิร์ชเอนจิน ไม่สามารถจัดทำดัชนี เนื้อหาของมันได้
- คุณ ไม่สามารถ กรอกฟิลด์ฟอร์มหรือไฮไลต์ข้อความได้
OCR อ่านภาพนั้นและสร้างเลเยอร์ข้อความ — เลเยอร์ที่มองไม่เห็นของตัวอักษรที่ถูกจดจำวางซ้อนอยู่บนภาพอย่างแม่นยำ หลังจากทำ OCR แล้ว เอกสารจะดูเหมือนเดิมทุกประการ แต่ตอนนี้มีข้อความจริงอยู่ข้างใต้ที่คุณสามารถโต้ตอบด้วยได้
วิธีใช้ OCR กับ PDF ออนไลน์ (ฟรี)
Reduce your PDF file size instantly. No software needed.
การใช้ PDFlexa OCR:
- ไปที่ PDFlexa OCR
- อัปโหลด PDF ที่สแกนของคุณ (ลากแล้ววาง หรือคลิก เลือกไฟล์)
- เลือกภาษาของเอกสารจากเมนูแบบเลื่อนลง (รองรับ 24 ภาษา)
- เลือกรูปแบบผลลัพธ์:
- PDF ที่ค้นหาได้ — คงรูปลักษณ์เดิม เพิ่มเลเยอร์ข้อความที่มองไม่เห็น
- ข้อความธรรมดา (.txt) — เฉพาะข้อความที่แยกออกมา ไม่มีเลย์เอาต์
- คลิก เริ่มทำ OCR
- ดาวน์โหลดผลลัพธ์
การประมวลผลทำงานในเบราว์เซอร์ของคุณโดยใช้ Tesseract.js สำหรับ PDF ขนาดใหญ่ (30+ หน้า) การประมวลผลใช้เวลาสองสามนาที ไม่มีไฟล์ใดถูกอัปโหลดไปยังเซิร์ฟเวอร์
ภาษาที่รองรับได้แก่: อังกฤษ ฝรั่งเศส เยอรมัน สเปน โปรตุเกส อิตาลี ดัตช์ โปแลนด์ รัสเซีย อาหรับ จีน (ตัวย่อ) ญี่ปุ่น เกาหลี ฮินดี ตุรกี และอีก 9 ภาษา
เมื่อไหร่ที่ต้องใช้ OCR
| ประเภทเอกสาร | ต้องใช้ OCR ไหม |
|---|---|
| เอกสารกระดาษที่สแกนเป็น PDF | ✅ ใช่ — เป็นภาพ |
| ภาพถ่ายเอกสารด้วยโทรศัพท์ | ✅ ใช่ |
| PDF ที่สร้างจากไฟล์ Word/Excel/Google Docs | ❌ ไม่ — มีเลเยอร์ข้อความอยู่แล้ว |
| PDF ที่ส่งออกโดยตรงจากซอฟต์แวร์ (ใบแจ้งหนี้ ใบเสร็จ) | ❌ ไม่ — มีข้อความอยู่แล้ว |
| เอกสารเก่าในคลังที่สแกนไว้ | ✅ ใช่ |
| PDF ที่ข้อความเบลอหรือปนกัน | ⚠️ OCR อาจช่วยปรับปรุงได้ |
| PDF แบบฟอร์มที่คุณกรอกไม่ได้ | ✅ OCR + กรอกฟอร์ม PDF จะช่วยได้ |
วิธีตรวจสอบง่ายๆ: ลองเลือกข้อความบนหน้ากระดาษ ถ้าคุณสามารถไฮไลต์คำได้ แสดงว่า PDF มีเลเยอร์ข้อความอยู่แล้ว ถ้าเคอร์เซอร์สร้างเพียงกล่องเลือกรอบพื้นที่ (เหมือนการเลือกพื้นที่ภาพ) แสดงว่าเป็นภาพที่สแกนและต้องใช้ OCR
OCR ทำงานอย่างไร (เบื้องหลัง)
Turn any PDF into an editable Word document in seconds.
- การเรนเดอร์หน้า — แต่ละหน้าของ PDF ถูกเรนเดอร์ที่ความละเอียดสูง (เทียบเท่า 300+ DPI) เป็นภาพ
- การประมวลผลเบื้องต้น — ภาพถูกปรับให้ตรง ลดสัญญาณรบกวน และแปลงเป็นสีเทา
- การตรวจจับข้อความ — เอนจิน OCR ระบุพื้นที่ที่ดูเหมือนข้อความ (คอลัมน์ บรรทัด คำ)
- การจดจำตัวอักษร — แต่ละพื้นที่ตัวอักษรถูกจับคู่กับโมเดลที่ผ่านการฝึกสำหรับภาษาที่เลือก
- การสร้างเลเยอร์ข้อความ — ตัวอักษรที่จดจำได้ถูกวางไว้ในตำแหน่งที่ตรวจพบเหนือภาพต้นฉบับ
- การสร้าง PDF ใหม่ — PDF ใหม่ถูกสร้างขึ้นพร้อมภาพต้นฉบับบวกกับเลเยอร์ข้อความที่มองไม่เห็น
คุณภาพของ OCR ขึ้นอยู่กับ: ความละเอียดของการสแกน (ยิ่งสูงยิ่งดี) คุณภาพของเอกสาร (พิมพ์ชัดเจนเทียบกับหมึกจาง) การจับคู่ภาษา และข้อความเป็นตัวพิมพ์หรือลายมือ PDFlexa ใช้ Tesseract — เอนจิน OCR โอเพนซอร์สที่ใช้กันแพร่หลายที่สุด ผ่านการฝึกในกว่า 100 ภาษา
เคล็ดลับสำหรับผลลัพธ์ OCR ที่ดีขึ้น
สแกนที่ 300 DPI หรือสูงกว่า สแกนเนอร์สำหรับผู้บริโภคส่วนใหญ่ตั้งค่าเริ่มต้นไว้ที่ 150 DPI ซึ่งเพียงพอสำหรับการดูแต่ให้ผล OCR ที่ไม่ดี ใช้ 300 DPI สำหรับข้อความ 600 DPI สำหรับตัวพิมพ์ที่เล็กมาก
สแกนเป็นสีเทาหรือขาวดำ การสแกนสีมีขนาดใหญ่กว่าและไม่ได้ช่วยปรับปรุงคุณภาพ OCR สำหรับเอกสารข้อความมาตรฐาน สีเทาคือจุดที่เหมาะสมที่สุด
ตรวจสอบให้แน่ใจว่าหน้ากระดาษเรียบและตรง หน้ากระดาษโค้ง (จากการเข้าเล่มหนังสือ) การสแกนที่เอียง หรือเงาจากกล้องโทรศัพท์ล้วนลดความแม่นยำ สแกนเนอร์แบบแฟลตเบดส่วนใหญ่จัดการเรื่องนี้ได้ดี การสแกนด้วยกล้องโทรศัพท์มีปัญหามากที่สุด
เลือกภาษาที่ถูกต้อง Tesseract ใช้โมเดลที่ผ่านการฝึกเฉพาะภาษา เอกสารภาษาเยอรมันที่ประมวลผลด้วย OCR ภาษาอังกฤษจะให้ผลลัพธ์ที่ไม่ดีกับสระเสียง (ä, ö, ü) จับคู่ภาษาให้ถูกต้องเสมอ
ตัวพิมพ์ใหญ่และข้อความพิมพ์ OCR ได้ดีกว่าลายมือ OCR มาตรฐานถูกออกแบบมาสำหรับข้อความที่พิมพ์ การจดจำลายมือเป็นปัญหาที่แยกต่างหาก (ยากกว่า) ซึ่ง Tesseract จัดการได้ไม่ดีนัก
ความแม่นยำของ OCR: สิ่งที่คาดหวังได้
| คุณภาพเอกสาร | ความแม่นยำที่คาดหวัง |
|---|---|
| สะอาด พิมพ์ สแกนเรียบที่ 300 DPI | ความแม่นยำตัวอักษร 98–99% |
| การสแกนสำนักงานมาตรฐานที่ 150 DPI | ความแม่นยำ 92–96% |
| เอกสารเก่าที่หมึกจาง | ความแม่นยำ 80–90% |
| บันทึกลายมือ | 50–75% (แตกต่างกันมาก) |
| เอกสารวิชาการหลายคอลัมน์ | 90–95% (การตรวจจับเลย์เอาต์ยากกว่า) |
| อักษรที่ไม่ใช่ละติน (อาหรับ จีน เกาหลี) | 85–95% เมื่อใช้ภาษาที่ถูกต้อง |
สำหรับเอกสารสำคัญ (สัญญา บันทึกทางกฎหมาย) ตรวจสอบผลลัพธ์ OCR หาข้อผิดพลาดเสมอ — โดยเฉพาะชื่อเฉพาะ ตัวเลข และวันที่
OCR เทียบกับ PDF เป็น Word: ต่างกันอย่างไร
| OCR PDF | PDF เป็น Word | |
|---|---|---|
| ผลลัพธ์ | PDF ที่ค้นหาได้ (รูปลักษณ์เดิม) หรือ .txt | .docx ที่แก้ไขได้ |
| เหมาะกับ | ทำให้การสแกนค้นหาได้/เข้าถึงได้ | แก้ไขเนื้อหาใน Microsoft Word |
| เลย์เอาต์ | เลย์เอาต์เดิมถูกรักษาไว้อย่างสมบูรณ์แบบ | เลย์เอาต์อาจเปลี่ยนไปในการแปลงเป็น Word |
| กรณีใช้งาน | จัดเก็บ ค้นหา การเข้าถึง | นำกลับมาใช้และแก้ไขเนื้อหา |
หากคุณต้องการแก้ไขเนื้อหาที่สแกนใน Word ให้รัน OCR ก่อนแล้วจึงใช้ PDF เป็น Word — OCR ให้ข้อความจริงแก่ตัวแปลงในการทำงาน แทนที่จะเป็นพื้นที่ภาพเปล่า
คำถามที่พบบ่อย
OCR เปลี่ยนรูปลักษณ์ของ PDF ของฉันไหม ไม่ เลเยอร์ข้อความ OCR มองไม่เห็น — มันอยู่ด้านหลังภาพของหน้ากระดาษ PDF ดูเหมือนเดิมทุกประการทั้งก่อนและหลังทำ OCR ความแตกต่างเดียวคือตอนนี้ข้อความสามารถเลือกและค้นหาได้แล้ว
OCR อ่านลายมือได้ไหม OCR มาตรฐานถูกฝึกมาสำหรับข้อความพิมพ์และไม่น่าเชื่อถือกับลายมือ ผลลัพธ์แตกต่างกันมากขึ้นอยู่กับว่าลายมือเขียนชัดเจนและสม่ำเสมอแค่ไหน สำหรับเอกสารลายมือที่สำคัญ การถอดความด้วยมือน่าเชื่อถือกว่า
ฉันสามารถทำ OCR กี่หน้าได้ในครั้งเดียว OCR แบบเบราว์เซอร์ของ PDFlexa รองรับสูงสุด 50 หน้าต่อการอัปโหลด สำหรับเอกสารที่ยาวกว่านั้น ให้แยก PDF ออกเป็นส่วนๆ ทำ OCR แต่ละส่วน แล้วจึงรวมผลลัพธ์เข้าด้วยกัน
ทำไม OCR ถึงใช้เวลานาน แต่ละหน้าถูกประมวลผลแยกกัน: เรนเดอร์ที่ความละเอียดสูง วิเคราะห์ และจดจำ เอกสาร 20 หน้าอาจใช้เวลา 1–3 นาทีในเบราว์เซอร์ การประมวลผลทำงานบนอุปกรณ์ของคุณ — ความเร็วขึ้นอยู่กับ CPU และหน่วยความจำของคุณ
OCR ฟรีไหม ใช่ OCR ของ PDFlexa ทำงานทั้งหมดในเบราว์เซอร์ของคุณโดยใช้ Tesseract.js แบบโอเพนซอร์สโดยไม่มีค่าใช้จ่าย ไม่ต้องมีบัญชี ไม่มีขีดจำกัดรายวันสำหรับเครื่องมือ OCR
หากคุณแปลงเอกสารกระดาษเป็นดิจิทัลเป็นประจำ ดู เครื่องมือ PDF สำหรับนักบัญชี หรือ เครื่องมือ PDF สำหรับนักวิจัย สำหรับขั้นตอนการทำงานที่เกี่ยวข้อง