← คู่มือทั้งหมด

วิธีทำให้ไฟล์ PDF ที่สแกนมาค้นหาได้

ไฟล์สแกนก็แค่รูปถ่ายของหน้ากระดาษ นี่คือวิธีที่ OCR เปลี่ยนมันให้เป็นข้อความที่คุณค้นหา เลือก และคัดลอกได้ — ใช้เวลาราวหนึ่งนาที

ไฟล์ PDF ที่สแกนมาก็เป็นแค่รูปถ่ายของหน้ากระดาษ คอมพิวเตอร์เห็นเป็นพิกเซล ไม่ใช่ตัวอักษร คุณจึงเลือกข้อความ คัดลอกประโยค หรือค้นหาด้วย Ctrl-F ไม่ได้ ทางแก้คือ OCR (Optical Character Recognition หรือการรู้จำอักขระด้วยแสง) — ซอฟต์แวร์จะอ่านภาพ จดจำตัวอักษร แล้วแทรกชั้นข้อความที่มองไม่เห็นไว้ใต้ภาพสแกน หน้าตาของหน้ากระดาษเหมือนเดิมทุกอย่าง แต่ตอนนี้ค้นหาและเลือกข้อความได้แล้ว

วิธีทำ

เปิดเครื่องมือ OCR ลากไฟล์ PDF ที่สแกนมาวาง แล้วเลือกภาษาของเอกสาร (ขั้นตอนนี้สำคัญ — OCR จะแม่นยำกว่ามากเมื่อรู้ว่าต้องมองหาตัวอักษรและพจนานุกรมชุดไหน) เครื่องมือจะประมวลผลทุกหน้าแล้วส่งไฟล์ PDF ใหม่ที่มีชั้นข้อความค้นหาได้ฝังอยู่ในตัวกลับมาให้

ทุกขั้นตอนทำงานบนเซิร์ฟเวอร์ของเรา และไฟล์จะถูกลบทิ้งหลังจากนั้นสองชั่วโมง — ไม่ต้องสมัครสมาชิก ไม่มีลายน้ำ

เคล็ดลับให้ผลลัพธ์ออกมาดี

สแกนที่ 300 DPI ถ้าทำได้ — ถ้าความละเอียดต่ำเกินไป ตัวอักษรจะเบลอจนแยกกันไม่ออก วางหน้ากระดาษให้ตรง เพราะความเอียงมาก ๆ จะทำให้อ่านผิดพลาด และอย่าลืมว่า OCR คือการอ่านภาพที่ไม่สมบูรณ์แบบให้ดีที่สุดเท่าที่ทำได้ ลายมือเขียน ฟอนต์ลวดลายพิเศษ และสำเนาถ่ายเอกสารที่จางจะไม่มีวันได้ผลลัพธ์ที่สมบูรณ์แบบ