ไฟล์ PDF ที่สแกนมาก็เป็นแค่รูปถ่ายของหน้ากระดาษ คอมพิวเตอร์เห็นเป็นพิกเซล ไม่ใช่ตัวอักษร คุณจึงเลือกข้อความ คัดลอกประโยค หรือค้นหาด้วย Ctrl-F ไม่ได้ ทางแก้คือ OCR (Optical Character Recognition หรือการรู้จำอักขระด้วยแสง) — ซอฟต์แวร์จะอ่านภาพ จดจำตัวอักษร แล้วแทรกชั้นข้อความที่มองไม่เห็นไว้ใต้ภาพสแกน หน้าตาของหน้ากระดาษเหมือนเดิมทุกอย่าง แต่ตอนนี้ค้นหาและเลือกข้อความได้แล้ว
วิธีทำ
เปิดเครื่องมือ OCR ลากไฟล์ PDF ที่สแกนมาวาง แล้วเลือกภาษาของเอกสาร (ขั้นตอนนี้สำคัญ — OCR จะแม่นยำกว่ามากเมื่อรู้ว่าต้องมองหาตัวอักษรและพจนานุกรมชุดไหน) เครื่องมือจะประมวลผลทุกหน้าแล้วส่งไฟล์ PDF ใหม่ที่มีชั้นข้อความค้นหาได้ฝังอยู่ในตัวกลับมาให้
ทุกขั้นตอนทำงานบนเซิร์ฟเวอร์ของเรา และไฟล์จะถูกลบทิ้งหลังจากนั้นสองชั่วโมง — ไม่ต้องสมัครสมาชิก ไม่มีลายน้ำ
เคล็ดลับให้ผลลัพธ์ออกมาดี
สแกนที่ 300 DPI ถ้าทำได้ — ถ้าความละเอียดต่ำเกินไป ตัวอักษรจะเบลอจนแยกกันไม่ออก วางหน้ากระดาษให้ตรง เพราะความเอียงมาก ๆ จะทำให้อ่านผิดพลาด และอย่าลืมว่า OCR คือการอ่านภาพที่ไม่สมบูรณ์แบบให้ดีที่สุดเท่าที่ทำได้ ลายมือเขียน ฟอนต์ลวดลายพิเศษ และสำเนาถ่ายเอกสารที่จางจะไม่มีวันได้ผลลัพธ์ที่สมบูรณ์แบบ