← semua panduan

Cara menjadikan PDF imbasan boleh dicari

Imbasan hanyalah gambar sesebuah halaman. Beginilah OCR menukarnya menjadi teks yang boleh anda cari, pilih dan salin — dalam masa kira-kira seminit.

PDF hasil imbasan hanyalah gambar bagi sesebuah halaman. Komputer anda melihat piksel, bukan perkataan — jadi anda tidak boleh memilih teks, menyalin petikan, atau mencari frasa dengan Ctrl-F. Penyelesaiannya ialah OCR (pengecaman aksara optik): perisian membaca imej, mengenal pasti huruf, dan menambah satu lapisan teks halimunan di sebalik imbasan itu. Halaman itu kelihatan sama, tetapi kini ia boleh dicari dan dipilih.

Cara melakukannya

Buka alat OCR, jatuhkan PDF hasil imbasan anda, dan pilih bahasa dokumen itu (ini penting — OCR jauh lebih tepat apabila ia tahu abjad dan kamus yang perlu dijangkakan). Alat ini memproses setiap halaman dan mengembalikan PDF baharu dengan lapisan teks yang boleh dicari terbina di dalamnya.

Semuanya berjalan pada pelayan kami dan fail itu dipadam selepas dua jam — tanpa akaun, tanpa tera air.

Petua untuk hasil yang bersih

Imbas pada 300 DPI jika boleh — terlalu rendah dan huruf-huruf akan kabur antara satu sama lain. Pastikan halaman lurus; senget yang teruk menjejaskan pengecaman. Dan ingat, OCR hanyalah bacaan terbaik yang mungkin bagi imej yang tidak sempurna: tulisan tangan, fon bergaya, dan fotokopi kabur tidak akan pernah sempurna.