OCR PDF: kenali teks hasil scan
Hasil scan hanyalah gambar: tidak ada yang bisa dicari, tidak ada yang bisa disalin. Pengenalan karakter menambahkan lapisan teks di bawah gambar — tampilannya tidak berubah sedikit pun, tetapi dokumennya jadi bisa dicari.
Gratis · 100% di perangkat Anda — tidak ada yang dikirim- 1Buka PDF hasil scan.
- 2Jalankan pengenalan teks, lalu pilih bahasanya.
- 3Unduh PDF yang kini bisa dicari.
Cara menjalankan OCR pada PDF hasil scan
Buka PDF hasil scan, pilih bahasa dokumennya, jalankan pengenalan teks, lalu unduh hasilnya. Halaman mana yang memang berupa gambar sudah dihitung lebih dulu dan ditawarkan sebagai pilihan, jadi arsip tebal yang cuma sebagian dipindai tidak perlu diproses seluruhnya; rentang halaman seperti “1-3, 7” juga bisa diketik sendiri. Yang ditambahkan adalah lapisan teks tidak terlihat di bawah gambar: tampilan hasil scan tidak bergeser sedikit pun, tetapi dokumennya kini bisa dicari, dipilih, dan disalin, lalu diteruskan ke PDF → Word, PDF → Excel, atau Cari dan ganti. Yang jarang ditemukan di tempat lain: mesin pengenalannya sendiri berjalan di dalam browser Anda, bukan di server orang. Scan ijazah, akta kelahiran, faktur, surat keputusan, atau arsip skripsi tidak perlu dititipkan ke layanan online hanya supaya isinya terbaca mesin. Tidak ada antrean, tidak ada kuota halaman, tidak ada tanda air, dan sesudah kunjungan pertama semuanya tetap berjalan meski offline. Perhitungannya memakan beberapa detik per halaman dan sangat bergantung pada ketajaman scan.
Bahasa yang dikenali, akurasi, dan kata yang diragukan mesin
Model bahasa yang tersedia adalah Prancis, Inggris, Spanyol, Jerman, Italia, Portugis, dan beberapa bahasa Eropa lain; Bahasa Indonesia belum ada di antaranya. Itu bukan penghalang sebesar yang terdengar: pilih Inggris, karena bentuk hurufnya sama persis dan Bahasa Indonesia tidak memakai tanda diakritik, sehingga huruf demi huruf tetap terbaca dengan baik. Yang hilang hanya koreksi berbasis kamus, jadi kata seperti “pemberitahuan” atau “Nomor Induk Kependudukan” lebih perlu dibaca ulang. Model yang dipilih diunduh satu kali saat pertama dipakai, lalu menetap di perangkat. Soal akurasi, tidak ada mesin yang benar seratus persen: halaman bersih dan lurus yang dipindai pada 300 dpi memberi hasil nyaris sempurna, sedangkan foto dokumen yang diambil miring dengan ponsel, tulisan tangan, atau stempel yang menimpa kalimat pasti menghasilkan kekeliruan. Karena itu kata-kata yang diragukan mesin disodorkan dulu untuk ditinjau, berdampingan dengan potongan gambar aslinya, dan yang nyaris tidak terbaca ditawarkan dalam keadaan tidak tercentang. Sisanya masih bisa dirapikan di editor lewat Pilih atau Cari dan ganti, seperti teks biasa.
Pertanyaan umum
Apakah OCR dikerjakan di server?
Tidak — dan ini jarang, justru di situ intinya: mesin pengenalan teks berjalan di dalam browser Anda. Dokumen rahasia hasil scan tidak pergi ke mana pun.
Bahasa apa saja yang dikenali?
Prancis, Inggris, Spanyol, Jerman, Italia, dan Portugis — ditambah mode Prancis + Inggris untuk dokumen campuran; Bahasa Indonesia sendiri belum ada di daftar itu. Model bahasa yang dipilih diunduh sekali saat pertama dipakai, lalu tetap tersimpan di perangkat.
Apakah tampilan hasil scan ikut berubah?
Tidak. Gambarnya tetap apa adanya; teks yang dikenali diletakkan di bawahnya, tidak terlihat, semata-mata untuk pencarian dan penyalinan.
Berapa lama pengenalan teks berlangsung?
Beberapa detik per halaman di komputer yang cukup baru, lebih lama di ponsel: seluruh perhitungan terjadi di perangkat Anda, tanpa antrean dan tanpa kuota.
Apakah teks hasil pengenalan akurat seratus persen?
Tidak, dan tidak ada mesin yang seakurat itu: hasil scan yang bersih dan lurus memberi hasil sangat baik, sedangkan fotokopi yang miring atau berbintik jauh lebih buruk. Teks hasil pengenalan berguna untuk dicari dan disalin; baca ulang dulu sebelum dijadikan sumber.