OCR PDF
Kenali teks di dalam dokumen dan gambar hasil pindaian, langsung di browser Anda.
Unggah
Pilih file Anda atau seret dan lepas.
Sesuaikan
Pilih opsi Anda — semuanya berlangsung di browser Anda.
Unduh
Simpan file yang selesai secara instan. Tanpa watermark.
PDF hasil pindaian pada dasarnya cuma setumpuk foto. Anda tidak bisa mencarinya, tidak bisa menyalin satu paragraf darinya, dan tidak bisa menempelkan nomor referensi dari dalamnya. Tool OCR PDFora membaca teks di dalam gambar-gambar halaman itu menggunakan Tesseract, mesin open-source yang sama yang dipercaya dalam alur kerja dokumen serius, lalu menyerahkan teks hasil pengenalannya kepada Anda sebagai berkas .txt bersih yang bisa dicari, diedit, dan dipakai ulang.
Inilah yang membuat OCR ini berbeda: prosesnya berjalan sepenuhnya di dalam browser Anda. Hampir setiap layanan OCR online mengunggah hasil pindaian Anda ke server untuk diproses. Milik kami tidak. Pengenalannya terjadi di perangkat Anda sendiri, sehingga paspor yang dipindai, perjanjian sewa bertanda tangan, atau lembar hasil pemeriksaan medis tidak pernah dikirim ke mana pun. Untuk dokumen seperti itu, hal ini bukan sekadar nilai tambah, melainkan inti persoalannya.
Saat ini tool mengenali bahasa Inggris, Hindi, Spanyol, dan Prancis, dan Anda memilih bahasanya sebelum menjalankan pemindaian. Gratis, tanpa pendaftaran, tanpa watermark, dan tanpa kuota halaman. Kecepatan pengenalan bergantung pada perangkat Anda karena prosesor Andalah yang mengerjakannya, tetapi satu halaman biasa hanya butuh beberapa detik di laptop modern.
Cara menjalankan OCR pada PDF secara online
- Buka tool OCR PDF di PDFora lewat browser modern.
- Seret PDF hasil pindaian Anda ke area unggah, atau klik untuk memilihnya dari perangkat.
- Pilih bahasa dokumennya: Inggris, Hindi, Spanyol, atau Prancis. Bahasa yang tepat meningkatkan akurasi secara drastis.
- Klik Recognize Text dan biarkan Tesseract memproses setiap halaman secara lokal di browser Anda.
- Pantau progresnya saat halaman demi halaman selesai; dokumen yang lebih panjang butuh waktu sedikit lebih lama.
- Unduh teks hasil ekstraksi sebagai berkas .txt lalu cari, edit, atau salin isinya dengan bebas.
When to use this tool
- Menarik teks dari putusan pengadilan 60 halaman hasil pindaian agar bisa Anda cari klausul tertentu tanpa membaca setiap halaman.
- Mengambil kutipan dari halaman buku teks yang difoto untuk makalah penelitian, tanpa perlu mengetik ulang.
- Mendigitalkan setumpuk invoice kertas lama agar nominal dan nomor invoice-nya menjadi arsip yang bisa dicari.
- Mengubah surat edaran pemerintah berbahasa Hindi hasil pindaian menjadi teks yang bisa diedit untuk diterjemahkan atau diringkas.
- Menyelamatkan isi dokumen yang hanya tersisa cetakannya, dengan memindainya lalu menjalankan OCR.
- Membuat handout rapat dan laporan cetak bisa dikutip di email dengan mengangkat teksnya, bukan menangkap layarnya.
Tips for the best results
- Berikan hasil pindaian terbersih yang Anda punya. Resolusi 300 DPI, pencahayaan bagus, dan teks gelap di latar terang menghasilkan pengenalan jauh lebih baik daripada foto ponsel yang remang.
- Luruskan dulu hasil pindaiannya. Halaman miring membingungkan pengenalan karakter, jadi jalankan dokumen yang miring lewat tool deskew PDFora sebelum OCR.
- Cocokkan pengaturan bahasa dengan dokumennya. Menjalankan surat berbahasa Spanyol lewat model bahasa Inggris akan menghasilkan keluaran berantakan, begitu pula sebaliknya.
- Bersiaplah dengan proses yang lebih lambat di ponsel dan laptop tua. Mesinnya memakai prosesor perangkat Anda, jadi pindaian 100 halaman adalah pekerjaan untuk desktop, bukan tablet berumur lima tahun.
- Periksa ulang angkanya. OCR sangat baik tetapi tidak sempurna, dan digit pada nomor rekening atau total tagihan layak dilirik manual sebelum Anda mengandalkannya.
Pertanyaan yang sering diajukan
Apakah dokumen hasil pindaian saya diunggah untuk diproses?
Tidak, dan ini langka di antara tool OCR online. Mesin Tesseract berjalan di dalam browser Anda, jadi setiap halaman dikenali di perangkat Anda sendiri. Tidak ada apa pun yang dikirim ke server pada tahap mana pun, sehingga aman untuk dokumen identitas, kontrak, dan rekam medis.
Apa keluaran yang saya dapatkan?
Tool mengekstrak teks hasil pengenalan dan memberikannya kepada Anda sebagai berkas .txt yang bisa diunduh. Dari situ Anda bisa mencarinya, menempelkannya ke dokumen, atau memasukkannya ke alur kerja lain mana pun yang membutuhkan teks biasa.
Bahasa apa saja yang didukung?
Inggris, Hindi, Spanyol, dan Prancis tersedia saat ini. Pilih bahasa yang sesuai dokumen Anda sebelum menjalankan pengenalan, karena mesin memuat model khusus per bahasa dan akurasinya bergantung pada pilihan yang tepat.
Seberapa akurat pengenalan teksnya?
Pada pindaian teks cetak yang bersih dan terang, akurasinya biasanya sangat tinggi. Kualitas menurun pada foto buram, font tidak lazim, tulisan tangan, atau kemiringan parah. Masukan yang lebih baik adalah faktor tunggal paling berpengaruh, jadi pindai ulang atau luruskan halaman yang buruk sebelum menyalahkan mesinnya.
Kenapa OCR di perangkat saya lebih lambat daripada di perangkat rekan saya?
Karena prosesnya lokal, kecepatannya mengikuti perangkat keras Anda. Laptop keluaran baru melahap tiap halaman dalam hitungan detik, sementara ponsel lama butuh waktu jauh lebih lama. Kelebihan dari pemrosesan lokal itu adalah privasi yang utuh.
Apakah ada batas halaman atau berkas, dan apakah berbayar?
Tanpa biaya, tanpa akun, tanpa watermark, dan tanpa kuota halaman. Anda boleh menjalankan OCR pada seluruh arsip pindaian kalau mau. Satu-satunya kendala praktis adalah waktu, karena dokumen panjang butuh proses lebih lama di mesin Anda sendiri.