OCR PDF Gratis: Jadikan Hasil Scan Bisa Dicari dan Disalin
PDF Toucan editorial team · Terakhir diperbarui 20 September 2026 · 8 mnt baca

Untuk menjalankan OCR PDF gratis, unggah PDF hasil scan ke alat OCR PDF, pilih bahasa dokumen, lalu klik “Kenali teks”. Unduh PDF hasilnya, uji dengan Ctrl+F atau fitur Cari, dan salin teks yang diperlukan. Jika ingin mengeditnya di Word, lakukan OCR lebih dahulu, kemudian konversi PDF tersebut ke Word.
Apa itu OCR PDF dan apa yang berubah setelah dokumen diproses?
PDF hasil scan biasanya berisi gambar halaman, bukan teks digital. Tulisan mungkin terlihat jelas, tetapi pembaca PDF hanya melihat piksel. Karena itu, Ctrl+F tidak menemukan kata, pemilihan teks menjadi kotak gambar, dan hasil salin tidak dapat digunakan.
OCR atau optical character recognition membaca bentuk huruf pada gambar scan, lalu menambahkan lapisan teks pada PDF. Tampilan halaman umumnya tetap menyerupai scan asli, tetapi teksnya dapat dicari dan disalin.
Setelah OCR, Anda dapat melakukan hal berikut:
- Mencari kata dengan Ctrl+F di Windows atau ChromeOS, Command+F di Mac, atau fitur Cari pada pembaca PDF di ponsel.
- Menyalin nama, nomor dokumen, tanggal, atau kutipan ke aplikasi lain.
- Memudahkan pencarian dokumen dalam arsip scan yang banyak.
OCR tidak otomatis membetulkan isi dokumen. Ejaan, angka, tata letak, tabel, dan karakter kecil masih dapat salah terbaca, terutama pada scan buram, miring, gelap, bertulisan tangan, atau tertutup cap. PDF yang dibuat langsung dari Word biasanya sudah memiliki teks yang bisa dipilih sehingga tidak perlu OCR.
Bagaimana cara OCR PDF gratis di PDF Toucan?
PDF Toucan menerima file PDF dan menghasilkan PDF yang dapat dicari. Anda dapat menambahkan beberapa file sekaligus; setiap file diproses sendiri-sendiri.
- Buka alat OCR PDF, lalu klik “Pilih file PDF”.
- Pilih PDF hasil scan dari perangkat. Anda juga dapat menyeret file ke mana saja pada halaman atau menempelkan file.
- Pada bagian bahasa dokumen, pilih setidaknya satu bahasa yang benar-benar dipakai dalam isi PDF.
- Untuk scan biasa, gunakan “Scan pages without text”. Ini adalah pilihan yang direkomendasikan karena halaman yang sudah memiliki teks akan dibiarkan apa adanya.
- Bila diperlukan, buka “More options” untuk mengatur halaman yang dipindai atau memperbaiki kemiringan dan orientasi halaman.
- Klik “Kenali teks”. Dokumen dengan banyak halaman dapat memerlukan beberapa menit, jadi biarkan tab tetap terbuka.
- Setelah proses selesai, klik “Download the searchable PDF”.
- Buka hasil unduhan dan uji pencarian serta penyalinan teks.
Alat browser ini gratis tanpa akun, tanpa watermark, dan tanpa batas harian; iklan mendanai layanan. Untuk menjalankan OCR, file dikirim melalui HTTPS ke server di Uni Eropa, diproses di memori tanpa ditulis ke disk atau disimpan, lalu dihapus segera setelah hasil diunduh atau paling lambat 10 menit. Jika dokumen tidak boleh meninggalkan perangkat sama sekali, gunakan perangkat lunak OCR offline.
Bahasa OCR apa yang harus dipilih untuk dokumen Indonesia atau campuran?
Pilihan bahasa membantu mesin OCR mengenali alfabet, aksen, dan pola kata. Karena itu, bahasa yang tepat dapat membantu membedakan karakter serupa, misalnya 0 dan O atau 1 dan l.
| Kondisi dokumen | Bahasa yang dipilih | Catatan |
|---|---|---|
| Surat, modul, formulir, atau arsip Indonesia | Bahasa Indonesia | Pilihan utama untuk dokumen berbahasa Indonesia |
| Laporan atau kontrak Indonesia–Inggris | Bahasa Indonesia dan Inggris | Pilih keduanya bila memang muncul di dokumen |
| Dokumen dengan teks Arab, Jepang, atau Mandarin | Tambahkan bahasa yang relevan | Pilih bila bagian tersebut perlu dikenali |
| Istilah asing sesekali | Bahasa utama dokumen | Tambahkan bahasa lain hanya bila penggunaannya cukup banyak |
OCR mendukung 30 bahasa, termasuk skrip Latin, Kiril, Yunani, Arab, Ibrani, Devanagari, Thai, Tionghoa, Jepang, dan Korea. Anda dapat menggabungkan hingga lima bahasa dalam satu proses.
Hindari memilih banyak bahasa hanya untuk berjaga-jaga. Bahasa tambahan memperlambat proses dan dapat membuat hasil kurang konsisten. Bila nama, singkatan, atau istilah teknis salah terbaca, bandingkan dengan scan asli karena font dekoratif, cetakan pudar, dan cap sering mengganggu pengenalan.
Kapan perlu meluruskan halaman dan memperbaiki orientasi otomatis?
Posisi halaman memengaruhi hasil OCR. Periksa beberapa halaman sebelum memproses arsip besar, terutama jika file berasal dari foto ponsel atau scanner rumahan.
| Opsi | Gunakan saat | Dampak dan batasan |
|---|---|---|
| “Straighten tilted pages” | Halaman tampak sedikit miring | Meluruskan halaman agar baris teks lebih mudah dikenali |
| “Fix page orientation automatically” | Ada halaman terbalik atau menyamping | Memutar halaman ke orientasi yang benar secara otomatis |
| “Recognize existing text again” | PDF sudah memiliki teks, tetapi hasil OCR lama buruk | Menghapus teks lama yang buruk lalu membacanya ulang; pelurusan halaman tidak tersedia |
| “Treat every page as an image” | Lapisan teks lama rusak atau seluruh dokumen perlu dibaca ulang | Memproses semua halaman dari awal; teks yang bisa dipilih dan tautan lama akan hilang |
Untuk PDF hasil scan biasa, mulai dengan “Scan pages without text”. Pilih “Recognize existing text again” bila teks yang terlihat jelas tidak dapat dicari atau hasil salinannya acak. Jika dokumen juga perlu dikenali ulang sepenuhnya, “Treat every page as an image” dapat digunakan, tetapi pahami bahwa tautan dan teks lama tidak dipertahankan.
Sebelum memproses ratusan halaman, uji beberapa halaman yang mewakili dokumen. Tabel, kolom koran, kuitansi, cap, foto, dan cetakan kecil lebih berisiko memerlukan pemeriksaan manual.
Bagaimana memeriksa apakah hasil OCR PDF sudah benar?
Jangan langsung memakai hasil OCR untuk data penting tanpa verifikasi. Lakukan pemeriksaan singkat berikut.
- Buka PDF hasil OCR di pembaca PDF pilihan Anda.
- Tekan Ctrl+F di Windows atau ChromeOS, Command+F di Mac, atau gunakan Cari pada ponsel.
- Cari kata yang mudah diverifikasi, misalnya judul, nama perusahaan, nomor dokumen, atau nama orang.
- Pastikan pembaca PDF berpindah ke lokasi kata yang benar.
- Ulangi pengujian pada halaman awal, tengah, dan akhir karena kualitas scan dapat berbeda antarhalaman.
- Pilih satu atau dua kalimat, salin, lalu tempel ke editor teks biasa.
- Bandingkan data penting dengan scan asli, khususnya nominal, tanggal, NIK, nomor faktur, nomor rekening, alamat email, dan nama.
Berikan perhatian khusus pada pasangan karakter 0 dan O, 1 dan l, serta 5 dan S. Untuk dokumen hukum, keuangan, audit, atau administrasi resmi, OCR adalah alat bantu pencarian dan penyalinan, bukan pengganti pemeriksaan sumber asli.
Jika hasilnya banyak salah, cari scan yang lebih tajam dan tegak bila tersedia. Pilih bahasa yang benar, aktifkan perbaikan orientasi bila perlu, lalu jalankan OCR kembali.
Bagaimana mengubah PDF hasil scan menjadi Word setelah OCR?
Urutan proses sangat penting. Alat PDF ke Word tidak mengenali teks dari scan yang belum memiliki lapisan teks. Jika PDF scan langsung dikonversi, halaman scan akan dimasukkan ke DOCX sebagai gambar, bukan paragraf yang dapat diedit.
- Jalankan OCR terlebih dahulu dan unduh PDF yang dapat dicari.
- Buka alat PDF ke Word.
- Klik “Pilih file PDF”, lalu pilih PDF hasil OCR, bukan scan asli.
- Klik “Konversi ke Word”.
- Setelah selesai, klik “Download the Word document”.
- Buka file DOCX di Word dan periksa hasilnya sebelum mengedit atau membagikannya.
Teks hasil OCR memberi konverter bahan untuk diolah, tetapi tata letak rumit tetap dapat berubah. Periksa paragraf, tabel, kolom, catatan kaki, dan karakter khusus. Sebaiknya buka PDF hasil OCR di samping dokumen Word agar bagian yang perlu dirapikan mudah dibandingkan.
Apa yang perlu diketahui sebelum menjalankan OCR pada PDF bertanda tangan digital?
OCR mengubah struktur PDF karena lapisan teks ditambahkan atau dibuat ulang. Akibatnya, tanda tangan digital pada PDF tidak lagi valid. Simpan selalu salinan asli sebelum memproses dokumen resmi.
- Simpan PDF asli yang belum diubah di lokasi terpisah.
- Jangan menimpa file asli dengan hasil OCR.
- Gunakan PDF hasil OCR untuk pencarian, penyalinan, peninjauan internal, atau konversi ke Word.
- Pertahankan PDF asli sebagai bukti bila validitas tanda tangan, integritas dokumen, atau kebutuhan audit masih diperlukan.
Langkah ini penting untuk kontrak, surat keputusan, laporan audit, dan dokumen lain yang memerlukan verifikasi tanda tangan digital.
FAQ
Apakah OCR PDF gratis di PDF Toucan memerlukan akun?
Tidak. Anda dapat memilih PDF, menentukan bahasa dokumen, menjalankan “Kenali teks”, dan mengunduh hasil tanpa membuat akun. Tidak ada watermark atau batas harian pada alat browser. Beberapa PDF juga dapat ditambahkan dalam satu proses dan diproses masing-masing.
Apakah PDF hasil OCR bisa dicari dengan Ctrl+F dan teksnya disalin?
Ya. OCR menambahkan lapisan teks pada halaman scan sehingga kata dapat dicari dengan Ctrl+F, Command+F, atau fitur Cari di ponsel. Teks juga dapat dipilih dan disalin. Tetap periksa hasil salinan karena karakter tertentu mungkin salah dikenali.
Mengapa OCR salah membaca angka atau huruf pada hasil scan?
Kesalahan dapat muncul karena scan buram, miring, gelap, berbayang, terlalu kecil, atau tertutup cap. Karakter seperti 0 dan O juga mudah tertukar. Pilih bahasa yang sesuai, luruskan halaman bila perlu, dan bandingkan data penting dengan scan asli.
Apakah saya bisa memilih lebih dari satu bahasa saat OCR PDF?
Bisa. Anda dapat menggabungkan hingga lima bahasa, misalnya Bahasa Indonesia dan Inggris untuk dokumen bilingual. Pilih hanya bahasa yang benar-benar muncul dalam dokumen. Terlalu banyak bahasa memperlambat pemrosesan dan tidak selalu meningkatkan ketepatan hasil.
Apakah PDF ke Word langsung mengubah PDF hasil scan menjadi teks yang dapat diedit?
Tidak untuk scan yang belum di-OCR. Halaman scan tanpa lapisan teks akan ditambahkan sebagai gambar ke dokumen Word. Jalankan OCR terlebih dahulu, unduh PDF yang dapat dicari, lalu konversikan file tersebut agar tersedia teks yang dapat diedit dan diperiksa.
