Lewati ke konten
PDFToucan Beranda PDF Toucan

OCR PDF

Ubah pindaian menjadi PDF yang teksnya dapat dicari dan disalin tanpa mengubah format output dari PDF.

atau seret file ke sini

OCR PDF

Di PDF Toucan, OCR PDF adalah proses berbasis server yang mengubah halaman pindaian menjadi teks yang dapat dicari dan disalin di dalam dokumen PDF. Gunakan alat ini saat dokumen Anda berupa pindaian dan fitur pencarian tidak dapat menemukan kata-katanya. Tambahkan satu atau beberapa file, pilih bahasa dokumen yang digunakan, lalu unduh hasilnya setelah pengenalan selesai. Output tetap berupa PDF, bukan konversi langsung ke Word.

Yang dapat Anda lakukan dengan OCR PDF

  • Cari dan salin teks dari PDF pindaian

    Buat dokumen menjadi dapat dicari saat halamannya berupa pindaian. Setelah pengenalan teks selesai, Anda dapat mencari kata, memilih bagian tertentu, dan menyalin teks dari PDF tersebut. Ini berguna untuk mengelola arsip dan catatan pindaian tanpa harus mengetik ulang isinya secara manual.

  • Pilih hingga lima bahasa dokumen

    Pilih dari 30 bahasa pengenalan yang mencakup aksara Latin, Kiril, Yunani, Arab, Ibrani, Dewanagari, Thai, Tionghoa, Jepang, dan Korea. Jika dokumen memakai lebih dari satu bahasa, pilih semua bahasa yang relevan, hingga maksimal lima bahasa. Memilih bahasa tambahan akan memperlambat proses.

  • Pindai hanya halaman tanpa teks

    Gunakan opsi pindai halaman tanpa teks saat dokumen Anda memiliki campuran halaman pindaian dan halaman berbasis teks. Halaman yang sudah berisi teks akan dibiarkan, sementara halaman tanpa teks akan dikenali. Ini adalah cara praktis untuk memproses dokumen tanpa mengubah halaman yang sudah berfungsi.

  • Kenali ulang teks yang hasilnya kurang tepat

    Pilih opsi kenali ulang teks yang ada jika dokumen sudah memiliki teks yang dapat dipilih namun hasil pengenalannya buruk. Teks lama akan dihapus dan halaman dibaca ulang. Anda juga dapat menganggap setiap halaman sebagai gambar untuk mengenali dari awal, yang akan menghilangkan teks dan tautan lama.

  • Luruskan dan putar halaman pindaian

    Aktifkan perbaikan halaman untuk meluruskan halaman yang miring serta perbaiki orientasi halaman secara otomatis. Pelurusan tidak tersedia saat Anda memilih untuk mengenali ulang teks yang ada. Opsi ini membuat dokumen pindaian menjadi lebih rapi dan mudah dibaca sebelum teksnya mulai dikenali.

  • Proses beberapa PDF secara terpisah

    Tambahkan beberapa file sekaligus dalam satu sesi saat Anda perlu mengenali sekumpulan dokumen. Setiap file diproses secara terpisah, sehingga hasilnya tidak tercampur. Saat proses selesai, Anda menerima PDF yang dapat dicari untuk setiap file, tanpa menggabungkan dokumen menjadi satu.

OCR PDF online - begini caranya

OCR PDF online - begini caranya
  1. Tambahkan PDF pindaian yang ingin dikenali

    Klik tombol Pilih file PDF dan ambil satu atau beberapa dokumen dari perangkat Anda. Setiap file diproses secara terpisah. Gunakan pindaian yang membutuhkan teks yang dapat dicari dan disalin; hasil akhirnya akan berupa dokumen PDF untuk setiap file yang Anda kirimkan.

  2. Pilih semua bahasa yang digunakan dalam dokumen

    Pilih setidaknya satu bahasa dokumen sebelum memulai. Jika dokumen memakai lebih dari satu bahasa, pilih semua bahasa yang relevan, hingga maksimal lima bahasa. Jaga agar pilihan tetap spesifik, karena bahasa tambahan akan memperlambat proses pengenalan.

  3. Tentukan halaman yang perlu dipindai

    Pertahankan opsi yang disarankan untuk memindai halaman tanpa teks jika dokumen Anda sudah memiliki teks yang dapat dipilih. Pilih kenali ulang teks yang ada hanya jika teks lama salah. Anggap setiap halaman sebagai gambar jika Anda ingin semua halaman dikenali dari awal.

  4. Aktifkan perbaikan halaman lalu kenali teks

    Pilih pelurusan halaman untuk pindaian yang miring dan koreksi orientasi otomatis untuk halaman yang menyamping atau terbalik. Kemudian klik Kenali teks untuk memulai. Pengenalan teks dapat memakan waktu beberapa menit untuk file dengan banyak halaman, terutama jika beberapa bahasa dipilih.

  5. Unduh PDF yang dapat dicari

    Setelah pengenalan selesai, PDF yang dapat dicari tersedia untuk setiap file. Anda sekarang dapat mencari dan menyalin teks yang dikenali.

Pemrosesan server dengan penghapusan otomatis

PDF Toucan memproses file pengguna pada server di Uni Eropa. File Anda dikirim melalui HTTPS dan diproses di memori. File tidak pernah ditulis ke disk atau disimpan secara permanen. Sistem menghapus file secara otomatis segera setelah Anda mengunduh hasilnya, atau paling lambat setelah 10 menit. Layanan ini gratis, tidak memerlukan pembuatan akun, dan tidak menambahkan watermark pada dokumen Anda. Iklan membantu mendanai situs ini. Tanda tangan digital yang sudah ada pada dokumen akan menjadi tidak valid setelah pemrosesan selesai.

Diproses dalam memori di server kami di Uni Eropa. File Anda tidak pernah disimpan: dihapus segera setelah Anda mengunduh hasilnya (paling lambat setelah 10 menit).

OCR PDF – pertanyaan umum

Bagaimana cara OCR PDF agar teksnya bisa dicari?

Tambahkan file pindaian Anda, pilih bahasa yang digunakan di dalamnya, tentukan halaman yang akan dipindai, lalu mulai pengenalan. Setelah pemrosesan selesai, unduh PDF yang dapat dicari. Anda kemudian dapat mencari kata di dalam dokumen, memilih teks yang dikenali, dan menyalinnya sesuai kebutuhan Anda.

Apakah OCR PDF gratis tanpa membuat akun?

Ya, Anda dapat menggunakan layanan online ini secara gratis tanpa perlu mendaftar. Tambahkan dokumen Anda, atur opsi pengenalan, dan unduh hasilnya tanpa watermark. Pemrosesan mungkin memakan waktu beberapa menit apabila dokumen memiliki banyak halaman atau menggunakan beberapa bahasa sekaligus.

Bisakah PDF pindaian diubah menjadi teks yang dapat disalin?

Ya, Anda dapat membuat pindaian menjadi dapat dicari secara gratis. Pilih file, tentukan bahasa dokumen, dan jalankan pengenalan teks. File yang dihasilkan tetap berformat PDF dan menyertakan teks yang dikenali sehingga Anda dapat mencari, memilih, serta menyalin isinya dengan mudah.

Bahasa apa saja yang tersedia untuk pengenalan teks PDF?

Tersedia 30 bahasa pengenalan yang mencakup aksara Latin, Kiril, Yunani, Arab, Ibrani, Dewanagari, Thai, Tionghoa, Jepang, dan Korea. Anda dapat menggabungkan hingga lima bahasa dalam satu proses.

Kapan saya perlu mengenali ulang teks yang sudah ada?

Gunakan opsi ini jika dokumen Anda sudah memiliki teks yang dapat dipilih namun hasil pengenalannya buruk atau berantakan. Opsi yang disarankan biasanya membiarkan halaman yang sudah berisi teks. Jika Anda memilih untuk mengenali ulang, teks lama yang dapat dipilih akan dihapus dan diganti dengan hasil baru.

Apakah tanda tangan digital tetap valid setelah OCR?

Tidak, tanda tangan digital apa pun yang sudah ada menjadi tidak valid setelah pemrosesan selesai. Alat ini akan menunjukkan bahwa tanda tangan digital tidak lagi valid. Simpan dokumen asli yang ditandatangani jika Anda perlu mempertahankan statusnya.

Setelah OCR, apakah PDF pindaian bisa diubah ke Word?

Ya, Anda bisa. Pertama, ubah pindaian menjadi teks dengan membuat PDF yang dapat dicari di sini, lalu gunakan alat PDF ke Word yang terpisah jika Anda membutuhkan dokumen Word. Proses pengenalan ini sendiri menghasilkan PDF yang dapat dicari, bukan file Word secara langsung.

Gunakan alat ini saat Anda perlu membuat file pindaian menjadi dapat dicari secara online dan mempertahankan hasilnya sebagai PDF. Jika Anda membutuhkan dokumen Word yang dapat diedit setelahnya, coba alat PDF ke Word pada hasil yang sudah dapat dicari tersebut. Jika pengenalan teks meningkatkan ukuran file, alat Kompres PDF dapat membantu menguranginya sebelum Anda membagikan atau menyimpan dokumen.

Terakhir diperbarui 19 September 2026

Panduan untuk alat ini