PDF OCR yapma: Taranmış PDF’yi Aranabilir Hale Getirme
PDF Toucan editorial team · Son güncelleme: 20 Eylül 2026 · 8 dk okuma

Taranmış bir belge için PDF OCR yapma işlemi, sayfa görüntülerinin arkasına aranabilir ve kopyalanabilir bir metin katmanı ekler. OCR (Metin Tanıma) aracında PDF’yi seçin, belge dilini belirleyin, gerekirse eğrilik ve yön düzeltmelerini açın, ardından “Metni tanı” düğmesine basın. İndirdiğiniz PDF’nin görünümü korunur; ancak içindeki kelimeleri arayabilir ve metni kopyalayabilirsiniz.
PDF OCR yapma nedir, ne işe yarar?
Tarayıcıdan çıkan PDF, çoğu zaman metin içeren bir dosya değil, sayfa sayfa kaydedilmiş görüntülerden oluşur. Belge ekranda okunabilir görünse bile PDF okuyucu harfleri kelime olarak algılamaz. Bunun sonucu olarak:
- Ctrl+F veya Command+F ile arama yapılamaz.
- Bir cümleyi seçmek yerine sayfadaki görüntü alanı seçilir.
- Kopyalanan içerik boş, eksik veya kullanılamaz olabilir.
OCR, yani optik karakter tanıma, sayfadaki harf şekillerini analiz eder ve bunları PDF’ye görünmez bir metin katmanı olarak ekler. Böylece sayfanın özgün tarama görüntüsü yerinde kalırken kelimeleri aramak, seçmek ve kopyalamak mümkün olur.
PDF Toucan’da OCR çıktısı yine PDF biçimindedir. Bu nedenle belge düzenini korumak, arşivde isim veya tarih aramak ve metinden alıntı kopyalamak için uygundur. Ancak OCR, kusursuz bir yazıya döküm garantisi değildir. El yazısı, soluk fotokopi, düşük çözünürlük, gölgeli telefon fotoğrafı, damga, dekoratif yazı tipi ve karmaşık tablolar hataya daha yatkındır.
Taranmış PDF’ye OCR nasıl uygulanır?
İşlem bilgisayar, tablet ve telefonda tarayıcı üzerinden benzer şekilde yapılır. Çok sayfalı dosyalarda metin tanıma birkaç dakika sürebilir.
- OCR (Metin Tanıma) sayfasını açın.
- “PDF dosyalarını seç” düğmesine dokunun veya tıklayın ve taranmış PDF’yi seçin. Dosyayı sayfanın herhangi bir yerine sürükleyip bırakabilir ya da panodan yapıştırabilirsiniz.
- Belge dili bölümünden dokümanda kullanılan dili veya dilleri seçin. En az bir dil seçilmelidir.
- Gerekirse Daha fazla seçenek alanını açın. Buradan taranacak sayfaları, mevcut metin katmanının nasıl ele alınacağını ve sayfa düzeltmelerini belirlersiniz.
- “Metni tanı” düğmesini seçin. Birden fazla PDF eklediyseniz her dosya ayrı olarak işlenir.
- İşlem tamamlandığında “Download the searchable PDF” düğmesiyle aranabilir PDF’yi indirin.
- İndirdiğiniz dosyayı PDF okuyucuda açıp arama yaparak sonucu kontrol edin.
Özellikle uzun arşivlerde önce 5–10 sayfalık bir örnekle deneme yapmak iyi bir yaklaşımdır. Böylece dil ve sayfa düzeltme seçimlerinin belgenizde nasıl sonuç verdiğini, yüzlerce sayfayı işleme göndermeden görebilirsiniz.
OCR için belge dili nasıl seçilir?
Dil seçimi yalnızca arayüz tercihi değildir; tanıma motorunun hangi harfleri, alfabeleri ve kelime kalıplarını bekleyeceğini belirler. Türkçe belgelerde doğru dil seçimi, özellikle ç, ğ, ı, İ, ö, ş, ü karakterlerinin doğru okunmasına yardımcı olur.
Belgede yalnızca Türkçe varsa Türkçeyi seçin. Türkçe ve İngilizce içeren bir sözleşme, teknik doküman veya fatura için iki dili de ekleyin. Tek işlemde en fazla beş dil birleştirilebilir.
Gereksiz tüm dilleri seçmeyin. Ek diller işlemi yavaşlatabilir; ayrıca birbirine benzeyen karakterlerde istenmeyen eşleştirmelere yol açabilir. Örneğin yalnızca Latin harfli bir belge için başka yazı sistemlerini eklemek genellikle fayda sağlamaz.
Araç; Latin, Kiril, Yunanca, Arapça, İbranice, Devanagari, Tayca, Çince, Japonca ve Korece yazıları dâhil 30 tanıma dilini destekler. Bir belgede farklı alfabeler gerçekten bulunuyorsa yalnızca kullanılan dilleri birlikte seçin.
Eğri, ters veya zaten metin içeren PDF sayfaları nasıl düzeltilir?
Daha fazla seçenek bölümünde, belgenin durumuna göre tarama biçimini seçebilirsiniz. Başlangıç için önerilen seçenek çoğu durumda “Scan pages without text” seçeneğidir. Bu seçenek, metin içermeyen görüntü tabanlı sayfaları OCR’dan geçirir; zaten seçilebilir metni olan sayfalara dokunmaz.
| Seçenek | Ne yapar? | Ne zaman kullanılmalı? | Dikkat edilmesi gereken |
|---|---|---|---|
| Scan pages without text | Yalnızca metin katmanı olmayan sayfaları tanır | Yeni taramalar ve karma PDF’ler | Var olan kötü metin katmanını düzeltmez |
| Recognize existing text again | Hatalı eski metni kaldırır ve sayfayı yeniden okur | Arama ve kopyalama sonucu anlamsızsa | Bu modda eğri sayfa düzeltme kullanılamaz |
| Treat every page as an image | Her sayfayı görüntüye çevirip sıfırdan tanır | Metin katmanı bozuk veya tutarsızsa | Mevcut seçilebilir metin ve bağlantılar kaybolur |
Sayfalar hafif çapraz tarandıysa “Straighten tilted pages” seçeneğini açın. Satırların yatay hâle gelmesi, özellikle küçük yazılarda tanımayı iyileştirebilir. Sayfalar ters veya yana dönükse “Fix page orientation automatically” seçeneği doğru yönü otomatik saptamaya çalışır.
Önemli sınırlama şudur: “Recognize existing text again” seçiliyken eğri sayfa düzeltme kullanılamaz. Hem kötü eski metni yenilemeniz hem de eğriliği gidermeniz gerekiyorsa “Treat every page as an image” seçeneği düşünülebilir. Fakat bu tercihin mevcut bağlantıları ve seçilebilir metni kaldıracağını hesaba katın.
OCR sonucunun doğru olduğunu nasıl kontrol edebilirim?
OCR bittiğinde yalnızca indirmenin başarılı olduğunu değil, metnin doğru okunduğunu da doğrulamalısınız. İsim, tutar, tarih, adres, hesap numarası ve T.C. kimlik numarası gibi kritik veriler için bu adım önemlidir.
- Aranabilir PDF’yi açın.
- Belgede görünen, nadir geçen bir soyadı, fatura numarası veya tarih için arama yapın. Windows’ta Ctrl+F, Mac’te Command+F kullanın.
- Aramanın doğru sayfaya götürüp götürmediğini denetleyin. Baş, orta ve son bölümlerden en az birer sayfa kontrol edin.
- Kısa bir cümleyi seçip kopyalayın ve düz metin alanına yapıştırın.
- Kopyalanan metni özgün taramayla karakter karakter karşılaştırın.
Türkçe ı/İ harfleriyle birlikte O/0, l/1, S/5 gibi benzer karakterlere dikkat edin. Tablo sütunları, dipnotlar ve çok sütunlu düzenler de satır sırasının değişmesine neden olabilir.
Sonuç zayıfsa daha net bir tarama kullanın, belge dilini gözden geçirin ve eğrilik veya yön düzeltmesini açın. Eski ve hatalı bir OCR katmanı sorun yaratıyorsa belgeyi uygun yeniden tanıma seçeneğiyle tekrar işleyin.
Dijital imzalı bir PDF’ye OCR uygulanması, dosyanın içeriğini değiştirdiği için dijital imzayı geçersiz kılar. İmzalı aslı değiştirmeden ayrı saklayın; aranabilir kopyayı çalışma, arama ve alıntılama amacıyla kullanın.
OCR’den sonra PDF’de arama mı yapmalıyım, Word’e mi dönüştürmeliyim?
Doğru seçim, belgeyle ne yapacağınıza bağlıdır. Görünümü koruyarak arama yapmak ve metinden alıntı almak istiyorsanız OCR’li PDF en uygun seçenektir. Metni kapsamlı biçimde yeniden yazmanız veya düzenlemeniz gerekiyorsa Word belgesi daha pratik olabilir.
| İhtiyaç | Uygun işlem | Beklenen sonuç |
|---|---|---|
| Belge düzenini koruyarak kelime aramak | OCR’li PDF’yi kullanın | Aranabilir ve kopyalanabilir PDF |
| Birkaç cümleyi yeniden kullanmak | PDF’den metni kopyalayın | Denetim gerektiren metin alıntısı |
| Word’de metni düzenlemek | Önce OCR, sonra Word dönüşümü | Düzenlenebilir içerik için başlangıç dosyası |
| Taranmış sayfayı doğrudan Word’e çevirmek | Tek başına önerilmez | Sayfalar resim olarak eklenebilir |
PDF Toucan’daki PDF’ten Word aracı PDF’yi DOCX biçimine dönüştürür; ancak taranmış sayfalardaki görüntüyü kendi başına metne çevirmez. OCR uygulanmamış bir tarama, Word belgesine resim olarak eklenebilir ve metin düzenlenebilir olmaz.
Daha güvenli iş akışı şöyledir:
- Önce OCR ile aranabilir PDF oluşturun.
- İndirdiğiniz aranabilir PDF’yi PDF’ten Word aracına ekleyin.
- “PDF dosyalarını seç” düğmesinden dosyayı seçin.
- “Word’e dönüştür” düğmesini kullanın.
- DOCX dosyasını Word’de açın; başlıkları, satır sonlarını, tabloları ve kritik sayıları özgün PDF ile karşılaştırın.
PDF Toucan’da dosya gizliliği ve kullanım sınırları nelerdir?
OCR işlemi hesaplama gerektirdiğinden dosya HTTPS üzerinden Avrupa Birliği’ndeki sunuculara gönderilir. Dosya bellekte işlenir; diske yazılmaz veya saklanmaz. Sonuç indirildikten sonra, en geç 10 dakika içinde silinir.
Tarayıcı araçlarında hesap açma zorunluluğu, filigran veya günlük kullanım sınırı bulunmaz; hizmet reklamlarla desteklenir. Buna rağmen çok hassas kişisel veriler, ticari sırlar veya hukuki belgeler için kurumunuzun veri politikalarını ayrıca değerlendirin. Dijital imza doğrulamasının gerekli olduğu dosyalarda imzalı özgün belgeyi mutlaka değiştirmeden koruyun.
Sık sorulan sorular
PDF OCR yapma ücretsiz mi?
Evet. OCR aracı hesap gerektirmeden kullanılabilir, tarayıcı araçlarında filigran veya günlük kullanım sınırı yoktur. PDF’yi seçip belge dilini belirledikten sonra “Metni tanı” düğmesiyle aranabilir kopyayı oluşturabilirsiniz. Çok sayfalı dosyalarda işlem süresi daha uzun olabilir.
OCR sonrası PDF’de kelime veya isim nasıl aranır?
İndirilen aranabilir PDF’yi açın ve Windows’ta Ctrl+F, Mac’te Command+F kullanın. Arama kutusuna ad, soyad, tarih veya belge numarası yazın. Sonucun doğru olduğundan emin olmak için bulunan kelimeyi özgün tarama görüntüsü üzerinde de kontrol edin.
Türkçe karakterler OCR’da neden yanlış çıkıyor?
Yanlış dil seçimi, düşük kaliteli tarama, bulanıklık, eğri sayfa ve soluk baskı tanıma hatalarına neden olabilir. Türkçe dilini seçin, gereksiz dilleri kaldırın ve sayfa eğriliğini düzeltin. Özellikle ı/İ, ö/o ve ş/s karakterlerini kritik alanlarda elle karşılaştırın.
Eğri taranmış PDF sayfaları nasıl düzeltilir?
OCR ayarlarındaki “Straighten tilted pages” seçeneğini açın. Ters veya yan dönmüş sayfalar için otomatik yön düzeltmeyi de kullanın. Ancak “Recognize existing text again” modunda eğri sayfa düzeltme kullanılamaz; işlem modunu buna göre seçmeniz gerekir.
Taranmış PDF’yi Word’e çevirince metin neden resim olarak geliyor?
Taranmış PDF’de gerçek metin katmanı yoksa Word dönüştürücü sayfayı metin yerine görüntü olarak görür. Önce OCR uygulayıp aranabilir PDF oluşturun, sonra bu dosyayı Word’e dönüştürün. Dönüşümden sonra tablo, satır düzeni ve kritik bilgiler için kontrol yapmayı unutmayın.
