OCR PDF online: Fă un PDF scanat ușor de căutat
PDF Toucan editorial team · Ultima actualizare: 20 septembrie 2026 · 8 min de citit

Pentru OCR PDF online, rulează recunoașterea optică a caracterelor pe scanare, alege limba română și descarcă PDF-ul rezultat. Vei putea căuta și copia textul; dacă vrei ulterior un fișier editabil, aplică OCR înainte de conversia în Word.
Ce face OCR într-un PDF scanat?
Un PDF scanat este, de regulă, o colecție de imagini ale paginilor. Documentul poate arăta perfect lizibil pe ecran, însă cititorul PDF nu vede cuvinte, ci pixeli. De aceea, căutarea cu Ctrl+F nu returnează rezultate, selectarea marchează o zonă dreptunghiulară, iar copierea nu produce text utilizabil.
OCR, de la recunoaștere optică a caracterelor, analizează formele literelor din imagine și adaugă în PDF un strat de text selectabil, poziționat peste pagina scanată. Aspectul paginii rămâne în mare parte același, dar documentul devine căutabil și permite copierea fragmentelor.
După procesare, poți căuta un cuvânt cu Ctrl+F pe Windows sau Linux ori cu Command+F pe Mac. Poți selecta un paragraf, îl poți copia și îl poți lipi într-un editor de text sau într-un mesaj.
Rezultatul nu este o transcriere garantat perfectă. Scanările clare, cu text tipărit și contrast bun, sunt de obicei recunoscute bine. În schimb, diacriticele neclare, fonturile decorative, paginile înclinate, tabelele dense, copiile foarte palide, ștampilele și scrisul de mână pot introduce erori. Folosește instrumentul OCR PDF pentru a transforma un PDF scanat într-un PDF în care poți căuta și copia text.
Cum fac OCR PDF online în PDF Toucan?
Procesul funcționează în browser, pe calculator, tabletă sau telefon. PDF Toucan acceptă unul sau mai multe fișiere PDF, iar fiecare fișier este procesat separat.
- Deschide OCR PDF.
- Apasă „Selectează fișiere PDF” și alege documentul sau documentele dorite. Poți, de asemenea, să glisezi fișierele oriunde în pagină sau să le lipești din clipboard.
- La „Document language”, selectează limba sau limbile care apar în document. Este necesară cel puțin o limbă.
- Deschide opțiunile suplimentare dacă vrei să alegi paginile scanate sau să corectezi pagini înclinate și orientate greșit.
- Apasă „Recunoaște textul”.
- Așteaptă finalizarea procesării, apoi descarcă PDF-ul în care se poate căuta.
Recunoașterea poate dura câteva minute pentru documente cu multe pagini. Lasă fila deschisă până când procesarea se termină. Nu ai nevoie de cont, nu se adaugă filigran și nu există limite zilnice pentru instrumentele din browser.
Pentru acest instrument, fișierul este transmis prin HTTPS către servere din Uniunea Europeană. Este procesat în memorie, nu este scris pe disc și nu este stocat; este șters imediat ce descarci rezultatul, cel târziu după 10 minute. Dacă un document are reguli interne care interzic transmiterea lui în afara dispozitivului, alege în schimb o soluție OCR offline.
Ce limbă aleg pentru OCR și pot combina mai multe limbi?
Alegerea limbii este importantă, nu doar o preferință de afișare. Ea ajută motorul OCR să distingă alfabetul, diacriticele și formele probabile ale cuvintelor. Pentru un contract, o factură sau o cerere redactată în română, selectează româna. Pentru un document bilingv, selectează ambele limbi care apar efectiv în pagini.
Poți combina până la cinci limbi într-o singură procesare. De exemplu, pentru un contract româno-englez, selectează română și engleză. Nu adăuga limbi „pentru orice eventualitate”: limbile suplimentare încetinesc procesul și pot reduce precizia prin introducerea unor interpretări alternative ale acelorași caractere.
Instrumentul oferă 30 de limbi și sisteme de scriere, inclusiv scrieri latină, chirilică, greacă, arabă, ebraică, devanagari, thailandeză, chineză, japoneză și coreeană.
| Situație | Limbi recomandate | De ce |
|---|---|---|
| Factură sau act în română | Română | Ajută la diacritice și vocabularul uzual |
| Contract româno-englez | Română și engleză | Ambele limbi sunt analizate în aceeași rulare |
| Document cu citate în engleză, dar text predominant românesc | Română, apoi engleză doar dacă citatele sunt importante | Evită limbi inutile |
| Document cu mai multe alfabete | Doar limbile și scrierile prezente | Reduce confuziile și timpul de procesare |
Cum aleg paginile de scanat și opțiunea potrivită?
Unele PDF-uri sunt mixte: pot avea o primă pagină creată digital și anexe scanate. În acest caz, nu este necesar să recitești toate paginile. La opțiunea pentru paginile care trebuie scanate, alege varianta potrivită situației.
| Opțiune | Ce face | Când este potrivită | Limită importantă |
|---|---|---|---|
| Scanarea paginilor fără text | Recunoaște doar paginile care nu conțin deja text și lasă intacte paginile digitale | Recomandată pentru majoritatea documentelor și PDF-urilor mixte | Textul existent, dar greșit, rămâne neschimbat |
| Recunoașterea din nou a textului existent | Elimină textul vechi recunoscut greșit și citește pagina din nou | PDF-uri cu OCR vechi, imprecis sau inutilizabil | Îndreptarea paginilor nu este disponibilă |
| Tratarea fiecărei pagini ca imagine | Transformă toate paginile în imagini și le recunoaște de la zero | Fișiere cu straturi text defecte sau rezultate foarte neuniforme | Se pierd textul selectabil și linkurile existente |
Începe cu scanarea paginilor fără text, opțiunea recomandată. Este alegerea sigură pentru un scan complet și protejează textul digital corect dintr-un document mixt. Alege recunoașterea din nou a textului existent numai dacă ai verificat că textul selectabil actual este greșit.
Cum îndrept paginile înclinate sau orientate greșit înainte de OCR?
O pagină înclinată chiar și ușor poate reduce calitatea recunoașterii. În opțiunile de corectare a paginilor, activează îndreptarea paginilor înclinate pentru foi puse oblic în scaner sau fotografiate sub un mic unghi. Textul va fi aliniat mai bine pe rânduri, iar PDF-ul va fi mai plăcut de citit.
Activează și corectarea automată a orientării atunci când unele pagini sunt întoarse lateral sau cu susul în jos. Aceasta este utilă pentru dosare care conțin atât pagini portret, cât și tabele peisaj, sau pentru scanări realizate cu alimentator automat.
Urmează acești pași de control:
- Activează îndreptarea paginilor dacă rândurile sunt oblice.
- Activează corectarea automată a orientării dacă pagina este laterală sau inversată.
- Rulează OCR și deschide PDF-ul rezultat.
- Verifică prima pagină, o pagină din mijloc și una de la final: antetele trebuie să fie orizontale, iar rândurile să se citească normal.
Îndreptarea paginilor nu este disponibilă când alegi recunoașterea din nou a textului existent. Dacă ai nevoie de o citire complet nouă și de corecții ale paginii, tratarea fiecărei pagini ca imagine poate fi alternativa, cu costul pierderii linkurilor și textului selectabil anterior.
Cum verific dacă OCR a recunoscut bine textul?
Nu te baza doar pe mesajul că procesarea s-a încheiat. Verifică rezultatul, mai ales înainte să folosești textul într-un document oficial, într-o factură sau într-o bază de date.
- Deschide PDF-ul descărcat și caută cu Ctrl+F sau Command+F un nume, un număr de factură și un cuvânt cu diacritice, cum ar fi „înștiințare”.
- Confirmă că cititorul PDF sare la pagina corectă și evidențiază termenul găsit.
- Selectează câteva rânduri, copiază-le și lipește-le într-un editor simplu de text.
- Compară textul lipit cu scanarea, urmărind literele, spațiile, diacriticele și punctuația.
- Verifică manual numerele de telefon, CNP-urile, sumele, datele, seriile și codurile. Caracterele 0/O, 1/I/l și 5/S sunt confundate frecvent.
Dacă PDF-ul avea deja text selectabil, dar căutarea sau copierea oferă rezultate greșite, rulează din nou procesul cu opțiunea de recunoaștere a textului existent. Dacă stratul text este foarte deteriorat, poți trata fiecare pagină ca imagine și porni recunoașterea de la zero.
OCR modifică documentul pentru a adăuga stratul de text. Prin urmare, o semnătură digitală existentă nu mai este validă după procesare. Păstrează originalul semnat neschimbat și folosește copia OCR doar pentru căutare, copiere sau lucru intern.
Cum convertesc PDF-ul cu OCR în Word sau îl folosesc pentru căutare?
Pentru arhivare, căutare și copiere, păstrează PDF-ul rezultat după OCR. Este formatul potrivit pentru consultare rapidă și pentru căutarea termenilor direct în cititorul PDF.
Pentru editare, ordinea operațiunilor contează:
- Rulează mai întâi OCR și descarcă PDF-ul care poate fi căutat.
- Deschide PDF în Word.
- Apasă „Selectează fișiere PDF” și alege PDF-ul deja procesat prin OCR, nu scanarea originală.
- Apasă „Convertește în Word” și descarcă documentul DOCX.
- Deschide documentul în Microsoft Word și verifică titlurile, paragrafele, coloanele și tabelele înainte de editare sau trimitere.
Nu converti direct în Word o scanare dacă ai nevoie de text editabil. Instrumentul PDF în Word nu face recunoaștere OCR: paginile scanate sunt adăugate în documentul Word ca imagini. După ce OCR adaugă textul în PDF, conversia are text pe care îl poate folosi. Pentru documente mari, poți utiliza ulterior instrumentul compress pentru a reduce dimensiunea unui PDF bazat pe imagini.
Întrebări frecvente
Este OCR PDF online gratuit și trebuie să îmi fac cont?
Da. Instrumentul OCR PDF de la PDF Toucan este gratuit, nu necesită cont și nu aplică filigran. Alegi fișierele, selectezi cel puțin o limbă, apeși „Recunoaște textul” și descarci rezultatul. Procesarea are loc pe servere din UE, în memorie.
Pot face OCR pe un PDF cu pagini în română și engleză?
Da. Selectează română și engleză la „Document language” înainte de procesare. Poți combina până la cinci limbi, însă este recomandat să le alegi numai pe cele prezente efectiv în document. Limbile suplimentare încetinesc recunoașterea și pot afecta precizia.
De ce nu găsește Ctrl+F textul după ce am scanat documentul?
O scanare obișnuită conține imagini, nu text real. Rulează OCR, apoi descarcă fișierul rezultat și deschide exact acea copie în cititorul PDF. Dacă unele pagini tot nu pot fi găsite, verifică orientarea, limba selectată și claritatea scanării originale.
OCR poate recunoaște scrisul de mână?
OCR este cel mai eficient pentru text tipărit clar. Scrisul de mână, mai ales cel cursiv, neuniform sau foarte mic, poate fi recunoscut parțial ori greșit. Verifică manual toate numele, cifrele și informațiile importante înainte de a folosi textul extras într-un document oficial.
Este mai bine să fac OCR înainte de conversia PDF în Word?
Da, dacă vrei text editabil. Fă mai întâi OCR pentru a crea un strat de text în PDF, apoi convertește acel PDF în Word. Conversia directă a unei scanări adaugă paginile ca imagini în DOCX, fără paragrafe editabile sau căutare reală în text.
