
A PDF OCR olyan, szerveren futó szövegfelismerési folyamat, amely a szkennelt PDF-oldalakat kereshető és kijelölhető szöveggel egészíti ki. Akkor használd, ha a dokumentum képként beolvasott oldalakat tartalmaz, és nem találsz benne kereséssel szavakat. Tölts fel egy vagy több fájlt, válaszd ki a nyelveket, majd töltsd le a kereshető PDF-et. A kimenet PDF marad, nem közvetlen Word-fájl.
Mit tehet a(z) PDF OCR szövegfelismerés eszközzel?
Kereshető és másolható szöveg a szkennelt oldalakon
Ha a PDF oldalai csak képként tartalmazzák a szöveget, a felismerés után kereshetsz a dokumentumban. Kijelölheted és kimásolhatod a felismert részleteket is. Ez különösen hasznos archivált iratoknál, beolvasott jegyzeteknél és olyan anyagoknál, amelyeket újragépelés nélkül szeretnél átnézni.
A dokumentumhoz illő felismerési nyelvek
Válaszd ki a dokumentumban ténylegesen használt nyelveket. A rendszer 30 nyelvet és több írásrendszert támogat, köztük latin, cirill, görög, arab, héber, dévanágari, thai, kínai, japán és koreai írást. Egy futásban legfeljebb öt nyelv kombinálható. A feleslegesen kijelölt további nyelvek lassítják a feldolgozást.
Csak a szöveg nélküli oldalak beolvasása
Az ajánlott beállítás csak azokon az oldalakon futtat felismerést, amelyeken nincs kijelölhető szöveg. A már használható szöveget tartalmazó oldalak változatlanok maradnak. Így vegyes tartalmú dokumentumnál nem módosítod szükségtelenül azokat az oldalakat, amelyekben a keresés és a másolás már működik.
Hibás korábbi felismerés újraolvasása
Ha egy PDF-ben már van kijelölhető, de hibásan felismert szöveg, választhatod annak ismételt felismerését. Ilyenkor a régi szöveg törlődik, az oldalak pedig új OCR-feldolgozást kapnak. A „minden oldal kezelése képként” lehetőség elölről kezdi a folyamatot, de a régi kijelölhető szöveget és linkeket is elveszíti.
Ferde és rosszul tájolt szkennelések javítása
Kapcsold be a ferdén beolvasott oldalak kiegyenesítését, hogy olvashatóbb legyen a dokumentum. Az automatikus tájolásjavítás a fejjel lefelé vagy oldalra fordítva szkennelt oldalakat megfelelő irányba forgatja. A ferde oldalak kiegyenesítése nem érhető el akkor, ha meglévő szöveg ismételt felismerését választod.
Több PDF külön kereshető fájlként
Több PDF-et is feltölthetsz egy munkamenetben, ha több dokumentumon szeretnél szövegfelismerést futtatni. Minden fájl külön kerül feldolgozásra, ezért az eredmények is külön maradnak. A kész kereshető PDF-eket egyenként töltheted le, az eredeti fájlstruktúrát megőrizve.
PDF OCR szövegfelismerés online – útmutató

Töltsd fel a felismerendő szkennelt PDF-eket
Kattints a „PDF-fájlok kiválasztása” gombra, majd válassz ki egy vagy több PDF-et az eszközödről. Minden feltöltött fájl külön feldolgozást kap. Olyan szkennelt PDF-et adj hozzá, amelyben kereshetővé és másolhatóvá szeretnéd tenni a szöveget.
Jelöld ki a dokumentumban használt nyelveket
Válassz legalább egy nyelvet, és jelöld be az összes, oldalakon előforduló nyelvet. Egy dokumentumhoz legfeljebb öt nyelvet adhatsz meg. Maradj a szükséges nyelveknél, mert több kiválasztott nyelv lassíthatja a PDF OCR feldolgozását.
Válaszd ki az OCR-re váró oldalakat
Vegyes dokumentumnál hagyd bekapcsolva a szöveg nélküli oldalak beolvasását. Ez nem módosítja a már kijelölhető szöveggel rendelkező oldalakat. Csak hibás régi felismerés esetén válaszd a meglévő szöveg ismételt felismerését, vagy kezeld képként az összes oldalt.
Javítsd az oldalakat, majd indítsd el a felismerést
Szükség esetén egyenesítsd ki a ferde szkenneléseket, és kapcsold be az oldaltájolás automatikus javítását. Ezután kattints a „Szöveg felismerése” gombra. A sokoldalas PDF-ek felismerése néhány percet igénybe vehet, különösen több fájl vagy több nyelv esetén.
Töltsd le a kereshető PDF-fájlokat
Amikor elkészült a felismerés, töltsd le minden fájl kereshető PDF-változatát. Ekkor már kereshetsz és másolhatsz a felismert szövegben. Ha az eredeti dokumentum digitálisan alá volt írva, számolj vele, hogy az OCR után az aláírás már nem érvényes.
Szerveres feldolgozás rövid megőrzési idővel
A PDF Toucan OCR-szolgáltatása az Európai Unióban működő szervereken dolgozza fel a fájlokat. A PDF HTTPS-kapcsolaton érkezik, a feldolgozás pedig memóriában történik: a fájl nem kerül lemezre és nem tárolódik. Az eredmény letöltése után azonnal törlődik, letöltés hiányában pedig legkésőbb 10 percen belül. A szolgáltatás ingyenes, nem kér fiókot, és nem helyez vízjelet a PDF-re; a hirdetések finanszírozzák az oldalt. A böngészős eszközöknél nincs napi korlát. Mivel a felismerés módosítja a PDF-et, egy meglévő digitális aláírás érvénytelenné válik.
Fájlját memóriában dolgozzuk fel az Európai Unió területén lévő szervereinken. A fájlt sosem tároljuk: az eredmény letöltésekor töröljük, legkésőbb 10 perc után.
PDF OCR szövegfelismerés – gyakori kérdések
Hogyan tehetek kereshetővé egy szkennelt PDF-et?
Töltsd fel a fájlt, válaszd ki a dokumentumban használt nyelveket, majd állítsd be, mely oldalakat kell beolvasni. Indítsd el a felismerést, és töltsd le a kész kereshető PDF-et. Ezután a dokumentumban kereshetsz, szöveget jelölhetsz ki és másolhatsz.
Ingyen használható a PDF OCR online?
Igen. A PDF OCR online ingyen használható, fiók létrehozása és vízjel nélkül. Feltöltheted a PDF-et, megadhatod a felismerési beállításokat, majd letöltheted a kereshető eredményt. Sok oldal vagy több nyelv kiválasztása esetén a feldolgozás néhány percig tarthat.
Kell fiókot létrehoznom a szövegfelismeréshez?
Nem. A szövegfelismeréshez nem kell regisztrálnod vagy belépned. Válaszd ki a PDF-et, jelöld meg legalább az egyik dokumentumnyelvet, és indítsd el a folyamatot. Az eredmény továbbra is PDF lesz, benne kereshető és másolható felismert szöveggel.
Milyen nyelveket ismer fel a PDF OCR?
Harminc felismerési nyelv közül választhatsz, többek között latin, cirill, görög, arab, héber, dévanágari, thai, kínai, japán és koreai írással. Egy futásban legfeljebb öt nyelvet kombinálhatsz. Csak a ténylegesen szükséges nyelveket jelöld ki, mert a több nyelv lassítja a feldolgozást.
Megváltozik a már kijelölhető szöveg a PDF-ben?
Az ajánlott beállítással nem. A szöveg nélküli oldalak beolvasása változatlanul hagyja azokat az oldalakat, amelyeken már van kijelölhető szöveg. Meglévő szöveg ismételt felismerésekor a régi szöveg törlődik, a minden oldalt képként kezelő opció pedig a linkeket is eltávolítja.
Miért válik érvénytelenné a digitális aláírás OCR után?
Azért, mert a szövegfelismerés módosítja a PDF-fájlt, ezért a digitális aláírás már nem egyezik a megváltozott dokumentummal. Őrizd meg az eredeti, aláírt PDF-et, ha az aláírás érvényességét meg kell tartanod. A feldolgozott fájlnál erre külön figyelmeztetés jelenik meg.
Átalakítható a szkennelt PDF Word-fájllá a felismerés után?
Igen. Először készíts kereshető PDF-et ezzel a PDF OCR folyamattal, majd használd a különálló pdf-to-word eszközt, ha Word-dokumentumra van szükséged. Az OCR maga nem készít közvetlen Word-fájlt: a kimenete kereshető PDF.
Használd a PDF OCR szolgáltatást, ha a szkennelt dokumentumot kereshető PDF-ként szeretnéd megőrizni. Ha utána szerkeszthető Word-változatra van szükséged, folytasd a pdf-to-word eszközzel. Ha a felismerés után nagyobb lesz a fájlméret, a compress segíthet csökkenteni azt megosztás vagy archiválás előtt.
Utoljára frissítve: 2026. szeptember 20.