Naar inhoud
PDFToucan PDF Toucan startpagina

PDF OCR online gratis: Maak een gescande PDF doorzoekbaar

PDF Toucan editorial team · Laatst bijgewerkt op 20 september 2026 · 9 min leestijd

PDF OCR online gratis: Maak een gescande PDF doorzoekbaar

Met PDF OCR online gratis voeg je aan een gescande PDF een onzichtbare tekstlaag toe. Daardoor blijft de pagina er hetzelfde uitzien, maar kun je tekst zoeken, selecteren en kopiëren. Kies de juiste documenttaal, corrigeer zo nodig scheve pagina’s en controleer de uitkomst voordat je de PDF verder bewerkt of naar Word omzet.

Hoe maak ik een gescande PDF online doorzoekbaar met OCR?

Een scan bestaat meestal uit afbeeldingen van papier. Voor een PDF-lezer zijn dat pixels, geen letters. Daarom vindt zoeken niets en selecteer je vaak alleen een groot afbeeldingsvlak. OCR, oftewel tekstherkenning, analyseert de lettervormen en voegt een tekstlaag toe achter de zichtbare scan.

Volg deze stappen in OCR PDF:

  1. Klik op PDF-bestanden selecteren en kies je gescande PDF. Je kunt een PDF ook ergens op de pagina neerzetten door te slepen, of een bestand plakken.
  2. Kies onder Document language minstens één taal die werkelijk in het document voorkomt.
  3. Laat bij Which pages should be scanned? normaal gesproken Scan pages without text ingeschakeld. Dit is de aanbevolen instelling: pagina’s die al tekst bevatten, blijven ongewijzigd.
  4. Open More options alleen als je pagina’s wilt rechtzetten, draaien of de bestaande tekstlaag opnieuw wilt laten herkennen.
  5. Klik op Tekst herkennen. Bij veel pagina’s kan de herkenning enkele minuten duren.
  6. Kies na afloop Download the searchable PDF.
  7. Open de gedownloade PDF en test zoeken met Ctrl+F op Windows of Linux, of Command+F op een Mac.

Je kunt meerdere PDF’s tegelijk toevoegen. Elk bestand wordt afzonderlijk verwerkt. Na OCR kun je bijvoorbeeld zoeken op een naam, dossiernummer, factuurnummer of postcode zonder iedere pagina handmatig te lezen.

De zichtbare pagina verandert niet wezenlijk door de tekstlaag. Dat is praktisch voor archieven en scans waarvan de oorspronkelijke opmaak moet blijven staan. De tekst onder de afbeelding is echter een interpretatie van OCR en kan fouten bevatten.

Welke OCR-taal moet ik kiezen voor mijn PDF?

De taalkeuze is belangrijker dan zij lijkt. OCR gebruikt de gekozen talen om lettervormen, accenten en woordpatronen beter te onderscheiden. Kies daarom alleen de taal of talen die daadwerkelijk op de pagina’s staan.

SituatieAanbevolen taalkeuzeWaarom
Nederlandse brief of factuurNederlandsHerkent Nederlandse woorden en accenten beter
Nederlands-Engels contractNederlands en EngelsBeide tekstlagen krijgen passende taalondersteuning
Document met een buitenlandse bijlageAlleen de talen die in de bijlage en hoofdtekst voorkomenMinder overbodige interpretaties
Oude, meertalige scanMaximaal vijf relevante talenExtra talen maken de verwerking trager

Je kunt maximaal vijf talen combineren in één opdracht. Vink niet alle beschikbare talen aan “voor de zekerheid”. Extra talen vertragen de herkenning en kunnen verwarring opleveren bij tekens die op elkaar lijken.

De OCR-functie ondersteunt 30 talen, met onder meer Latijnse, Cyrillische, Griekse, Arabische, Hebreeuwse, Devanagari-, Thaise, Chinese, Japanse en Koreaanse schriften. Dat betekent niet dat ieder document foutloos wordt gelezen. Vooral handgeschreven notities, vervaagde kopieën, sierletters, stempels en foto’s met schaduw blijven lastig.

Een scherpe scan van gedrukte tekst geeft doorgaans een beter resultaat dan een scheef gefotografeerd document. Controleer bij formulieren en administratieve stukken altijd namen, bedragen, datums en referentienummers handmatig.

Hoe corrigeer ik een scheve, gedraaide of verkeerd om gescande pagina?

Een paar graden scheefstand kan OCR al hinderen, vooral bij klein lettertype of dicht opeen geplaatste regels. PDF Toucan biedt onder Page fixes twee nuttige correcties.

  1. Schakel Straighten tilted pages in als de regels op de scan zichtbaar schuin lopen. De tool probeert de pagina recht te zetten voordat de tekst wordt herkend.
  2. Schakel Fix page orientation automatically in wanneer pagina’s op hun kop, zijwaarts of in de verkeerde richting zijn gescand.
  3. Controleer na het downloaden enkele pagina’s met tabellen, liggende bijlagen en voetnoten. Automatische rotatie is nuttig, maar een complexe pagina-indeling kan extra controle nodig maken.

Gebruik Treat every page as an image alleen wanneer dat nodig is. Deze instelling zet iedere pagina om naar een afbeelding en herkent alles opnieuw. Daardoor gaan bestaande selecteerbare tekst en links verloren. Het is een bruikbare noodoplossing voor een PDF met een beschadigde of onbetrouwbare tekstlaag, maar niet de eerste keuze voor een normale scan.

Let op de beperking: Straighten tilted pages is niet beschikbaar als je Recognize existing text again gebruikt. Moet een slecht tekstlaagje worden vervangen én zijn pagina’s scheef? Overweeg dan Treat every page as an image, maar accepteer vooraf dat bestaande links en selecteerbare tekst verdwijnen.

Wanneer moet ik bestaande tekst opnieuw laten herkennen?

Niet elke PDF is volledig een scan. Een document kan bijvoorbeeld digitale tekst bevatten, gevolgd door ingescande bijlagen. Kies daarom de herkenningsmodus die bij de staat van je bestand past.

OptieWat gebeurt er?Gebruik deze optie wanneer
Scan pages without textAlleen pagina’s zonder tekst worden gelezen; bestaande tekstpagina’s blijven intactJe een gewone scan of gemengde PDF hebt
Recognize existing text againSlecht herkende oude tekst wordt verwijderd en opnieuw gelezenZoeken of kopiëren wel werkt, maar onjuiste tekst oplevert
Treat every page as an imageAlle pagina’s worden vanaf nul als afbeelding herkendDe huidige tekstlaag onbruikbaar of inconsistent is

Begin normaal met Scan pages without text. Dit voorkomt dat goede digitale tekst onnodig wordt aangepast. Kies Recognize existing text again als je bijvoorbeeld een woord duidelijk op de pagina ziet, maar zoeken niets vindt of kopiëren onleesbare tekens geeft.

Maak bij belangrijke documenten eerst zelf een kopie van het origineel. OCR wijzigt de inhoud van de PDF door een tekstlaag toe te voegen. Heeft het bestand een digitale handtekening, dan is die na OCR niet meer geldig. Bewaar het ondertekende origineel daarom ongewijzigd en gebruik de doorzoekbare versie uitsluitend als werk- of raadpleegkopie.

Hoe controleer ik of de OCR-tekst goed is herkend?

OCR is een hulpmiddel, geen bewijs dat alle tekst foutloos is overgenomen. Een korte controle voorkomt problemen als je de tekst later citeert, doorzoekt of omzet.

  1. Zoek met Ctrl+F of Command+F op een opvallende naam, postcode, factuurnummer en datum.
  2. Test niet alleen de eerste pagina, maar ook een pagina uit het midden en aan het einde van het document.
  3. Selecteer enkele zinnen, kopieer ze en plak ze in een teksteditor.
  4. Vergelijk de geplakte tekst met de scan. Let extra op 0 en O, 1 en l, 5 en S, accenten, decimalen en valuta-bedragen.
  5. Controleer alle pagina’s met tabellen, kolommen, kleine letters, stempels of een lage scanresolutie.
  6. Herhaal de OCR met de juiste taal en paginacorrecties als veel tekst verkeerd is herkend.

Bij tabellen kan de tekst inhoudelijk goed herkend zijn, terwijl de leesvolgorde minder logisch is. Kolommen, cellen en voetnoten worden niet altijd in dezelfde volgorde gekopieerd als waarin je ze visueel leest. Voor kritieke gegevens, zoals een contractbedrag of medisch gegeven, blijft vergelijking met de scan noodzakelijk.

Kan ik een OCR-PDF daarna naar Word omzetten?

Ja, maar de volgorde is essentieel. Maak eerst de scan doorzoekbaar en zet daarna pas die nieuwe PDF om. De tool PDF naar Word voert zelf geen OCR uit. Een oorspronkelijke scan zonder tekstlaag wordt in het Word-document dus als afbeelding toegevoegd.

  1. Verwerk de oorspronkelijke scan eerst via OCR PDF en download de doorzoekbare PDF.
  2. Open PDF naar Word.
  3. Klik op PDF-bestanden selecteren en kies de OCR-verwerkte PDF, niet de oorspronkelijke scan.
  4. Klik op Converteren naar Word.
  5. Download het DOCX-bestand via Download the Word document.
  6. Open het bestand in Word en vergelijk tekst, tabellen en paginawisselingen met de doorzoekbare PDF.

OCR vóór de conversie is de logische stap als je tekst wilt kunnen controleren en kopiëren. Complexe lay-outs, formulieren met invulvelden, meerkoloms pagina’s en tabellen kunnen in Word nog nabewerking vragen. Houd de PDF daarom naast het DOCX-bestand open tijdens de controle.

Is het OCR-resultaat door veel scanpagina’s groot geworden, dan kun je daarna eventueel de tool compress gebruiken voor een kleinere PDF-versie. Controleer na compressie wel opnieuw of de zichtbaarheid van kleine tekst en stempels voldoende is.

Is PDF Toucan veilig voor een PDF met persoonsgegevens?

Voor OCR worden bestanden via HTTPS naar servers in de Europese Unie gestuurd. PDF Toucan verwerkt het bestand in het geheugen, schrijft het niet naar schijf en slaat het niet op. Het bestand wordt verwijderd zodra je het resultaat downloadt, en uiterlijk na tien minuten.

Voor de browsertools zijn geen account, watermerk of dagelijkse limiet nodig; advertenties financieren de site. Toch blijft het verstandig om zelf een afweging te maken. Controleer het beleid van je werkgever, opdrachtgever of organisatie voordat je documenten met bijzondere persoonsgegevens, medische gegevens, looninformatie of vertrouwelijke contracten verwerkt.

Moet een bestand absoluut op je eigen apparaat blijven, kies dan offline OCR-software. Bewaar bij een digitaal ondertekend document altijd de originele, ondertekende PDF apart, omdat OCR de geldigheid van de handtekening aantast.

Veelgestelde vragen

Wat is OCR in een PDF?

OCR staat voor tekstherkenning. De software leest letters op een gescande pagina en voegt ze als onzichtbare tekstlaag aan de PDF toe. Daardoor blijft de scan zichtbaar zoals hij was, terwijl je woorden kunt zoeken, tekst kunt selecteren en inhoud kunt kopiëren.

Kan ik na OCR zoeken in een gescande PDF?

Ja. Download na Tekst herkennen de doorzoekbare PDF en open die in een PDF-lezer. Gebruik vervolgens Ctrl+F op Windows of Linux, of Command+F op een Mac. Test met een herkenbaar woord, een naam of een nummer dat duidelijk op de scan staat.

Waarom herkent OCR sommige woorden of cijfers verkeerd?

De kwaliteit hangt af van de scan, het lettertype, de taalkeuze en de pagina-indeling. Scheve pagina’s, lage resolutie, schaduw, handschrift, tabellen en vage kopieën verhogen de kans op fouten. Controleer daarom vooral bedragen, datums, eigennamen en tekens zoals 0, O, 1 en l.

Kan ik een gescande PDF gratis naar Word omzetten?

Ja, maar voer eerst OCR uit. De PDF-naar-Word-tool herkent geen tekst in een pure scan; zulke pagina’s worden als afbeeldingen in een DOCX-bestand geplaatst. Maak de PDF eerst doorzoekbaar, converteer daarna de OCR-versie en controleer de opmaak in Word.

Blijft een digitale handtekening geldig na OCR?

Nee. OCR voegt een tekstlaag toe en wijzigt daarmee de PDF. Daardoor is een bestaande digitale handtekening niet meer geldig. Bewaar het originele ondertekende bestand ongewijzigd en gebruik alleen een afzonderlijke OCR-kopie voor zoeken, kopiëren of verdere bewerking.

PDF OCR online - zo werkt het
PDF OCR online - zo werkt het

Gerelateerde gidsen