Gå til indhold
PDFToucan PDF Toucan-forside

Genkend tekst i PDF: Gør scannede dokumenter søgbare

PDF Toucan editorial team · Senest opdateret 20. september 2026 · 10 min. læsning

Genkend tekst i PDF: Gør scannede dokumenter søgbare

Du kan genkende tekst i PDF med OCR, så en scannet fil bliver søgbar, og teksten kan kopieres. Åbn værktøjet, vælg PDF'en og det relevante sprog, ret eventuelt skæve eller forkert vendte sider, og kontrollér den downloadede PDF med en søgning.

Hvad betyder det at genkende tekst i en PDF?

En scannet PDF består ofte kun af billeder af papirsider. Siderne ser ud som tekst for øjet, men en PDF-læser ser dem som pixels. Derfor finder søgning intet, du kan ikke markere enkelte ord, og kopieret indhold bliver enten tomt eller ubrugeligt.

OCR står for optisk tegngenkendelse. Processen læser bogstaverne i sidebilledet og tilføjer et usynligt, markerbart tekstlag oven på scanningen. PDF'ens visuelle udseende ændrer sig normalt ikke, men du kan bagefter søge, markere og kopiere tekst.

Når OCR er udført, kan du typisk:

  • søge med Ctrl+F på Windows eller Cmd+F på Mac,
  • markere og kopiere tekst fra en side,
  • bruge tekstindholdet som grundlag for videre konvertering.

Resultatet afhænger af kvaliteten af originalen. Klare scanninger af trykt tekst giver ofte gode resultater. Håndskrift, svage kopier, fotos taget på skrå, meget små skrifttyper, stempler og komplicerede tabeller kan give læsefejl. OCR er derfor et nyttigt arbejdsredskab, ikke en garanti for en fejlfri afskrift.

Hvordan gør jeg en scannet PDF søgbar med OCR?

Brug OCR PDF-værktøjet fra PDF Toucan. Det kan behandle én eller flere PDF-filer, men hver fil behandles separat.

  1. Åbn OCR PDF, og vælg "Vælg PDF-filer".
  2. Vælg den scannede PDF. Du kan også slippe filen et vilkårligt sted på siden eller indsætte den.
  3. Find tekstgenkendelsesindstillingerne, og vælg mindst ét sprog under "Document language".
  4. Lad som udgangspunkt "Scan pages without text" være valgt under sideindstillingerne.
  5. Vælg eventuelle sidetilpasninger, hvis scanningerne er skæve eller ligger forkert.
  6. Klik på "Genkend tekst".
  7. Vent på behandlingen, og vælg download af den søgbare PDF, når teksten er genkendt.

Store dokumenter eller filer med mange sider kan tage nogle minutter. Hold derfor browserfanen åben, mens behandlingen kører. Hvis du har valgt flere PDF'er, får du en søgbar udgave af hver enkelt fil.

Hvilket sprog skal jeg vælge til OCR?

Sprogvalget er vigtigt, fordi OCR bruger sprog og skriftsystemer til at skelne mellem bogstaver, tegn og ord. Vælg dansk til et dansk dokument. Indeholder dokumentet også engelske bilag eller afsnit, kan du tilføje engelsk.

Vælg kun de sprog, der faktisk forekommer i filen. Flere sprog kan kombineres i samme kørsel, op til fem, men unødvendige sprog gør behandlingen langsommere og kan gøre genkendelsen mindre præcis.

Vær især opmærksom på bogstaver som æ, ø og å. Det korrekte sprog hjælper OCR med at skelne dem fra lignende tegn. Værktøjet understøtter 30 genkendelsessprog og skriftsystemer, herunder latinske, græske, kyrilliske, arabiske, hebraiske, indiske samt kinesiske, japanske og koreanske skriftsystemer.

Praktiske eksempler:

  • En dansk faktura: vælg dansk.
  • En dansk kontrakt med engelske vilkår: vælg dansk og engelsk.
  • Et dokument med svensk og dansk: vælg begge sprog, hvis begge forekommer løbende.
  • Et rent dansk dokument: undgå at vælge mange ekstra sprog "for en sikkerheds skyld".

Hvordan retter jeg skæve eller forkert vendte scannede sider?

En lidt skæv side kan være nok til at forringe genkendelsen, især ved små skrifttyper og tabeller. Åbn de ekstra indstillinger, før du starter OCR, hvis dokumentet er skannet ujævnt.

  1. Slå "Straighten tilted pages" til, hvis tekstlinjerne hælder eller siderne er ført skævt gennem en scanner.
  2. Slå "Fix page orientation automatically" til, hvis enkelte sider ligger på siden eller på hovedet.
  3. Kontrollér et par sider i den færdige PDF, særligt sider med tabeller, formularfelter eller blandet stående og liggende format.

Retning af skæve sider forbedrer ofte læsbarheden og gør det lettere for OCR at følge tekstlinjerne. Automatisk orientering er praktisk for dokumenter med blandede bilag, hvor nogle sider ved en fejl er vendt 90 eller 180 grader.

Der er en vigtig begrænsning: "Straighten tilted pages" er ikke tilgængelig sammen med "Recognize existing text again". Hvis du både har dårlig eksisterende OCR og skæve sider, kan "Treat every page as an image" være relevant, men læs konsekvenserne i næste afsnit først.

Ved lange arkiver er det fornuftigt at prøve med nogle repræsentative sider først. Så opdager du hurtigt, om sprogvalg og sidetilpasninger giver et brugbart resultat, før du behandler hele dokumentet.

Hvornår skal jeg genkende eksisterende tekst igen?

PDF'er kan være rene scanninger, digitale dokumenter eller en blanding. Under "Which pages should be scanned?" vælger du, hvordan siderne skal behandles.

ValgHvad sker der?Brug det nårVigtig konsekvens
"Scan pages without text"Kun sider uden tekstlag genkendes. Sider med eksisterende tekst lades urørte.Standardvalg for scanninger og blandede PDF'er.Dårlig eksisterende OCR bliver ikke rettet.
"Recognize existing text again"Dårligt genkendt gammelt tekstlag fjernes, og siderne læses igen.Søgning og kopiering giver fejl, selv om teksten ser rigtig ud på siden.Retning af skæve sider er ikke tilgængelig.
"Treat every page as an image"Alle sider omdannes til billeder og genkendes helt fra bunden.Tekstlag er ødelagt eller ubrugeligt i hele filen.Eksisterende markerbar tekst og links går tabt.

Start normalt med "Scan pages without text". Det beskytter allerede gode digitale sider og tilføjer OCR til de sider, der kun er billeder.

Vælg "Recognize existing text again", hvis PDF'en allerede kan søges, men søgeresultaterne er forkerte, eller kopieret tekst består af meningsløse tegn. Vælg kun "Treat every page as an image", når du bevidst vil genopbygge tekstlaget for hele dokumentet og accepterer, at eksisterende links og markerbar tekst forsvinder.

Bemærk også digitale signaturer: OCR ændrer PDF'ens indhold. En eksisterende digital signatur er derfor ikke længere gyldig efter behandlingen. Behold den signerede original uændret, og brug en kopi til OCR, søgning og videre arbejde.

Hvordan kontrollerer jeg, om OCR-teksten er korrekt?

Kontrollér altid resultatet, før du bruger det til vigtige oplysninger, redigering eller sagsbehandling. En hurtig test tager kun få minutter.

  1. Åbn den downloadede søgbare PDF i din sædvanlige PDF-læser.
  2. Tryk på Ctrl+F eller Cmd+F, og søg efter et usædvanligt navn, et beløb, et fakturanummer eller et ord med æ, ø eller å.
  3. Bekræft, at PDF-læseren hopper til det synlige ord på den rigtige side.
  4. Gentag testen på en side tidligt, midt i og sent i dokumentet.
  5. Markér et kort afsnit, kopiér det til en teksteditor, og sammenlign det med den synlige side.

Se især efter fejl i:

  • personnavne, adresser og virksomhedsnavne,
  • datoer, beløb og kontonumre,
  • tabeller og kolonner,
  • fodnoter, stempler og svag tekst,
  • tegn, der ligner hinanden, som 0 og O eller 1 og l.

Hvis resultatet er dårligt, prøv igen med det korrekte dokumentsprog. Prøv også automatisk sidereorientering eller retning af skæve sider. Hvis PDF'en har et gammelt, fejlbehæftet tekstlag, kan du genkende den eksisterende tekst igen eller behandle alle sider som billeder.

Kan jeg konvertere den søgbare PDF til Word bagefter?

Ja, men rækkefølgen er afgørende. En almindelig scanning indeholder ingen rigtig tekst. Konverterer du den direkte, bliver scannede sider sat ind som billeder i Word i stedet for redigerbar tekst.

Gør sådan:

  1. Udfør først OCR, og download den søgbare PDF.
  2. Åbn PDF til Word.
  3. Vælg "Vælg PDF-filer", og vælg den OCR-behandlede PDF, ikke den oprindelige scanning.
  4. Klik på "Konvertér til Word".
  5. Download DOCX-filen, og åbn den i Word.
  6. Sammenlign Word-dokumentet med PDF'en, før du redigerer eller deler det.

PDF til Word udfører ikke selv tekstgenkendelse. Derfor skal OCR komme først. Selv efter OCR bør du kontrollere overskrifter, afsnit, tabeller, spalter og fodnoter ekstra grundigt, fordi komplekse layout kan flytte sig under konverteringen.

Er det sikkert at bruge OCR PDF online?

OCR PDF hos PDF Toucan behandles på servere i EU. Filen sendes via HTTPS, behandles i hukommelsen og skrives ikke til disk eller lagres. Den slettes, når resultatet downloades, og senest efter 10 minutter.

Værktøjet kræver ikke konto, tilføjer ikke vandmærke og har ingen daglig grænse for browser-værktøjerne. Alligevel bør du selv vurdere dokumentets følsomhed. Upload ikke materiale, som du ikke må dele med en ekstern behandlingstjeneste, eller som efter interne regler skal blive på din egen enhed.

Hvordan gør jeg en PDF søgbar?

Åbn OCR PDF, vælg "Vælg PDF-filer", og tilføj filen. Vælg mindst ét sprog under "Document language", klik på "Genkend tekst", og download den færdige PDF. Test derefter med Ctrl+F eller Cmd+F, om søgning finder ord på de forventede sider.

Kan OCR genkende dansk æ, ø og å?

Ja, vælg dansk som dokumentsprog for at give genkendelsen de bedste forudsætninger for danske bogstaver og ordmønstre. Kontrollér dog altid vigtige navne, beløb og stednavne bagefter. Svage scanninger, små skrifttyper og håndskrift kan stadig føre til fejl.

Hvorfor kan jeg ikke redigere en scannet PDF i Word?

En scanning består normalt af sidebilleder og ikke redigerbar tekst. Konverteres den direkte til Word, indsættes siderne derfor som billeder. Kør først OCR, download den søgbare PDF, og brug derefter PDF til Word. Kontrollér den færdige DOCX, særligt tabeller og komplekse layout.

Ødelægger OCR en digital signatur?

Ja. OCR tilføjer eller genopbygger tekstindholdet i PDF'en, så dokumentet ændres. Derfor er en eksisterende digital signatur ikke længere gyldig. Gem den signerede original uændret, hvis signaturen skal kunne kontrolleres senere, og brug kun en kopi som søgbar arbejdsudgave.

Kan jeg OCR-behandle flere PDF-filer på én gang?

Ja, du kan vælge flere PDF-filer i samme omgang. Hver fil behandles dog for sig, og du får en søgbar udgave af hver enkelt. Behandling af store filer eller mange sider kan tage nogle minutter, så lad browserfanen være åben, indtil resultaterne er klar.

OCR PDF online - sådan gør du
OCR PDF online - sådan gør du

Relaterede guides