Hvad betyder OCR?
OCR står for Optical Character Recognition. Teknologien omsætter synlige tegn i et billede til tekst, en computer kan arbejde videre med. Den bruges eksempelvis til scannede breve, kvitteringer, tekniske manualer og billeder af dokumenter, der ikke allerede indeholder et brugbart tekstlag.
OCR er ikke det samme som at forstå dokumentets forretningsmæssige betydning. Værktøjet kan læse et beløb, men det afgør ikke alene, om beløbet er subtotal, moms eller det endelige betalingskrav. Den fortolkning kræver struktur, regler eller yderligere analyse.
Fejl kan være små i udseende og store i konsekvens. Et nul kan blive til bogstavet O, et minustegn kan forsvinde, eller et decimalkomma kan overses. Derfor skal en AI-arbejdsgang kontrollere kritiske felter, før den bruger OCR-tekst til beregning, bogføring eller et svar til en kunde.
Forbedr inputtet og bevar placeringen
Undersøg opløsning, rotation, kontrast og beskæring. Et skævt eller uklart foto kan kræve en ny optagelse frem for mere efterbehandling. Gem side og koordinater for tekstfund, hvis værktøjet understøtter det, så en medarbejder kan se feltet i originalen. Kontroller, om dokumentet allerede har et korrekt tekstlag; unødvendig OCR kan introducere fejl. Ved flerspaltede sider er læserækkefølgen et særskilt problem.
Valider de felter, der driver handlinger
Brug formatkontrol, kendte identifikatorer og sammenhænge mellem felter. En fakturas linjer kan sammenholdes med subtotal og total, mens et varenummer kan slås op i et autoritativt register. Lav en tydelig kø for usikre eller modstridende resultater. Et generelt gennemsnit for tegngenkendelse siger ikke nødvendigvis noget om fejl i de få beløb, datoer eller referencer, som bestemmer den efterfølgende handling.
Et eksempel fra praksis
Illustrativt eksempel: En håndværksvirksomhed digitaliserer leverandørbilag fra mobilfotos. OCR finder tekst og beløb, men et utydeligt komma gør en pris forkert. Integrationen sammenholder linjesummen med fakturatotalen og sender bilaget til kontrol i stedet for at bogføre. Medarbejderen får det originale udsnit ved siden af det foreslåede felt. Efter rettelse gemmes fejltypen som et testeksempel for nye bilagsformater.
Typiske faldgruber
- At behandle OCR-tekst som fejlfri originaltekst.
- At miste koblingen mellem et fund og dets placering på siden.
- At måle kun på tegnnøjagtighed og ikke på kritiske forretningsfelter.
Det skal I afklare
- Kontrollér billedkvalitet og eksisterende tekstlag.
- Bevar kildeposition og valider vigtige felter.
- Aftal manuel kontrol ved tvivl, sumfejl og ukendte formater.
Spørgsmål og svar
Kan OCR læse håndskrift?
Nogle modeller og tjenester kan, men kvaliteten afhænger af skrift, sprog og dokumenttype. Test med repræsentative eksempler og undgå generelle garantier.
Er OCR nok til at importere en tabel?
Nej. Tegnene skal også knyttes til de rigtige rækker, kolonner og enheder. Tabeludtræk og efterfølgende validering er særskilte trin.
Kilder og videre læsning
De tekniske begreber bygger på nedenstående kilder. Eksemplerne er illustrative og viser, hvordan I kan arbejde med emnet.
- Tesseract: User Manual ↗Primærkilde gennemgået 7. september 2026.
- Microsoft: Read model OCR data extraction ↗Primærkilde gennemgået 7. september 2026.

