Waarom is de tekst in mijn document onjuist of onleesbaar?
Andri gebruikt OCR (optische tekenherkenning) om tekst uit je geüploade documenten te halen. Wanneer de OCR onjuiste gegevens of onleesbare tekst oplevert, komt dat meestal doordat de beeldkwaliteit van het bronbestand te laag is om tekst nauwkeurig te extraheren.
Voor het uploaden: open je document en controleer of je moet inzoomen om de tekst comfortabel te kunnen lezen. Als dat zo is, zal de OCR dezelfde moeite hebben.
Veelvoorkomende oorzaken
Scans met een lage resolutie: Bestanden die zijn gescand met minder dan 300 DPI leveren vaak wazige tekst op die door OCR verkeerd wordt geïnterpreteerd
Slechte beeldkwaliteit: Vervaagde tekst, schaduwen of scheefliggende pagina's maken tekenherkenning onbetrouwbaar
Kleine of gestileerde lettertypen: Sierlijke lettertypen of zeer kleine tekst kunnen geautomatiseerde teksextractie in de war brengen
Kopieën van kopieën: Fotokopieën van fotokopieën verminderen de teksthelderheid bij elke generatie
Stappen voor probleemoplossing
1. Controleer de helderheid van het document
Open je PDF- of afbeeldingsbestand met een zoomniveau van 100%. Als de tekst wazig lijkt of je moet inzoomen om deze te kunnen lezen, scan of exporteer het document dan opnieuw met een hogere resolutie (minimaal 300 DPI aanbevolen).
2. Upload een versie van hogere kwaliteit
Als je toegang hebt tot het oorspronkelijke document, maak dan een nieuwe scan of export met deze instellingen:
Scan met 300 DPI of hoger
Gebruik de zwart-wit- of grijswaardenmodus voor documenten die alleen tekst bevatten
Zorg ervoor dat de pagina vlak ligt en goed verlicht is (bij foto's/scans)
Sla het bestand indien mogelijk op als PDF in plaats van JPG om de tekstkwaliteit te behouden
Verwijder het bestand van lage kwaliteit uit je zaak en upload de verbeterde versie. Zie Bestanden uploaden naar je zaak voor instructies voor het uploaden.
3. Controleer op specifieke fouten
Controleer de geëxtraheerde tekst op patronen zoals:
Verkeerd gelezen letters (0 versus O, 1 versus l, 8 versus B)
Willekeurige speciale tekens op plaatsen waar die niet voorkomen
Volledig ontbrekende tekstgedeelten
Dit geeft aan dat de OCR moeite had met specifieke delen van je document. Een duidelijkere scan verhelpt deze problemen doorgaans.
Als de OCR belangrijke informatie, zoals namen of zaaknummers, consequent verkeerd leest, controleer dan nogmaals alle door AI gegenereerde samenvattingen of analyses waarin naar die gegevens wordt verwezen.