Tekst uit een afbeelding halen

Sleep een foto, scan of screenshot hierheen, kies de taal en klik op ‘Tekst herkennen’ – daarna kopieer je de tekst of sla je hem op als .txt-bestand. De herkenning draait volledig in je browser; je afbeelding wordt nooit geüpload.

Sleep je bestanden hierheen of

JPG, PNG, WebP, HEIC, GIF, BMP of TIFF – één afbeelding, tot 50 MB

Tip: je kunt afbeeldingen ook plakken met Ctrl + V.

Je bestanden worden alleen in je browser verwerkt en niet naar een server geüpload: ze verlaten je apparaat niet.

Beste resultaat: gedrukte tekst, recht van boven gefotografeerd, scherp, donkere letters op een lichte achtergrond, ongeveer 300 dpi. Handschrift wordt nauwelijks herkend.

Herkende tekst

Kies een afbeelding, controleer de taal en klik op ‘Tekst herkennen’.

Resultaat

Zo wordt het berekend

Optische tekenherkenning (OCR, Optical Character Recognition) maakt van de pixels in een afbeelding weer letters: een foto van een brief, een gescande factuur of een screenshot van een document wordt tekst die je kunt kopiëren, doorzoeken en bewerken. Om tekst uit een afbeelding te halen gebruikt deze tool Tesseract, de bekendste opensource-OCR-engine, omgezet naar WebAssembly en direct in je browser actief.

Zo werkt het

  1. Sleep een afbeelding hierheen, kies er een of plak hem met Ctrl + V (bijvoorbeeld een screenshot van het klembord).
  2. Controleer de taal van de tekst in de afbeelding. Nederlands staat standaard ingesteld; je kunt ook Engels, Duits, Frans, Spaans, Portugees en Italiaans kiezen.
  3. Klik op ‘Tekst herkennen’. De voortgangsbalk laat zien of er nog gegevens laden of dat de tekst al wordt herkend.
  4. Verbeter de tekst in het vak als dat nodig is en kopieer hem of sla hem op als .txt-bestand.

Tips voor een goede herkenning

Beperkingen

Tesseract is gemaakt voor gedrukte tekst. Handschrift wordt nauwelijks herkend, net als sterk decoratieve lettertypes, schuin gefotografeerde borden of tekst op een drukke achtergrond. Tabellen en opmaak met meerdere kolommen komen eruit als doorlopende tekst, waarbij de volgorde van de kolommen kan verschuiven. De getoonde betrouwbaarheid is het gemiddelde dat Tesseract over alle woorden berekent; onder ongeveer 70 % loont een betere afbeelding. Controleer belangrijke getallen (bedragen, IBAN, factuurnummers) altijd zelf: verwisselingen als 0/O, 1/l of 5/S komen ook bij goede originelen voor.

De eerste keer worden gegevens gedownload

Om zonder server te werken, downloadt je browser bij de eerste klik op ‘Tekst herkennen’ de herkenningsengine (ongeveer 3,7 MB, zo’n 1,5 MB gecomprimeerd tijdens de overdracht) en de gegevens van de gekozen taal: Nederlands 2,9 MB, Engels 2,8 MB, Duits 1,3 MB, Frans 0,7 MB, Spaans 2,0 MB, Portugees 1,3 MB, Italiaans 1,6 MB. Alle bestanden komen van deze website; er wordt geen extern contentnetwerk benaderd. De browser bewaart de taalgegevens lokaal (IndexedDB), waardoor de volgende keer veel sneller start. Het herkennen van een pagina duurt een paar seconden, afhankelijk van je apparaat en de grootte van de afbeelding.

Privacy

Je afbeelding verlaat nooit je apparaat. De herkenning draait volledig in je browser (in een web worker) en ook de herkende tekst wordt nergens heen gestuurd. Sluit je het tabblad, dan blijft er niets over – alleen de gedownloade taalgegevens blijven in de browseropslag staan tot je die wist.

Tip: snijd onscherpe randen eerst weg met afbeelding bijsnijden, dat verbetert de herkenning.

Veelgestelde vragen

Wordt mijn afbeelding geüpload?

Nee. De tekstherkenning draait volledig in je browser. Alleen de herkenningsengine en de taalgegevens worden gedownload – van deze website, niet van een derde partij. Je afbeelding en de tekst blijven op je apparaat.

Welke talen worden herkend?

Nederlands, Engels, Duits, Frans, Spaans, Portugees en Italiaans. De taal van deze pagina staat standaard ingesteld. Kies de taal van de tekst in de afbeelding, anders ontbreken speciale tekens als ë, é of ß en wordt de woordherkenning minder nauwkeurig.

Kan de tool handschrift lezen?

Nauwelijks. Tesseract is getraind op gedrukte tekst. Heel nette blokletters lukken soms, gewoon lopend handschrift vrijwel nooit.

Waarom staan er fouten in de tekst?

Meestal ligt het aan de afbeelding: te klein, onscherp, scheef, te weinig contrast of een drukke achtergrond. Fotografeer het papier recht van boven bij goed licht, snijd bij tot de tekst en controleer de gekozen taal. Ongeveer 300 dpi is een goede richtlijn.

Waarom duurt de eerste keer langer?

De eerste keer downloadt je browser de herkenningsengine (ongeveer 1,5 MB gecomprimeerd) en de taalgegevens (Nederlands 2,9 MB). Die blijven daarna in de browser bewaard, dus volgende afbeeldingen gaan sneller.

Kan ik tekst uit een screenshot kopiëren?

Ja. Maak een screenshot (Windows: Win + Shift + S, Mac: Cmd + Shift + 4), plak hem hier met Ctrl + V en klik op ‘Tekst herkennen’. Screenshots zijn meestal ideaal: scherp, recht en met veel contrast.

Werkt het ook met pdf-bestanden?

Niet direct – de tool leest afbeeldingen. Maak bij een gescande pdf een screenshot van de pagina of exporteer hem als afbeelding en plak die hier. Bevat de pdf al tekst, dan kun je die gewoon selecteren en kopiëren in je pdf-lezer.

Hoe nauwkeurig is de herkenning?

Bij nette scans en screenshots van gedrukte tekst heel hoog, vaak foutloos. De betrouwbaarheid onder het resultaat helpt je dat in te schatten: onder ongeveer 70 % loont een betere afbeelding. Controleer getallen zoals bedragen of IBAN altijd.

Bronnen en wettelijke basis

Bijgewerkt op:

Vergelijkbare tools