PDF naar tekst omzetten
PDF naar tekst omzetten met één klik: sleep de PDF erin, klik op ‘Tekst ophalen’, klaar. Afgebroken regels worden weer nette alinea’s, en tekstherkenning (OCR) leest gescande pagina’s. Alles gebeurt in je browser – het bestand wordt niet geüpload.
Bron: Adobe – ISO 32000-1:2008 Document management – Portable document format (PDF 1.7). Bijgewerkt: .
Zo wordt het berekend
Tekst uit een PDF kopiëren levert vaak een rommeltje op: harde regeleinden midden in een zin, afgebroken woorden (‘docu-ment’), door elkaar gelopen kolommen. Deze tool leest de tekstlaag van de PDF met pdf.js, groepeert de tekststukjes op hun plek op de pagina tot regels en voegt die samen tot alinea’s. Het resultaat kun je meteen bewerken, kopiëren of opslaan als TXT-bestand (UTF-8).
Zo werkt het
- Sleep een PDF erin of kies er een.
- Kies de tekstvorm: ‘Alinea’s’ geeft lopende tekst om verder te bewerken, ‘Regels zoals in de PDF’ houdt elk regeleinde – handig voor adressen, gedichten of lijsten.
- Vink eventueel ‘Paginawissels markeren’ aan; dan staat ‘--- Pagina 3 ---’ voor elke pagina.
- Klik op ‘Tekst ophalen’, controleer, kopieer of sla op. De opties kun je daarna wijzigen zonder de PDF opnieuw te lezen.
Gescande pdf’s: tekstherkenning (OCR)
Een scan is een afbeelding zonder tekstlaag. Heeft een pagina minder dan 20 tekens, dan tekent de tool haar op ongeveer 300 dpi en laat Tesseract haar lezen – dezelfde vrije OCR-engine als in Tekst uit afbeelding. Kies de taal van het document. Het duurt een paar seconden per pagina; bij scherpe scans is het heel nauwkeurig, bij handschrift of slechte kopieën niet.
Eerlijke grenzen
- Tabellen en layouts met kolommen worden regel voor regel gelezen; kolommen kunnen door elkaar lopen. Voor een bewerkbaar document met koppen: PDF naar DOCX.
- Sommige pdf’s gebruiken lettertypen zonder tekentabel; dan krijg je vakjes of wartaal. Vink in dat geval ‘Alle pagina’s met OCR lezen’ aan.
- Een beveiligde PDF open je met het wachtwoord; de tool omzeilt geen kopieerbeveiliging.
Privacy
De PDF blijft op je apparaat. Alleen de PDF-engine en zo nodig de tekstherkenning worden van deze site geladen – geen dienst van derden ziet je document. Voor gestructureerde tekst (notities, AI) is er PDF naar Markdown.
Veelgestelde vragen
Hoe zet ik een PDF gratis om naar tekst?
Sleep de PDF hierheen en klik op ‘Tekst ophalen’. Kopieer de tekst met één klik of sla hem op als TXT. Zonder account en zonder upload.
Hoe zet ik een gescande PDF om naar tekst?
Laat ‘Gescande pagina’s lezen met tekstherkenning (OCR)’ aan en kies de taal van het document. Pagina’s zonder tekstlaag worden dan automatisch gelezen.
Waarom heeft gekopieerde PDF-tekst zoveel regeleinden?
Een PDF slaat tekst per regel op. Met ‘Alinea’s’ voegt de tool bij elkaar horende regels samen en haalt afbrekingen aan het regeleinde weg.
Kan ik de tekst in Word plakken?
Ja: klik op ‘Kopiëren’ en plak. Wil je koppen en alinea’s in een Word-bestand houden, gebruik dan ‘PDF naar DOCX’.
Wordt mijn PDF geüpload?
Nee. Lezen en tekstherkenning gebeuren helemaal in je browser.
Waarom zie ik alleen vakjes of rare tekens?
De PDF gebruikt lettertypen die niet aan echte letters gekoppeld zijn. Vink ‘Alle pagina’s met OCR lezen’ aan en haal de tekst opnieuw op: de OCR leest dan wat er gedrukt staat.
Bronnen en wettelijke basis
- Adobe – ISO 32000-1:2008 Document management – Portable document format (PDF 1.7)
- pdf.js – getTextContent / getAnnotations (Mozilla, Apache-2.0)
- pdf.js 6.3.289 licence (Apache-2.0)
- Tesseract.js – OCR library for the browser (GitHub, Apache-2.0)
- Tesseract OCR documentation – Improving the quality of the output
- Unicode Standard – UTF-8 encoding form (TXT export)
- Open-source licenses of the libraries used (MIT, LGPL-3.0)
Bijgewerkt op:
Vergelijkbare tools
- PDF naar Markdown omzettenPDF naar Markdown: koppen, alinea’s, lijsten en links als .md voor Obsidian, GitHub, notities of AI-chats. Met OCR voor scans, gratis en zonder upload.
- PDF naar DOCX omzettenZet een PDF om in een bewerkbaar DOCX-bestand voor Word of LibreOffice, direct in je browser, gescande pagina’s met OCR. Zonder upload en zonder account.
- Tekst uit een afbeelding halen met OCRTekst uit afbeelding halen: kopieer tekst uit foto’s, scans en screenshots. OCR voor Nederlands, Engels, Duits, Frans en meer – gratis in je browser.
- PDF naar JPG omzettenZet een PDF om naar JPG of PNG: elke pagina als eigen afbeelding, 72 tot 300 dpi, los of als ZIP. Gratis, direct in de browser – niets wordt geüpload.
- Tekst opschonen onlineVerwijder regeleinden, dubbele spaties, lege regels en onzichtbare tekens, verwijder dubbele regels en sorteer lijsten. Gratis en direct in de browser.
- Achtergrond verwijderen van een afbeeldingVerwijder automatisch de achtergrond van een foto: de AI draait in je browser, volledige resolutie, transparante PNG of effen kleur. Zonder upload, gratis.