PDF in Text umwandeln

PDF in Text umwandeln mit einem Klick: PDF hineinziehen, „Text extrahieren“ klicken, fertig. Umbrochene Zeilen werden zu sauberen Absätzen, eingescannte Seiten liest die Texterkennung (OCR). Alles läuft in Ihrem Browser – die Datei wird nicht hochgeladen.

Quelle: Adobe – ISO 32000-1:2008 Document management – Portable document format (PDF 1.7). Stand: .

Dateien hierher ziehen oder

Eine PDF-Datei, bis 200 MB

Ihre Dateien werden nur in Ihrem Browser verarbeitet und nicht hochgeladen – sie verlassen Ihr Gerät nicht.

Extrahierter Text

Wählen Sie eine PDF-Datei und klicken Sie auf „Text extrahieren“.

Meine Toolbox

Ergebnis

So wird gerechnet

Aus einer PDF Text herauszukopieren, endet oft im Chaos: harte Zeilenumbrüche mitten im Satz, getrennte Wörter („Zei-len“), vertauschte Spalten. Dieses Werkzeug liest die Textebene der PDF mit pdf.js, ordnet die Textstücke nach ihrer Lage auf der Seite zu Zeilen und fügt sie zu Absätzen zusammen. Das Ergebnis können Sie direkt bearbeiten, kopieren oder als TXT-Datei (UTF-8) speichern.

So funktioniert's

  1. PDF hineinziehen oder auswählen.
  2. Textform wählen: „Absätze“ ergibt Fließtext zum Weiterschreiben, „Zeilen wie im PDF“ behält jeden Umbruch – gut für Adressen, Gedichte oder Listen.
  3. Optional „Seitenwechsel markieren“: Dann steht vor jeder Seite „--- Seite 3 ---“.
  4. „Text extrahieren“ klicken, Ergebnis prüfen, kopieren oder speichern. Die Optionen lassen sich danach umstellen, ohne die PDF neu zu lesen.

Eingescannte PDFs: Texterkennung (OCR)

Ein Scan ist ein Bild ohne Textebene. Findet das Werkzeug auf einer Seite weniger als 20 Zeichen, zeichnet es die Seite mit etwa 300 dpi und lässt sie von Tesseract lesen – derselben freien OCR-Engine, die auch Text aus Bild erkennen nutzt. Wählen Sie dafür die Sprache des Dokuments. Die Erkennung braucht je Seite einige Sekunden; bei sauberen Scans ist sie sehr genau, bei Handschrift oder schlechten Kopien nicht.

Ehrliche Grenzen

Datenschutz

Die PDF bleibt auf Ihrem Gerät. Geladen werden nur die PDF-Engine und bei Bedarf die Texterkennung von diesem Server – kein Dienst eines Dritten sieht Ihr Dokument. Strukturierten Text für Notizen oder KI-Chats liefert PDF in Markdown.

Häufige Fragen

Wie kann ich eine PDF kostenlos in Text umwandeln?

PDF hier hineinziehen und „Text extrahieren“ klicken. Den Text kopieren Sie mit einem Klick oder speichern ihn als TXT-Datei. Ohne Anmeldung und ohne Upload.

Wie wandle ich eine eingescannte PDF in Text um?

Lassen Sie „Gescannte Seiten per Texterkennung (OCR) lesen“ eingeschaltet und wählen Sie die Sprache des Dokuments. Seiten ohne Textebene werden dann automatisch per OCR gelesen.

Warum hat der kopierte PDF-Text so viele Zeilenumbrüche?

PDFs speichern Text zeilenweise, nicht als Absatz. Mit der Textform „Absätze“ fügt das Werkzeug zusammengehörige Zeilen wieder zusammen und löst Silbentrennungen am Zeilenende auf.

Kann ich den PDF-Text in Word einfügen?

Ja: „Kopieren“ klicken und in Word einfügen. Sollen Überschriften und Absätze als Word-Datei erhalten bleiben, nehmen Sie „PDF in DOCX“.

Wird meine PDF hochgeladen?

Nein. Lesen und Texterkennung laufen vollständig in Ihrem Browser.

Warum erscheinen nur Kästchen oder seltsame Zeichen?

Die PDF nutzt Schriften ohne Zuordnung zu echten Buchstaben. Haken Sie „Alle Seiten per OCR lesen“ an und extrahieren Sie erneut – die Texterkennung liest dann das Schriftbild statt der kaputten Textebene.

Quellen und Rechtsgrundlagen

Stand:

Passende Werkzeuge