PDF-Text extrahieren (PDF → TXT)

Laden Sie eine PDF hoch – das Tool extrahiert den enthaltenen Text Seite für Seite und zeigt ihn an. Sie können das Ergebnis direkt kopieren oder als TXT-Datei speichern.

📄 PDF-Datei hierher ziehen oder zum Auswählen klicken Der Text wird sofort nach der Auswahl extrahiert

Anleitung: PDF-Text extrahieren

  1. Wählen Sie die PDF-Datei aus, aus der Sie den Text holen möchten. Die Extraktion beginnt sofort, Seite für Seite.
  2. Wenn Sie keine Trennlinien wie „----- 1. Seite -----“ zwischen den Seiten brauchen, entfernen Sie das Häkchen. Die Änderung wird sofort im Ergebnis übernommen.
  3. Markieren Sie im Ergebnisfeld den gewünschten Abschnitt und kopieren Sie ihn, oder klicken Sie auf Alles kopieren.
  4. Mit Als TXT speichern erhalten Sie eine UTF-8-Textdatei, die sich zum Beispiel im Editor von Windows oder in TextEdit öffnen lässt.

Warum sich Text aus PDFs oft schlecht kopieren lässt

Wer im PDF-Viewer Text markiert und kopiert, erlebt häufig Überraschungen: Zeilenumbrüche landen an falschen Stellen, bei zweispaltigen Dokumenten vermischen sich die Sätze der linken und rechten Spalte, oder zwischen den Buchstaben tauchen seltsame Leerzeichen auf. Der Grund: Eine PDF speichert nur, welches Zeichen an welcher Position gezeichnet wird. Sätze und Absätze als Struktur kennt das Format nicht.

Dieses Tool liest die Koordinaten der in der PDF gespeicherten Textstücke, fasst Stücke auf gleicher Höhe zu einer Zeile zusammen und fügt bei größerem Zeilenabstand eine Leerzeile ein, weil dort vermutlich ein neuer Absatz beginnt. So erhalten Sie meist einen besser lesbaren Text als beim Kopieren aus dem Viewer.

Gescannte PDFs: Wenn kein Text gefunden wird

PDFs, die mit einem Scanner oder der Handykamera erstellt wurden, bestehen pro Seite aus einem einzigen Bild. Für das Auge sieht es wie Text aus, die Datei enthält aber keine Zeicheninformationen – das Ergebnis bleibt deshalb leer. In diesem Fall brauchen Sie ein Programm mit Texterkennung (OCR, optische Zeichenerkennung). Dieses Tool unterstützt keine OCR.

Ob ein Dokument ein Scan ist, prüfen Sie so: Versuchen Sie im PDF-Viewer, Text mit der Maus zu markieren. Lässt sich nicht einzelner Text auswählen, sondern nur die ganze Seite als Fläche, handelt es sich um eine Bild-PDF.

Tipps für die Weiterverwendung des Textes

  • Für Zitate aus Berichten, Hausarbeiten oder wissenschaftlichen Artikeln können Sie Passagen direkt einfügen, statt sie abzutippen.
  • Stehen im Ergebnis Zeilenumbrüche mitten im Satz, fassen Sie den Text mit dem Tool Zeilenumbrüche entfernen zu einem Absatz zusammen.
  • Müssen Sie den Umfang prüfen, etwa für eine Zeichenvorgabe, fügen Sie das Ergebnis in den Zeichenzähler ein und sehen Zeichen- und Byteanzahl.
  • Tabellen werden ohne Spaltentrennung als fortlaufender Text ausgegeben. Ist die Tabellenstruktur wichtig, besorgen Sie sich besser die Originaldatei (z. B. Excel oder Word).

Häufig gestellte Fragen

Das Ergebnis der Textextraktion ist leer. Was nun?
Gescannte oder aus Fotos erstellte PDFs enthalten keine Zeicheninformationen und können nicht ausgelesen werden. Verwenden Sie in diesem Fall ein Programm mit OCR-Funktion.
Umlaute oder Sonderzeichen werden falsch angezeigt. Woran liegt das?
Manche PDFs speichern Schriftinformationen auf ungewöhnliche Weise, sodass die Zeichencodes nicht den tatsächlichen Buchstaben entsprechen. Bei solchen Dokumenten liefert kaum ein Extraktionstool den korrekten Text.
Funktioniert das auch mit passwortgeschützten PDFs?
PDFs mit Öffnungspasswort können nicht gelesen werden. Erstellen Sie zuerst eine Kopie ohne Passwort und verwenden Sie diese.
Werden meine Dateien oder der extrahierte Text auf einem Server gespeichert?
Nein. Die Analyse der PDF und die Textextraktion laufen vollständig in Ihrem Browser. Weder die Datei noch das Ergebnis werden irgendwohin übertragen.
Ist das Tool kostenlos?
Ja, die Nutzung ist kostenlos und ohne Anmeldung möglich.

Zuletzt aktualisiert: 2026-10-06