PDF in Text
Die Textebene einer PDF extrahieren, optional mit erhaltenem Layout.
Füge mindestens 1 Dateien hinzu.
Große Dokumente können bis zu einer Minute dauern. Du kannst diesen Tab im Hintergrund offen lassen.
Über PDF in Text
Hol den gesamten Text aus einer PDF für Suche, Zitate oder Weiterverarbeitung. Der Layout-Modus hält Spalten und Tabellen mit Leerzeichen ausgerichtet, der Lese-Modus liefert fließenden Text. Gescannte PDFs haben keine Textebene — nutze dafür OCR.
So funktioniert es
-
1
Lege eine PDF ab.
-
2
Wähle, ob das Layout erhalten bleiben soll.
-
3
Lade die .txt-Datei herunter.
Häufig gestellte Fragen
Warum ist das Ergebnis leer?
Die PDF ist wahrscheinlich ein Scan (ein Bild von Text). Nutze das OCR-Tool, um Text in gescannten Dokumenten zu erkennen.
Ist der Text UTF-8-kodiert?
Ja. Umlaute und andere Sonderzeichen bleiben erhalten, sofern die PDF korrekte Schriftzuordnungen enthält.