PDF in Text
Den reinen Text aus jedem PDF holen.
So extrahierst du Text aus einem PDF
- Füge ein PDF hinzu; die Extraktion startet sofort und zeigt den Fortschritt pro Seite.
- Prüfe die Vorschau und lade dann den gesamten Text als .txt-Datei herunter.
- Seiten sind in der Ausgabe durch Leerzeilen getrennt, damit die Struktur erkennbar bleibt.
- Gescannte PDFs ohne Textebene liefern ein leeres Ergebnis; sie enthalten Bilder von Text, keinen Text.
Häufige Fragen
- Warum ist der extrahierte Text leer oder unleserlich?
- Leer heißt meist: ein gescanntes PDF, dessen Seiten Bilder sind; ohne OCR gibt es dort keinen Text. Unleserlicher Text deutet auf exotische Schriften oder Kodierungen im Quelldokument hin.
- Bleibt das Layout erhalten?
- Nein, die Ausgabe ist reiner Text: Spalten, Tabellen und Formatierung werden zu Zeilen. Für layouttreues Bearbeiten bräuchtest du das ursprüngliche Dokumentformat.
- Kann ich statt des Downloads nur einen Teil kopieren?
- Ja, markiere den gewünschten Abschnitt direkt im Vorschaufeld und kopiere ihn.
- Wird mein Dokument irgendwohin hochgeladen?
- Nein. Die Extraktion läuft vollständig in deinem Browser; die Datei verlässt dein Gerät nicht.