Text aus PDF extrahieren
Ihre Datei bleibt auf Ihrem Gerät — es wird nichts hochgeladen.
So funktioniert es
„Text aus PDF extrahieren“ holt die Textebene aus einem Dokument und gibt sie als reinen Text zurück, den Sie in einen Editor, eine Übersetzung oder ein Skript einfügen können. Das Ergebnis ist unformatierter Text: Zeilenumbrüche werden daraus abgeleitet, wo die Wörter auf der Seite stehen, Spalten, Tabellen, Schriften und Formatierungen bleiben aber nicht erhalten. Kommt gar nichts heraus, hat das PDF überhaupt keine Textebene — es ist ein Scan oder eine Folge von Seitenbildern, und daraus Wörter zu machen, ist Sache der Texterkennung. Extrahiert wird vollständig in Ihrem Browser, weder das PDF noch der Text geht je an einen Server.
- Ziehen Sie ein PDF auf die Seite.
- Klicken Sie auf „Text extrahieren“ — die Seiten werden nacheinander gelesen, der Zähler zeigt, wie weit es ist.
- Lesen Sie die Vorschau. Bei langen Dokumenten ist sie am Bildschirm gekürzt, die heruntergeladene Datei enthält aber immer den vollständigen Text.
- Kopieren Sie den Text direkt in die Zwischenablage oder laden Sie eine gewöhnliche .txt-Datei in UTF-8 herunter, in der die Seiten durch eine Leerzeile getrennt sind.