PDF · lokal im Browser · ohne Upload

Text aus PDF extrahieren

Liest den Text aller Seiten in Lesereihenfolge, zeigt ihn Seite für Seite und speichert ihn als Textdatei. Die PDFs verlassen Ihr Gerät dabei nicht.

Bleibt auf Ihrem Gerät. aktenadler liest und schreibt die PDFs hier im Browser. Nichts wird hochgeladen.

Geöffnete Dateien

  • Noch keine Datei geöffnet.

Text extrahieren

Liest den Text aller Seiten der Übersicht in Lesereihenfolge. Gescannte Seiten ohne Textebene bleiben leer: eine Texterkennung hat aktenadler nicht.

Seiten

Noch keine Seiten. Öffnen Sie ein oder mehrere PDFs.

Pfeiltasten wählen eine Seite, die Leertaste markiert sie. Die Tastenkürzel stehen unter „Drehen und ordnen“.

Ergebnisse

Noch keine. Fertige Dateien erscheinen hier als Links zum Speichern.

    Text extrahieren in drei Schritten

    1. PDF öffnen

      Wählen Sie eine oder mehrere Dateien über „PDF öffnen“ aus. Seiten, die Sie nicht brauchen, löschen Sie vorher in der Übersicht.

    2. Text extrahieren

      Ein Klick auf „Text extrahieren“ liest alle Seiten der Übersicht. Der Text erscheint darunter, mit einer Überschrift je Seite.

    3. Als Textdatei speichern

      Unter „Ergebnisse“ liegt der gesamte Text als .txt-Datei in UTF-8, etwa vertrag-text.txt, bereit für jeden Editor.

    Wann kein Text herauskommt

    aktenadler liest den Text, der im PDF als Text gespeichert ist. Das gilt für fast alle PDFs, die aus Word, einem Buchhaltungsprogramm oder einem Browser erzeugt wurden.

    Enthält das PDF eine E-Rechnung im ZUGFeRD-Format, sind die Rechnungsdaten als XML eingebettet und damit genauer als der Text der Seite. Das ZUGFeRD-Werkzeug holt sie heraus, die E-Rechnungs-Ansicht zeigt sie lesbar an.

    Ohne Upload, und so prüfen Sie das selbst

    aktenadler liest und schreibt die PDFs mit JavaScript in diesem Browser-Tab. Beim Öffnen der Seite lädt Ihr Browser die Programmdateien von aktenadler.com und meldet einen Seitenaufruf an die eigene Statistik, ohne Dateinamen und ohne Inhalte. Ihre PDF selbst wird nie übertragen.

    Nachprüfen können Sie das in jedem Browser: Entwicklerwerkzeuge öffnen (F12), den Reiter „Netzwerk“ wählen, dann eine PDF öffnen und den Text extrahieren. In der Liste erscheint keine Anfrage mit Ihrer Datei. Die automatischen Tests von aktenadler prüfen das beim Zusammenfügen bei jeder Änderung am Code.

    Häufige Fragen

    Kann aktenadler gescannte PDFs lesen?

    Nein. Gescannte Seiten sind Bilder, und eine Texterkennung (OCR) hat aktenadler nicht. Solche Seiten bleiben im Ergebnis leer.

    Bleibt die Formatierung erhalten?

    Nein. Das Ergebnis ist reiner Text in Lesereihenfolge, ohne Schriftarten, Tabellen und Bilder. Für jede Seite gibt es eine Überschrift mit Datei und Seitennummer.

    In welcher Kodierung wird die Textdatei gespeichert?

    In UTF-8. Umlaute, ß und Sonderzeichen bleiben erhalten, jeder aktuelle Editor öffnet die Datei richtig.

    Kann ich den Text mehrerer PDFs auf einmal extrahieren?

    Ja. Öffnen Sie alle Dateien; aktenadler liest die Seiten in der Reihenfolge der Übersicht und schreibt sie in eine Textdatei.

    Passende Werkzeuge