PDF in Text

Laden Sie ein PDF hoch und erhalten Sie eine reine .txt-Datei mit dem Text, der bereits darin steckt. Kostenlos, ohne Konto, ohne Wasserzeichen.

Kostenlos – Ohne Anmeldung – Vollständiges Ergebnis

Kostenlos, vollständiges Ergebnis

Kein Wasserzeichen, keine Seitenbegrenzung, keine Tageslimits und kein Konto. Sie laden das vollständige Ergebnis herunter.

Vertraulich von Grund auf

Dateien werden über HTTPS übertragen und direkt nach der Verarbeitung vom Server gelöscht. Wir behalten keine Kopie Ihrer Dokumente.

Verarbeitet PDF

Laden Sie direkt von Ihrem Gerät hoch – das Ergebnis steht in Sekunden zum Download bereit.

Nichts zu installieren

Läuft in jedem modernen Browser, am Rechner wie am Handy. Übliche Dateien sind in Sekunden fertig.

So funktioniert es

1

PDF hochladen

Legen Sie ein PDF in den Upload-Bereich. Dateien bis 100 MB werden angenommen.

2

Die Textebene wird gelesen

Der in der Datei gespeicherte Text wird auf unserem Server mit pdf.js Seite für Seite ausgelesen, genau so, wie er gespeichert wurde.

3

.txt-Datei herunterladen

Sie erhalten eine UTF-8-Textdatei, benannt nach Ihrem PDF, bereit zum Einfügen, Durchsuchen oder Weiterverarbeiten.

Der Text, der ohnehin schon in der Datei steht

Die meisten PDFs führen ihre Wörter als echten Text mit sich und nicht als Bild. Eine Datei, die aus Word, Google Docs, einem Buchhaltungssystem oder einer Website exportiert wurde, enthält eine Textebene, komplett mit Zeichen, Abständen und Zeilenumbrüchen. Dieses Tool liest diese Ebene mit pdf.js auf unserem eigenen Server aus und schreibt sie als reine .txt-Datei in UTF-8 heraus.

Weil nichts erkannt, umgeschrieben oder erraten wird, ist das Ergebnis exakt: Die Wörter, die Sie bekommen, sind die Wörter, die das Dokument speichert. Die Extraktion ist selbst bei einigen hundert Seiten in Sekunden fertig, und die heruntergeladene Datei trägt den Namen der hochgeladenen, aus vertrag.pdf wird also vertrag.txt.

Wenn ein PDF keinen Text zum Auslesen hat

Es gibt eine ehrliche Grenze. Ist das PDF ein Scan oder ein Foto einer Seite, enthält es ein Bild und sonst nichts. Es gibt keine Textebene zum Auslesen, dieses Tool kann also nichts extrahieren und sagt das klar, statt Ihnen eine leere Datei in die Hand zu drücken.

Dieses Verhalten ist Absicht. Wörter in einem Bild zu erkennen ist OCR, und OCR kostet für jede verarbeitete Seite echtes Geld. Ein kostenloses Tool sollte das niemals still in Ihrem Namen ausgeben, deshalb halten wir an und verweisen Sie stattdessen an die richtige Stelle. Mit OCR PDF legen Sie eine durchsuchbare Textebene auf den Scan und kommen dann hierher zurück, oder Sie nehmen PDF in Word, das Scans als Teil der Umwandlung liest.

Wofür der reine Text gut ist

  • Ein Dokument zitieren. Eine saubere Abschrift eines Berichts, den Sie belegen müssen.
  • Ein anderes Tool füttern. Reinen Text wollen Suchindizes, Skripte und Tabellenkalkulationen.
  • Suchen und vergleichen. Zwei .txt-Dateien lassen sich in jedem Editor Zeile für Zeile vergleichen.
  • Gesperrte Inhalte kopieren. Manche Anzeigeprogramme unterbinden das Markieren; die Textebene ist trotzdem da.

Sie brauchen nur einen Teil des Dokuments? Teilen Sie das PDF zuerst und extrahieren Sie den Text aus dem Abschnitt, auf den es ankommt. Wenn Sie ein Dokument gegen eine frühere Fassung prüfen, macht PDF vergleichen das nebeneinander.

Häufige Fragen

Ist das wirklich kostenlos?

+

Ja. Die Extraktion liest Text, der ohnehin in der Datei steht, im Betrieb kostet sie uns also fast nichts. Kein Konto, kein Wasserzeichen, kein Tageslimit, keine gekürzte Ausgabe.

Was passiert bei einem gescannten PDF?

+

Ein Scan ist ein Bild einer Seite und kein Text, es gibt also nichts zu extrahieren, und das Tool sagt Ihnen das, statt eine leere oder erfundene Datei auszugeben. Lassen Sie den Scan zuerst durch OCR PDF laufen, oder nehmen Sie PDF in Word, das Scans als Teil der Umwandlung liest.

Wie sieht die Ausgabedatei aus?

+

Eine einzige reine Textdatei in UTF-8, benannt nach Ihrem PDF, aus bericht.pdf wird also bericht.txt. Der Text folgt der Seitenreihenfolge des Dokuments und behält seine Zeilenumbrüche.

Warum ist die Reihenfolge des Textes manchmal seltsam?

+

Die Reihenfolge kommt aus dem PDF selbst. Zeitungsartige Spalten, Randspalten und Tabellen sind als getrennte Textblöcke gespeichert und können deshalb ineinander verschachtelt ankommen. Normale Berichte, Briefe und Verträge kommen sauber heraus.

Gibt es eine Größenbeschränkung?

+

Ein PDF auf einmal, bis zu 100 MB. Die Seitenzahl ist nicht begrenzt; ein langes Dokument braucht nur länger zum Hochladen, nicht zum Extrahieren.

Ähnliche Tools

Einfache Preise: kostenlose Tools, ein Abo für KI

Die Datei-Tools sind ohne Limit kostenlos. KI-Funktionen laufen über ein Credit-Abo: Jedes neue Konto startet mit 250 Gratis-Credits, und Credits auf Ihrem Guthaben verfallen nie.

Alle Preise ansehen iOS-App bald im App Store

Wir nutzen notwendigen Browser-Speicher, um Sie angemeldet zu halten und unsere Tools zu betreiben, dazu anonyme Nutzungsstatistiken, die keine Cookies setzen. Keine Werbung, kein seitenübergreifendes Tracking.