Zum Hauptinhalt springen
PicsSizer.com Logo

PDF in Text umwandeln

Sauberen, bearbeitbaren Text aus Ihren PDFs erhalten, auch aus gescannten Seiten. Kopieren oder als .txt-Datei speichern.

Liest gescannte Seiten (OCR)18 OCR-SprachenSaubere AbsätzeBis zu 20 PDFs gleichzeitigKopieren oder als .txt speichern
Ihr PDF bleibt auf Ihrem GerätKostenlos, ohne AnmeldungKein Tages- oder Seitenlimit

Warum kann ich aus manchen PDFs keinen Text kopieren?

Manche PDFs enthalten ein Bild des Textes anstelle des Textes selbst. Eine gescannte Seite ist nur ein Bild, es gibt also nichts zum Markieren oder Kopieren. Dieser Konverter liest echten Text direkt aus dem PDF ohne OCR – das ist schnell und exakt. OCR kommt nur bei den Seiten zum Einsatz, die als Bild vorliegen.

Wofür Menschen PDF-zu-Text nutzen

Beruf

  • Klauseln aus einem Vertrag oder gescannten Brief kopieren
  • Text aus einem als PDF gespeicherten Bericht oder einer Präsentation weiterverwenden
  • Angaben aus einer Rechnung oder einem Kontoauszug übernehmen
  • Text zum Bearbeiten in eine Dokumenten- oder Tabellenkalkulations-App einfügen

Schule und Forschung

  • Ein Forschungspapier zitieren, ohne es abzutippen
  • Gescannte Buchseiten in durchsuchbare Notizen verwandeln
  • Text aus Vorlesungsfolien und Handouts extrahieren
  • Zitate aus mehreren PDFs auf einmal sammeln

Alltag

  • Ein PDF in KI-Chat-Tools einfügen, um es zusammenzufassen oder Fragen dazu zu stellen
  • Text aus einem PDF kopieren, das die Markierung nicht zulässt
  • Text in einen Übersetzer einfügen
  • Eine Anleitung, ein Formular oder ein Rezept als reine Textdatei speichern

So wandeln Sie ein PDF in Text um

  1. 1

    PDFs hinzufügen

    Ziehen Sie Ihre PDFs in das Feld oben auf dieser Seite, oder klicken Sie, um sie auszuwählen. Sie können bis zu 20 auf einmal hinzufügen.

  2. 2

    Seiten werden gelesen

    Seiten mit echtem Text werden sofort gelesen. Gescannte Seiten werden automatisch erkannt und mit OCR in der gewählten Sprache gelesen. Ein Moduswechsel ist nicht nötig.

  3. 3

    Kopieren oder herunterladen

    Bearbeiten Sie den Text bei Bedarf, dann kopieren oder speichern Sie ihn als .txt-Datei. Bei mehreren PDFs können Sie alles als eine .txt-Datei oder als ZIP herunterladen.

Gescannte PDFs mit OCR in Text umwandeln

Ein gescanntes PDF ist ein Bild jeder Seite, daher muss der Text mit OCR (optischer Zeichenerkennung) gelesen werden. Dieser Konverter prüft jede Seite einzeln und liest die gescannten Seiten automatisch mit OCR.

  • Jede Seite wird als Text, OCR oder leer markiert, sodass Sie sehen, welche Seiten gescannt wurden.
  • Seiten, deren Text als Kästchen oder seltsame Symbole kopiert wird, gelten ebenfalls als Scans und werden mit OCR gelesen.
  • Gescannte Seiten werden in der von Ihnen gewählten Sprache gelesen. Wählen Sie aus 18 Sprachen, bis zu 3 gleichzeitig.
  • Wirkt der Text einer Seite fehlerhaft, klicken Sie auf die Seitenzahl und wählen Sie „Mit OCR lesen", um sie erneut als Scan zu lesen.

Auch gemischte PDFs funktionieren. Getippte und gescannte Seiten werden gemeinsam als ein Text in der richtigen Seitenreihenfolge zusammengeführt.

Haben Sie ein Foto oder einen Screenshot statt eines PDFs? Holen Sie sich den Text mit dem Bild-zu-Text-Konverter.

Text aus einem PDF ohne Zeilenumbrüche kopieren

Aus einem PDF kopierter Text bricht meist am Ende jeder Zeile um. „Zeilen zu Absätzen zusammenführen" fügt umgebrochene Sätze wieder zusammen, sodass der Text sauber in ein Dokument, eine E-Mail oder KI-Chat-Tools eingefügt werden kann. Diese Option ist standardmäßig aktiv.

Die Bereinigung behebt auch andere Ursachen für unsauberen PDF-Text:

  • Wörter, die mit einem Bindestrich am Zeilenende getrennt sind, werden wieder zu einem Wort zusammengefügt.
  • Überschriften, Listeneinträge und Tabellenzeilen bleiben in eigenen Zeilen.
  • „Kopf-, Fußzeilen und Seitenzahlen entfernen" lässt wiederkehrende Kopf- und Fußzeilen sowie Seitenzahlen weg, die sich über die Seiten hinweg wiederholen. Diese Option ist standardmäßig aktiv.
  • Seitenmarkierungen wie --- Seite 3 --- zeigen an, wo jede Seite beginnt. Deaktivieren Sie sie für einen zusammenhängenden Textblock.

Jede Option aktualisiert den Text sofort, ohne dass das PDF erneut gelesen werden muss. Deaktivieren Sie „Zeilen zu Absätzen zusammenführen", um jeden Zeilenumbruch wie im PDF zu erhalten.

Kostenlos, privat und unbegrenzt

Dieser PDF-zu-Text-Konverter ist kostenlos, ohne Anmeldung und ohne Konto. Zusätzlich erhalten Sie:

  • Privatsphäre. Ihr PDF bleibt auf Ihrem Gerät. Es wird direkt auf Ihrem Smartphone oder Computer geöffnet und gelesen, die Datei wird nie an einen Server gesendet.
  • Kein Seiten- und kein Tageslimit. Jedes PDF kann bis zu 100 MB groß sein, und Sie können bis zu 20 auf einmal hinzufügen.
  • Geschützte Dateien werden sorgfältig behandelt. Ein passwortgeschütztes PDF wird mit Ihrem Passwort auf Ihrem Gerät geöffnet, das Passwort wird nicht gespeichert.

Beim ersten Lesen einer gescannten Seite lädt die OCR-Engine einmalig herunter (etwa 4 MB bei Englisch). Sie wird in Ihrem Browser gespeichert, sodass spätere Scans schneller starten. PDFs mit ausschließlich echtem Text benötigen sie nicht.

Wie extrahiert man am besten Text aus einem PDF?

Lesen Sie den Text, den das PDF bereits enthält, und setzen Sie OCR nur bei gescannten Seiten in der richtigen Sprache ein. So bleiben getippte Seiten exakt und gescannte Seiten so genau wie möglich. Dieses Tool trifft diese Entscheidung für Sie, Seite für Seite.

Diese Tipps sorgen für saubereren Text:

  • Wählen Sie die richtige OCR-Sprache. Deutscher Text, der als Englisch gelesen wird, verliert zum Beispiel seine Umlaute.
  • Wählen Sie bis zu 3 Sprachen für Scans mit gemischten Sprachen.
  • Verwenden Sie einen klaren, geraden Scan. Blasse oder schiefe Seiten führen zu mehr Fehlern.
  • Kommt eine Seite fehlerhaft heraus, klicken Sie auf die Seitenzahl und wählen Sie „Mit OCR lesen".
  • Prüfen Sie Namen, Zahlen und E-Mail-Adressen auf gescannten Seiten. Sie werden am leichtesten falsch erkannt.

Wie lange dauert OCR bei einem PDF? Seiten mit echtem Text werden fast sofort gelesen, selbst bei langen PDFs. Jede gescannte Seite braucht wenige Sekunden, und Sie können den Fortschritt jederzeit verfolgen oder abbrechen.

OCR ist für gedruckten Text gemacht. Handschrift und schlechte Scans führen oft zu Fehlern. Komplexe Layouts wie Zeitschriften und Formulare können auch in falscher Reihenfolge herauskommen, lesen Sie den Text also vor der Nutzung durch.

Häufig gestellte Fragen

Gescannte Seiten, Sprachen, Limits und Datenschutz

Haben Sie noch Fragen? Kontaktieren Sie unser Support-Team.