Ein realistisches Ausgangsdokument, gefolgt vom tatsächlichen Dokumentzustand oder der Ausgabedatei nach „PDF zu Text“.
Nachher
Vorher
PDF in Text (OCR)

PDF-zu-Text-Konverter – Extrahieren Sie Text kostenlos online aus PDF

Das PDF ist ein Scan, also wird nichts ausgewählt, nichts kopiert und die Suche findet nichts. Extrahieren Sie den Text trotzdem daraus – inklusive Nur-Bild-PDFs, mehr als 30 Sprachen.

  • Holen Sie sich Text aus einer gescannten PDF-Datei, während Auswählen und Kopieren nichts bewirken
  • Liest Nur-Bild-PDFs und Dokumentfoto-PDFs in über 30 Sprachen
  • Als TXT, Markdown, Word, Excel oder CSV herunterladen

PDF

PDF hochladen

Beliebiges PDF ablegen – Text kopieren oder als .txt herunterladen

PDF · free up to 11MB, Premium up to 50MB

Das können Sie mit PDF zu Text machen

Überprüfen Sie die Hauptfunktionen, bevor Sie beginnen.

  • Holen Sie sich Text aus einer PDF-Datei, bei der Kopieren und Einfügen nichts bewirken
  • Text aus gescannten oder reinen Bild-PDFs extrahieren
  • Inhalte aus PDFs kopieren, die das Markieren blockieren
  • Text in der Originalsprache Ihres Dokuments lesen
  • Extraktion für ein saubereres Ergebnis erneut ausführen
  • Bearbeitbaren Text für Notizen oder die Suche erhalten

Referenz zu den Einstellungen

Verfügbare Steuerelemente für PDF zu Text.

VerarbeitungsmodusVoreinstellungen
Verarbeiten Sie eine einzelne Eingabe oder wechseln Sie zur Premium-Stapelverarbeitung, um mehrere Eingaben mit denselben Einstellungen zu bearbeiten. Welche Eingabearten unterstützt werden, hängt vom Werkzeug ab.Optionen: Einzelne DateiStapel

Verfahren

VerfahrenRunterfallen
Legt fest, welche Texterkennungs-Engine deine Datei liest; wechsle zu Engine 1 oder Engine 2, wenn Standard stilisierte Schriften oder Handschrift falsch erkennt — das Ergebnis wird automatisch neu berechnet.Optionen: StandardVerfahren 1Verfahren 2
SpracheRunterfallen
Wählen Sie die Hauptsprache der Vorlage. Die verfügbaren Sprachen hängen vom gewählten Erkennungsmodul ab; nicht unterstützte Sprachen werden ausgeblendet. Englisch ist voreingestellt. Prüfen Sie den extrahierten Text auf Erkennungsfehler.Optionen: EnglischFranzösischDeutschSpanischItalienischPortugiesischNiederländischRussischJapanischKoreanischChinesisch (vereinfacht)Chinesisch (traditionell)ArabischHindiBengalischPunjabiUrduVietnamesischThailändischPolnischSchwedischDänischNorwegischFinnischTürkischUkrainischIndonesischTamilischTeluguMarathiNepalesischPersischGriechischHebräisch
Extraktion erneut ausführenEin Klick
Führt die Extraktion erneut auf derselben Datei mit den aktuellen Einstellungen für Engine und Sprache aus — praktisch für einen neuen Versuch nach einem schwachen oder fehlgeschlagenen Durchlauf.

Herunterladen

Herunterladen alsRunterfallen
Wählen Sie nach der Textextraktion das Ausgabeformat. Word- und Tabellenexporte erstellen eine Datei aus der Vorlage. CSV-Exporte von PDF-Tabellen enthalten eine ZIP-Datei mit einer Datei je Tabelle.Optionen: Text (.txt)Markdown-Dokument (.md)Word-Dokument (.docx)Excel-Arbeitsmappe (.xlsx)CSV (Tabellen · .zip)
Kostenlos nutzbar · Keine Registrierung erforderlich · Ohne WasserzeichenUploads werden während der Übertragung verschlüsseltGemäß unserer Aufbewahrungsrichtlinie entfernt

Häufig gestellte Fragen

Lade dein PDF hoch, und das Tool erkennt, ob es eine echte Textebene oder nur gescannte Bilder enthält. PDFs mit Textebene werden sofort exportiert. Reine Bild-PDFs (gescannte Bücher, fotografierte Belege, alte Berichte) durchlaufen automatisch OCR. So oder so erhältst du eine saubere .txt-Datei mit erhaltenen Absätzen, Zeilenumbrüchen und Abschnittsabständen.

usage

Ja. Wenn das PDF nur aus Bildern besteht (typisch bei Scans, fotografierten Seiten oder Fax-Exporten), springt die OCR-Engine automatisch an – Sie benötigen kein separates Tool. Die Mehrsprachenunterstützung ist integriert, sodass selbst zweisprachige oder nicht-lateinische Schriften (Chinesisch, Arabisch, Hindi) im selben Durchgang extrahiert werden.

features

Absatzumbrüche, Leerzeilen zwischen Abschnitten, Aufzählungszeichen und Nummerierungspräfixe bleiben als reiner Text erhalten. Überschriften erscheinen je nach Quellschriftart in Großbuchstaben oder in ihrer ursprünglichen Groß-/Kleinschreibung. Visuelle Hervorhebungen (fett, kursiv) werden in reinem Text nicht codiert – verwende dafür stattdessen den PDF-zu-Word-Konverter.

technical

Ja. Geben Sie das Passwort nach dem Hochladen in der Eingabeaufforderung ein, und das Tool entsperrt die Datei im Arbeitsspeicher gerade so lange, wie es zum Extrahieren des Textes nötig ist. Das Passwort wird niemals auf der Festplatte gespeichert oder an Drittdienste übertragen. Gesperrte PDFs ohne Passwort können nicht verarbeitet werden – aus Sicherheitsgründen wird kein Passwort-Cracking durchgeführt.

features

Seitenzahl und Dateigröße sind begrenzt, damit die Konvertierung zuverlässig bleibt. Der kostenlose Tarif unterstützt bis zu 30 Seiten und 11 MB, Premium 200 Seiten und 50 MB, Pro 500 Seiten und 120 MB und Enterprise 1000 Seiten. Teilen Sie größere Dokumente mit dem Werkzeug „PDF aufteilen“ und verarbeiten Sie jeden Abschnitt separat.

technical

Die Verarbeitung erfolgt auf sicheren Servern und Dateien werden gemäß unserer Sicherheitsrichtlinie entfernt – es sei denn, Sie teilen ein Ergebnis ausdrücklich mit, wodurch es unter einem öffentlichen Link verbleibt, den jeder, der es hat, bis zu 30 Tage lang öffnen kann. Die .txt-Ausgabe gehört Ihnen – kein Wasserzeichen, keine Quellenangabe, keine Nachverfolgung. Forscher, Journalisten, Anwälte und Studenten nutzen das Tool, um Text aus vertraulichen Berichten zu extrahieren, wobei sie wissen, dass die Quell-PDF-Datei nicht über dieses Fenster hinaus gespeichert wird.

privacy

Ja. Öffnen Sie das Engine-Panel, wählen Sie die Sprache Ihres Dokuments und die OCR-Engine, und die Seite wird in dieser Schrift gelesen – über 100 Sprachen werden unterstützt, einschließlich nicht-lateinischer und von rechts nach links geschriebener. Wenn der erste Durchlauf akzentuierte oder nicht-englische Zeichen falsch liest, wechseln Sie die Sprache und tippen Sie auf „Erkennung erneut ausführen“.

usage

Die formatierte Ansicht behält das ursprüngliche Seitenlayout bei – Spalten, Abstände und Zeilenpositionen –, was bei Tabellen und Belegen hilft. Die einfache Ansicht liefert sauberen, neu umgebrochenen Text, der sich leichter in ein Dokument oder einen Chatbot einfügen lässt. Wechsle zwischen beiden, kopiere dann den Text oder lade ihn als .txt-Datei herunter.

features

Dieses Tool liefert Ihnen den reinen Text zum Kopieren oder Speichern als .txt. Wenn Sie lieber das Original-PDF behalten, es aber per Strg+F durchsuchbar machen möchten, lassen Sie es durch das Tool „Bild zu durchsuchbarem PDF“ laufen – es legt eine unsichtbare OCR-Textebene über den Scan, sodass die Seite identisch aussieht, während die Wörter auswählbar werden.

tips

Starten Sie bei gängigen lateinisch geschriebenen Sprachen mit „Standard“ und der Sprache Ihres Dokuments — das ist schnell und genau für alltäglichen Text. Wirkt die Ausgabe verstümmelt oder ist die Schrift nicht lateinisch (Arabisch, Hindi, Chinesisch, Kyrillisch), wechseln Sie zu Engine 1 oder Engine 2, wählen Sie die passende Sprache aus der Auswahl und tippen Sie auf „Extraktion erneut ausführen“ — verschiedene Engines sind auf verschiedene Schriften abgestimmt, daher dauert es nur Sekunden, beide auszuprobieren.

tips

Das Ausgabefeld ist vollständig bearbeitbar, sodass Sie einen OCR-Fehler schnell bereinigen oder einen Abschnitt direkt auf dem Bildschirm kürzen können. „In Zwischenablage kopieren“ kopiert stets genau das, was gerade im Feld steht, einschließlich Bearbeitungen — doch „.txt herunterladen“ speichert die Originaldatei, die vom letzten Engine-/Sprachdurchlauf erzeugt wurde, nicht Ihre Bildschirmbearbeitungen. Um eine Korrektur zu behalten, nutzen Sie „Kopieren“ und fügen Sie sie in Ihre eigene .txt-Datei ein, oder wechseln Sie bei einem systematischen Fehler die Sprache oder Engine und tippen Sie auf „Extraktion erneut ausführen“, statt von Hand zu bearbeiten.

features

Lade dein PDF hoch und lass den Extraktor den Text herausziehen – bei gescannten oder reinen Bildseiten läuft die Texterkennung (OCR) automatisch mit – und lade das Ergebnis anschließend als reine .txt-Datei herunter. Die Datei öffnet sich in Notepad, TextEdit oder jedem Code-Editor, ganz ohne spezielle Software. So genutzt funktioniert es wie ein einfacher PDF-zu-Notepad-Konverter, wenn du nur rohen, kopierfertigen Text ohne Formatierung oder Bilder möchtest.

usage

Ja – PDF-Text konvertieren, in der Vorschau anzeigen und herunterladen, ohne ein Konto zu erstellen. Das kostenlose Paket umfasst OCR für gescannte PDFs, formatierte und einfache Ansichten sowie den TXT-Download. Premium entfernt abgedeckte Tageslimits.

pricing

Ja – Pixoate unterstützt die Stapel- und Massenverarbeitung. Wechseln Sie in den Stapelmodus, fügen Sie bis zu 60 PDFs bei Premium oder 200 bei Pro hinzu, legen Sie Ihre Optionen einmal fest und jedes PDF wird mit den gleichen Einstellungen verarbeitet, bevor Sie eine einzelne ZIP-Datei herunterladen. Die Massenverarbeitung ist eine Premium-Funktion; Die Ausgabe verwendet die gleiche Qualität und die gleichen Einstellungen wie im Einzelmodus.

features

Ja – bei der Massenverarbeitung konfigurieren Sie die Einstellungen einmalig und sie gelten für jedes Element im Stapel – bis zu 60 PDFs bei Premium oder 200 bei Pro. Es ist nicht erforderlich, die Einrichtung für jedes Element zu wiederholen. Temporär hochgeladene und generierte Dateien werden sicher verarbeitet und automatisch gelöscht.

usage

Fast immer liegt es an einem von drei Gründen: Die Datei überschreitet das kostenlose Upload-Limit von 11 MB – Premium akzeptiert 50 MB und Pro 120 MB. Das Format wird von diesem Werkzeug nicht unterstützt; prüfen Sie daher die Liste im Upload-Bereich. Oder die Datei entspricht tatsächlich nicht dem Format ihrer Dateiendung: Durch Umbenennen ändert sich der Dateiinhalt nicht. Deshalb kann ein scheinbar gültiges PDF abgelehnt werden.

troubleshooting

In einer PDF-Datei wird gespeichert, wo sich jedes Zeichen auf der Seite befindet, nicht in den Absätzen und Stilen, mit denen ein Textverarbeitungsprogramm arbeitet. Konvertieren bedeutet also, diese Struktur durch Rückschluss neu aufzubauen. Komplexe Spalten, Tabellen und Text, der um Bilder gewickelt ist, sind der Ort, an dem es schwebt. Wenn das Erscheinungsbild wichtiger ist als die Bearbeitbarkeit, wählen Sie den visuellen Modus. Wenn Sie etwas eingeben müssen, wählen Sie den bearbeitbaren Modus und rechnen Sie damit, die ungerade Überschrift zu korrigieren.

troubleshooting

Nein. Sie können PDF to Text ausführen und das kostenlose Ergebnis ohne Konto herunterladen, und es trägt kein Wasserzeichen. Premium ist das, was Sie kaufen, wenn die Grenzen zu greifen beginnen: bis zu 60 Dateien in einem Stapel, größere Uploads, keine tägliche Obergrenze und das Ergebnis in Originalauflösung. Beim Download-Schritt wird nichts angezeigt, was vor dem Start nicht sichtbar war.

pricing

Nein – PDF to Text läuft im Browser auf Desktop und Smartphone. Sie müssen nichts installieren, keine Testversion starten und keine Lizenz kaufen, bevor Sie prüfen können, ob das Tool Ihre Aufgabe löst. Verwenden Sie dafür Ihre eigene Datei statt eines Beispiels.

troubleshooting

Wie PDF zu Text dir hilft, es zu erledigen

Es löst jeden Tag echte Probleme – für Unternehmen, Kreative und alltägliche Aufgaben. Finden Sie den für Sie passenden Anwendungsfall und starten Sie.

Ausbildung

Extraktion von Vorlesungs- & Kursnotizen

Studierende extrahieren reinen Text aus von Professoren bereitgestellten PDF-Vorlesungsskripten und Laborhandbüchern, um Auszüge in Notion, Obsidian und Lernkarteikarten einzufügen.

Privatgebrauch

Lebenslauf-Text für Massenbewerbungen

Bewerber extrahieren reinen Text aus ihrem PDF-Lebenslauf, um ihn in ATS-Bewerbungsformulare, LinkedIn Easy Apply und Textfelder von Recruiter-Portalen einzufügen, die keine Datei-Uploads akzeptieren.

Für Unternehmen

E-Mail-Entwürfe aus PDF-Berichten

Analysten extrahieren Management-Summary-Abschnitte aus langen PDF-Berichten, um sie in E-Mails, Slack-Nachrichten und Teams-Chats einzufügen, damit Stakeholder die wichtigsten Erkenntnisse schnell erfassen.

Für Unternehmen

SEO-Audit bestehender PDF-Ressourcen

Marketer extrahieren Text aus alten PDF-Whitepapers und eBooks, um die Keyword-Abdeckung zu prüfen, Content-Lücken zu identifizieren und ihn als frische Blogbeiträge für die organische Suche neu zu veröffentlichen.

Für Unternehmen

Vorbereitung des Übersetzungs-Workflows

Übersetzer extrahieren Text aus einer PDF-Quelle, bevor sie ihn in Translation-Memory-Tools wie Trados, MemoQ oder DeepL Pro einfügen, um schneller und genauer zu lokalisieren.

Produktivität

KI-Prompts aus langen PDF-Berichten

Power-User extrahieren Text aus PDF-Forschungsarbeiten und übergeben ihn an ChatGPT, Claude oder Gemini als Kontext für Zusammenfassungen, Fragen und Antworten sowie die Extraktion von Kernaussagen.

Für Unternehmen

Klartext-Backup-Archive

IT- und Archivteams extrahieren reinen Text aus PDF-Dokumentenarchiven, um schlanke, zukunftssichere Backups zu erstellen, die in 20 Jahren nicht auf PDF-Viewer angewiesen sind.

Ausbildung

Zitat- & Literaturverzeichnisse

Forschende extrahieren Literaturverzeichnisse aus PDFs als reinen Text, um sie in Zotero, Mendeley oder EndNote einzufügen, ohne jeden Eintrag manuell neu abzutippen.

Privatgebrauch

Zugang über Screenreader und Text-to-Speech

Extrahiere sauberen Text aus einem PDF, damit er von Screenreadern vorgelesen oder in Text-zu-Sprache-Apps eingefügt werden kann – nützlich für sehbehinderte Leser oder um einen langen Bericht freihändig anzuhören.

Rechtliches

Stichwortsuche für juristische E-Discovery

Rechtsanwaltsfachangestellte extrahieren Text aus eingescannten Zeugenaussagen und Beweismittelbündeln, sodass der Inhalt über Tausende Seiten hinweg durchsuchbar wird, statt reine Bild-PDFs auf der Suche nach einem Namen oder einer Klausel durchzuscrollen.

Für Entwickler

Datenpipelines für gescannte Rechnungen

Entwickler und Ops-Teams extrahieren Text aus gescannten Rechnungen und Belegen, um Regex- oder LLM-basierte Parser zu speisen und die Massen-Dateneingabe zu automatisieren, statt manuell abzutippen.

Forschung

FOIA- & Leaked-Document-Untersuchungen

Investigative Journalisten extrahieren Text aus gescannten Regierungsveröffentlichungen und FOIA-Dokumenten, um Aussagen über große Dokumentensammlungen hinweg zu durchsuchen, zu zitieren und abzugleichen.

Diese Funktion bietet die beschriebenen Bearbeitungs- und Ausgabemöglichkeiten. Prüfen Sie die Vorschau und das Ergebnis vor dem Herunterladen oder Veröffentlichen.

Bearbeiten Sie Ihr Bild mit den passenden Optionen und prüfen Sie das Ergebnis sorgfältig vor dem Herunterladen oder Veröffentlichen.