PDF in Text (OCR)

Text aus PDFs extrahieren – kostenlos

Holen Sie mit präziser OCR bearbeitbaren Text aus jedem PDF – auch aus Scans, reinen Bild-PDFs oder abfotografierten Dokumenten. Kopieren Sie ihn oder laden Sie ihn als TXT, Markdown, Word, Excel oder CSV herunter.

  • Liest gescannte und reine Bild-PDFs in über 30 Sprachen
  • Formatierter oder reiner Text – sofort kopieren oder herunterladen
  • Private processing · Files deleted automatically

PDF · Secure processing

TXT
PDFTXT

PDF hochladen

Beliebiges PDF ablegen – Text kopieren oder als .txt herunterladen

PDF · free up to 20MB, Premium up to 50MB

Das können Sie mit PDF zu Text machen

Alles, was Sie mit diesem Werkzeug erreichen – ohne Einarbeitung, ohne Einrichtung.

  • Reinen Text aus jedem PDF extrahieren
  • Text aus gescannten oder reinen Bild-PDFs extrahieren
  • Inhalte aus PDFs kopieren, die das Markieren blockieren
  • Text in der Originalsprache Ihres Dokuments lesen
  • Extraktion für ein saubereres Ergebnis erneut ausführen
  • Bearbeitbaren Text für Notizen oder die Suche erhalten

Informationen zu den Einstellungen

Jede Einstellung in PDF zu Text erklärt – was sie bewirkt und wann Sie sie einsetzen.

Verfahren

VerfahrenDropdown
Legt fest, welche Texterkennungs-Engine deine Datei liest; wechsle zu Engine 1 oder Engine 2, wenn Standard stilisierte Schriften oder Handschrift falsch erkennt — das Ergebnis wird automatisch neu berechnet.Optionen: StandardVerfahren 1Verfahren 2
SpracheDropdown
Legt fest, in welcher Sprache der Ausgangstext verfasst ist, damit Zeichen zuverlässig erkannt werden; die durchsuchbare Auswahl zeigt nur Sprachen, die die gewählte Engine unterstützt – standardmäßig Englisch.Optionen: EnglischFranzösischDeutschSpanischItalienischPortugiesischNiederländischRussischJapanischKoreanischChinesisch (vereinfacht)Chinesisch (traditionell)ArabischHindiBengalischPunjabiUrduVietnamesischThailändischPolnischSchwedischDänischNorwegischFinnischTürkischUkrainischIndonesischTamilTeluguMarathiNepalesischPersischGriechischHebräisch
Extraktion erneut ausführenEin Klick
Führt die Extraktion erneut auf derselben Datei mit den aktuellen Einstellungen für Engine und Sprache aus — praktisch für einen neuen Versuch nach einem schwachen oder fehlgeschlagenen Durchlauf.
Uploads are encrypted in transitRemoved under our retention policy

Fertig mit PDF zu Text? Probiere als Nächstes diese

Handverlesene Tools, die gut zu PDF zu Text passen. Mach weiter, ohne deine Datei zu verlieren.

Alle Tools ansehen
PDFW

PDF zu Word

Schluss mit dem Abtippen gesperrter PDFs. Sie erhalten eine saubere .docx-Datei mit erhaltenen Schriften, Tabellen und erhaltenem Layout, die sich in Word, Pages oder Google Docs öffnen lässt – fertig in Sekunden. Kostenlos starten, ohne Kreditkarte.

Jetzt ausprobieren
PDF</>

PDF zu HTML

Semantisches HTML mit echtem Tabellen-Markup, das Sie direkt in Ihre Website oder Ihr CMS einfügen können – funktioniert auch bei gescannten PDFs und ist in Sekunden fertig. Kostenlos starten, keine Kreditkarte.

Jetzt ausprobieren
Aa

Bild zu Text (OCR)

Schluss mit dem Abtippen von Screenshots und Scans. Laden Sie ein beliebiges Bild hoch und erhalten Sie sauberen, bearbeitbaren Text in über 30 Sprachen – in Sekunden zum Kopieren bereit. Kostenlos starten.

Jetzt ausprobieren
PDF

PDF zusammenführen

Schluss mit fünf Anhängen pro E-Mail. Legen Sie Ihre PDFs ab, ziehen Sie sie in die richtige Reihenfolge und laden Sie in Sekunden eine einzige zusammengeführte Datei herunter. Kostenlos starten, kein Wasserzeichen, Dateien werden automatisch gelöscht.

Jetzt ausprobieren
PDF8MBPDF1MB

PDF komprimieren

Am Upload-Limit gescheitert oder vom Mailserver abgewiesen? Wählen Sie eine Qualitätsvorgabe und erhalten Sie in Sekunden ein deutlich kleineres PDF – gleiches Dokument, leichtere Datei. Kostenlos starten, kein Wasserzeichen.

Jetzt ausprobieren
1,248 words

Wortzähler

Essay limits and character caps sneak up on you. Paste or type to see words, characters, sentences, paragraphs and reading time update live. Free to use and copy — no account needed.

Jetzt ausprobieren

Häufig gestellte Fragen

Lade dein PDF hoch, und das Tool erkennt, ob es eine echte Textebene oder nur gescannte Bilder enthält. PDFs mit Textebene werden sofort exportiert. Reine Bild-PDFs (gescannte Bücher, fotografierte Belege, alte Berichte) durchlaufen automatisch OCR. So oder so erhältst du eine saubere .txt-Datei mit erhaltenen Absätzen, Zeilenumbrüchen und Abschnittsabständen.

usage

Ja. Wenn das PDF nur aus Bildern besteht (typisch bei Scans, fotografierten Seiten oder Fax-Exporten), springt die OCR-Engine automatisch an – Sie benötigen kein separates Tool. Die Mehrsprachenunterstützung ist integriert, sodass selbst zweisprachige oder nicht-lateinische Schriften (Chinesisch, Arabisch, Hindi) im selben Durchgang extrahiert werden.

features

Absatzumbrüche, Leerzeilen zwischen Abschnitten, Aufzählungszeichen und Nummerierungspräfixe bleiben als reiner Text erhalten. Überschriften erscheinen je nach Quellschriftart in Großbuchstaben oder in ihrer ursprünglichen Groß-/Kleinschreibung. Visuelle Hervorhebungen (fett, kursiv) werden in reinem Text nicht codiert – verwende dafür stattdessen den PDF-zu-Word-Konverter.

technical

Ja. Geben Sie das Passwort nach dem Hochladen in der Eingabeaufforderung ein, und das Tool entsperrt die Datei im Arbeitsspeicher gerade so lange, wie es zum Extrahieren des Textes nötig ist. Das Passwort wird niemals auf der Festplatte gespeichert oder an Drittdienste übertragen. Gesperrte PDFs ohne Passwort können nicht verarbeitet werden – aus Sicherheitsgründen wird kein Passwort-Cracking durchgeführt.

features

Dateien können bei Free bis zu 20 MB, bei Premium 50 MB oder bei Pro 120 MB groß sein und 500 Seiten können problemlos verarbeitet werden. Größere Dokumente funktionieren auch, dauern aber länger – die OCR eines 2000-seitigen Rechtsarchivs kann einige Minuten dauern. Teilen Sie bei umfangreichen Aufträgen die PDF-Datei zunächst mit dem PDF-Split-Tool auf und verarbeiten Sie jeden Teil separat.

technical

Die Verarbeitung läuft auf sicheren Servern und Dateien werden innerhalb von 24 Stunden gelöscht – es sei denn, Sie geben ein Ergebnis ausdrücklich frei; dann bleibt es bis zu 30 Tage lang unter einem öffentlichen Link erreichbar, den jeder öffnen kann, der ihn besitzt. Die .txt-Ausgabe gehört Ihnen – kein Wasserzeichen, keine Namensnennung, kein Tracking. Forschende, Journalisten, Anwälte und Studierende extrahieren mit dem Werkzeug Text aus vertraulichen Berichten – in dem Wissen, dass das Quell-PDF darüber hinaus nicht gespeichert wird.

privacy

Ja. Öffnen Sie das Engine-Panel, wählen Sie die Sprache Ihres Dokuments und die OCR-Engine, und die Seite wird in dieser Schrift gelesen – über 100 Sprachen werden unterstützt, einschließlich nicht-lateinischer und von rechts nach links geschriebener. Wenn der erste Durchlauf akzentuierte oder nicht-englische Zeichen falsch liest, wechseln Sie die Sprache und tippen Sie auf „Erkennung erneut ausführen“.

usage

Die formatierte Ansicht behält das ursprüngliche Seitenlayout bei – Spalten, Abstände und Zeilenpositionen –, was bei Tabellen und Belegen hilft. Die einfache Ansicht liefert sauberen, neu umgebrochenen Text, der sich leichter in ein Dokument oder einen Chatbot einfügen lässt. Wechsle zwischen beiden, kopiere dann den Text oder lade ihn als .txt-Datei herunter.

features

Dieses Tool liefert Ihnen den reinen Text zum Kopieren oder Speichern als .txt. Wenn Sie lieber das Original-PDF behalten, es aber per Strg+F durchsuchbar machen möchten, lassen Sie es durch das Tool „Bild zu durchsuchbarem PDF“ laufen – es legt eine unsichtbare OCR-Textebene über den Scan, sodass die Seite identisch aussieht, während die Wörter auswählbar werden.

tips

Starten Sie bei gängigen lateinisch geschriebenen Sprachen mit „Standard“ und der Sprache Ihres Dokuments — das ist schnell und genau für alltäglichen Text. Wirkt die Ausgabe verstümmelt oder ist die Schrift nicht lateinisch (Arabisch, Hindi, Chinesisch, Kyrillisch), wechseln Sie zu Engine 1 oder Engine 2, wählen Sie die passende Sprache aus der Auswahl und tippen Sie auf „Extraktion erneut ausführen“ — verschiedene Engines sind auf verschiedene Schriften abgestimmt, daher dauert es nur Sekunden, beide auszuprobieren.

tips

Das Ausgabefeld ist vollständig bearbeitbar, sodass Sie einen OCR-Fehler schnell bereinigen oder einen Abschnitt direkt auf dem Bildschirm kürzen können. „In Zwischenablage kopieren“ kopiert stets genau das, was gerade im Feld steht, einschließlich Bearbeitungen — doch „.txt herunterladen“ speichert die Originaldatei, die vom letzten Engine-/Sprachdurchlauf erzeugt wurde, nicht Ihre Bildschirmbearbeitungen. Um eine Korrektur zu behalten, nutzen Sie „Kopieren“ und fügen Sie sie in Ihre eigene .txt-Datei ein, oder wechseln Sie bei einem systematischen Fehler die Sprache oder Engine und tippen Sie auf „Extraktion erneut ausführen“, statt von Hand zu bearbeiten.

features

Lade dein PDF hoch und lass den Extraktor den Text herausziehen – bei gescannten oder reinen Bildseiten läuft die Texterkennung (OCR) automatisch mit – und lade das Ergebnis anschließend als reine .txt-Datei herunter. Die Datei öffnet sich in Notepad, TextEdit oder jedem Code-Editor, ganz ohne spezielle Software. So genutzt funktioniert es wie ein einfacher PDF-zu-Notepad-Konverter, wenn du nur rohen, kopierfertigen Text ohne Formatierung oder Bilder möchtest.

usage

Yes — you can convert PDF to text free to preview; create a free account to download required. The free tier includes a generous daily allowance and covers OCR on scanned PDFs, the Formatted and Plain views, and the .txt download. If you extract text from large batches of documents every day, upgrading removes the daily limits.

pricing

Ja – Pixoate unterstützt die Stapel- und Massenverarbeitung. Wechseln Sie in den Stapelmodus, fügen Sie bis zu 60 PDFs bei Premium oder 200 bei Pro hinzu, legen Sie Ihre Optionen einmal fest und jedes PDF wird mit den gleichen Einstellungen verarbeitet, bevor Sie eine einzelne ZIP-Datei herunterladen. Die Massenverarbeitung ist eine Premium-Funktion; Die Ausgabe verwendet die gleiche Qualität und die gleichen Einstellungen wie im Einzelmodus.

features

Ja – bei der Massenverarbeitung konfigurieren Sie die Einstellungen einmalig und sie gelten für jedes Element im Stapel – bis zu 60 PDFs bei Premium oder 200 bei Pro. Es ist nicht erforderlich, die Einrichtung für jedes Element zu wiederholen. Temporär hochgeladene und generierte Dateien werden sicher verarbeitet und automatisch gelöscht.

usage

Wie PDF zu Text dir hilft, es zu erledigen

Echte Probleme, die es jeden Tag löst — für Unternehmen, Kreative und alltägliche Aufgaben. Finde den passenden Anwendungsfall und leg in Sekunden los.

Ausbildung

Extraktion von Vorlesungs- & Kursnotizen

Studierende extrahieren reinen Text aus von Professoren bereitgestellten PDF-Vorlesungsskripten und Laborhandbüchern, um Auszüge in Notion, Obsidian und Lernkarteikarten einzufügen.

Privatgebrauch

Lebenslauf-Text für Massenbewerbungen

Bewerber extrahieren reinen Text aus ihrem PDF-Lebenslauf, um ihn in ATS-Bewerbungsformulare, LinkedIn Easy Apply und Textfelder von Recruiter-Portalen einzufügen, die keine Datei-Uploads akzeptieren.

Für Unternehmen

E-Mail-Entwürfe aus PDF-Berichten

Analysten extrahieren Management-Summary-Abschnitte aus langen PDF-Berichten, um sie in E-Mails, Slack-Nachrichten und Teams-Chats einzufügen, damit Stakeholder die wichtigsten Erkenntnisse schnell erfassen.

Für Unternehmen

SEO-Audit bestehender PDF-Ressourcen

Marketer extrahieren Text aus alten PDF-Whitepapers und eBooks, um die Keyword-Abdeckung zu prüfen, Content-Lücken zu identifizieren und ihn als frische Blogbeiträge für die organische Suche neu zu veröffentlichen.

Für Unternehmen

Vorbereitung des Übersetzungs-Workflows

Übersetzer extrahieren Text aus einer PDF-Quelle, bevor sie ihn in Translation-Memory-Tools wie Trados, MemoQ oder DeepL Pro einfügen, um schneller und genauer zu lokalisieren.

Produktivität

KI-Prompts aus langen PDF-Berichten

Power-User extrahieren Text aus PDF-Forschungsarbeiten und übergeben ihn an ChatGPT, Claude oder Gemini als Kontext für Zusammenfassungen, Fragen und Antworten sowie die Extraktion von Kernaussagen.

Für Unternehmen

Klartext-Backup-Archive

IT- und Archivteams extrahieren reinen Text aus PDF-Dokumentenarchiven, um schlanke, zukunftssichere Backups zu erstellen, die in 20 Jahren nicht auf PDF-Viewer angewiesen sind.

Ausbildung

Zitat- & Literaturverzeichnisse

Forschende extrahieren Literaturverzeichnisse aus PDFs als reinen Text, um sie in Zotero, Mendeley oder EndNote einzufügen, ohne jeden Eintrag manuell neu abzutippen.

Privatgebrauch

Zugang über Screenreader und Text-to-Speech

Extrahiere sauberen Text aus einem PDF, damit er von Screenreadern vorgelesen oder in Text-zu-Sprache-Apps eingefügt werden kann – nützlich für sehbehinderte Leser oder um einen langen Bericht freihändig anzuhören.

Rechtliches

Stichwortsuche für juristische E-Discovery

Rechtsanwaltsfachangestellte extrahieren Text aus eingescannten Zeugenaussagen und Beweismittelbündeln, sodass der Inhalt über Tausende Seiten hinweg durchsuchbar wird, statt reine Bild-PDFs auf der Suche nach einem Namen oder einer Klausel durchzuscrollen.

Für Entwickler

Datenpipelines für gescannte Rechnungen

Entwickler und Ops-Teams extrahieren Text aus gescannten Rechnungen und Belegen, um Regex- oder LLM-basierte Parser zu speisen und die Massen-Dateneingabe zu automatisieren, statt manuell abzutippen.

Forschung

FOIA- & Leaked-Document-Untersuchungen

Investigative Journalisten extrahieren Text aus gescannten Regierungsveröffentlichungen und FOIA-Dokumenten, um Aussagen über große Dokumentensammlungen hinweg zu durchsuchen, zu zitieren und abzugleichen.