Text aus PDFs extrahieren – kostenlos
Holen Sie mit präziser OCR bearbeitbaren Text aus jedem PDF – auch aus Scans, reinen Bild-PDFs oder abfotografierten Dokumenten. Kopieren Sie ihn oder laden Sie ihn als TXT, Markdown, Word, Excel oder CSV herunter.
- Liest gescannte und reine Bild-PDFs in über 30 Sprachen
- Formatierter oder reiner Text – sofort kopieren oder herunterladen
- Private processing · Files deleted automatically
PDF · Secure processing
PDF hochladen
Beliebiges PDF ablegen – Text kopieren oder als .txt herunterladen
PDF · free up to 20MB, Premium up to 50MB
Das können Sie mit PDF zu Text machen
Alles, was Sie mit diesem Werkzeug erreichen – ohne Einarbeitung, ohne Einrichtung.
- Reinen Text aus jedem PDF extrahieren
- Text aus gescannten oder reinen Bild-PDFs extrahieren
- Inhalte aus PDFs kopieren, die das Markieren blockieren
- Text in der Originalsprache Ihres Dokuments lesen
- Extraktion für ein saubereres Ergebnis erneut ausführen
- Bearbeitbaren Text für Notizen oder die Suche erhalten
Informationen zu den Einstellungen
3 Einstellungen
Jede Einstellung in PDF zu Text erklärt – was sie bewirkt und wann Sie sie einsetzen.
Verfahren
- VerfahrenDropdown
- Legt fest, welche Texterkennungs-Engine deine Datei liest; wechsle zu Engine 1 oder Engine 2, wenn Standard stilisierte Schriften oder Handschrift falsch erkennt — das Ergebnis wird automatisch neu berechnet.Optionen: StandardVerfahren 1Verfahren 2
- SpracheDropdown
- Legt fest, in welcher Sprache der Ausgangstext verfasst ist, damit Zeichen zuverlässig erkannt werden; die durchsuchbare Auswahl zeigt nur Sprachen, die die gewählte Engine unterstützt – standardmäßig Englisch.Optionen: EnglischFranzösischDeutschSpanischItalienischPortugiesischNiederländischRussischJapanischKoreanischChinesisch (vereinfacht)Chinesisch (traditionell)ArabischHindiBengalischPunjabiUrduVietnamesischThailändischPolnischSchwedischDänischNorwegischFinnischTürkischUkrainischIndonesischTamilTeluguMarathiNepalesischPersischGriechischHebräisch
- Extraktion erneut ausführenEin Klick
- Führt die Extraktion erneut auf derselben Datei mit den aktuellen Einstellungen für Engine und Sprache aus — praktisch für einen neuen Versuch nach einem schwachen oder fehlgeschlagenen Durchlauf.
Fertig mit PDF zu Text? Probiere als Nächstes diese
Handverlesene Tools, die gut zu PDF zu Text passen. Mach weiter, ohne deine Datei zu verlieren.
PDF zu Word
Schluss mit dem Abtippen gesperrter PDFs. Sie erhalten eine saubere .docx-Datei mit erhaltenen Schriften, Tabellen und erhaltenem Layout, die sich in Word, Pages oder Google Docs öffnen lässt – fertig in Sekunden. Kostenlos starten, ohne Kreditkarte.
Jetzt ausprobierenPDF zu HTML
Semantisches HTML mit echtem Tabellen-Markup, das Sie direkt in Ihre Website oder Ihr CMS einfügen können – funktioniert auch bei gescannten PDFs und ist in Sekunden fertig. Kostenlos starten, keine Kreditkarte.
Jetzt ausprobierenBild zu Text (OCR)
Schluss mit dem Abtippen von Screenshots und Scans. Laden Sie ein beliebiges Bild hoch und erhalten Sie sauberen, bearbeitbaren Text in über 30 Sprachen – in Sekunden zum Kopieren bereit. Kostenlos starten.
Jetzt ausprobierenPDF zusammenführen
Schluss mit fünf Anhängen pro E-Mail. Legen Sie Ihre PDFs ab, ziehen Sie sie in die richtige Reihenfolge und laden Sie in Sekunden eine einzige zusammengeführte Datei herunter. Kostenlos starten, kein Wasserzeichen, Dateien werden automatisch gelöscht.
Jetzt ausprobierenPDF komprimieren
Am Upload-Limit gescheitert oder vom Mailserver abgewiesen? Wählen Sie eine Qualitätsvorgabe und erhalten Sie in Sekunden ein deutlich kleineres PDF – gleiches Dokument, leichtere Datei. Kostenlos starten, kein Wasserzeichen.
Jetzt ausprobierenWortzähler
Essay limits and character caps sneak up on you. Paste or type to see words, characters, sentences, paragraphs and reading time update live. Free to use and copy — no account needed.
Jetzt ausprobierenHäufig gestellte Fragen
Lade dein PDF hoch, und das Tool erkennt, ob es eine echte Textebene oder nur gescannte Bilder enthält. PDFs mit Textebene werden sofort exportiert. Reine Bild-PDFs (gescannte Bücher, fotografierte Belege, alte Berichte) durchlaufen automatisch OCR. So oder so erhältst du eine saubere .txt-Datei mit erhaltenen Absätzen, Zeilenumbrüchen und Abschnittsabständen.
usageJa. Wenn das PDF nur aus Bildern besteht (typisch bei Scans, fotografierten Seiten oder Fax-Exporten), springt die OCR-Engine automatisch an – Sie benötigen kein separates Tool. Die Mehrsprachenunterstützung ist integriert, sodass selbst zweisprachige oder nicht-lateinische Schriften (Chinesisch, Arabisch, Hindi) im selben Durchgang extrahiert werden.
featuresAbsatzumbrüche, Leerzeilen zwischen Abschnitten, Aufzählungszeichen und Nummerierungspräfixe bleiben als reiner Text erhalten. Überschriften erscheinen je nach Quellschriftart in Großbuchstaben oder in ihrer ursprünglichen Groß-/Kleinschreibung. Visuelle Hervorhebungen (fett, kursiv) werden in reinem Text nicht codiert – verwende dafür stattdessen den PDF-zu-Word-Konverter.
technicalJa. Geben Sie das Passwort nach dem Hochladen in der Eingabeaufforderung ein, und das Tool entsperrt die Datei im Arbeitsspeicher gerade so lange, wie es zum Extrahieren des Textes nötig ist. Das Passwort wird niemals auf der Festplatte gespeichert oder an Drittdienste übertragen. Gesperrte PDFs ohne Passwort können nicht verarbeitet werden – aus Sicherheitsgründen wird kein Passwort-Cracking durchgeführt.
featuresDateien können bei Free bis zu 20 MB, bei Premium 50 MB oder bei Pro 120 MB groß sein und 500 Seiten können problemlos verarbeitet werden. Größere Dokumente funktionieren auch, dauern aber länger – die OCR eines 2000-seitigen Rechtsarchivs kann einige Minuten dauern. Teilen Sie bei umfangreichen Aufträgen die PDF-Datei zunächst mit dem PDF-Split-Tool auf und verarbeiten Sie jeden Teil separat.
technicalDie Verarbeitung läuft auf sicheren Servern und Dateien werden innerhalb von 24 Stunden gelöscht – es sei denn, Sie geben ein Ergebnis ausdrücklich frei; dann bleibt es bis zu 30 Tage lang unter einem öffentlichen Link erreichbar, den jeder öffnen kann, der ihn besitzt. Die .txt-Ausgabe gehört Ihnen – kein Wasserzeichen, keine Namensnennung, kein Tracking. Forschende, Journalisten, Anwälte und Studierende extrahieren mit dem Werkzeug Text aus vertraulichen Berichten – in dem Wissen, dass das Quell-PDF darüber hinaus nicht gespeichert wird.
privacyJa. Öffnen Sie das Engine-Panel, wählen Sie die Sprache Ihres Dokuments und die OCR-Engine, und die Seite wird in dieser Schrift gelesen – über 100 Sprachen werden unterstützt, einschließlich nicht-lateinischer und von rechts nach links geschriebener. Wenn der erste Durchlauf akzentuierte oder nicht-englische Zeichen falsch liest, wechseln Sie die Sprache und tippen Sie auf „Erkennung erneut ausführen“.
usageDie formatierte Ansicht behält das ursprüngliche Seitenlayout bei – Spalten, Abstände und Zeilenpositionen –, was bei Tabellen und Belegen hilft. Die einfache Ansicht liefert sauberen, neu umgebrochenen Text, der sich leichter in ein Dokument oder einen Chatbot einfügen lässt. Wechsle zwischen beiden, kopiere dann den Text oder lade ihn als .txt-Datei herunter.
featuresDieses Tool liefert Ihnen den reinen Text zum Kopieren oder Speichern als .txt. Wenn Sie lieber das Original-PDF behalten, es aber per Strg+F durchsuchbar machen möchten, lassen Sie es durch das Tool „Bild zu durchsuchbarem PDF“ laufen – es legt eine unsichtbare OCR-Textebene über den Scan, sodass die Seite identisch aussieht, während die Wörter auswählbar werden.
tipsStarten Sie bei gängigen lateinisch geschriebenen Sprachen mit „Standard“ und der Sprache Ihres Dokuments — das ist schnell und genau für alltäglichen Text. Wirkt die Ausgabe verstümmelt oder ist die Schrift nicht lateinisch (Arabisch, Hindi, Chinesisch, Kyrillisch), wechseln Sie zu Engine 1 oder Engine 2, wählen Sie die passende Sprache aus der Auswahl und tippen Sie auf „Extraktion erneut ausführen“ — verschiedene Engines sind auf verschiedene Schriften abgestimmt, daher dauert es nur Sekunden, beide auszuprobieren.
tipsDas Ausgabefeld ist vollständig bearbeitbar, sodass Sie einen OCR-Fehler schnell bereinigen oder einen Abschnitt direkt auf dem Bildschirm kürzen können. „In Zwischenablage kopieren“ kopiert stets genau das, was gerade im Feld steht, einschließlich Bearbeitungen — doch „.txt herunterladen“ speichert die Originaldatei, die vom letzten Engine-/Sprachdurchlauf erzeugt wurde, nicht Ihre Bildschirmbearbeitungen. Um eine Korrektur zu behalten, nutzen Sie „Kopieren“ und fügen Sie sie in Ihre eigene .txt-Datei ein, oder wechseln Sie bei einem systematischen Fehler die Sprache oder Engine und tippen Sie auf „Extraktion erneut ausführen“, statt von Hand zu bearbeiten.
featuresLade dein PDF hoch und lass den Extraktor den Text herausziehen – bei gescannten oder reinen Bildseiten läuft die Texterkennung (OCR) automatisch mit – und lade das Ergebnis anschließend als reine .txt-Datei herunter. Die Datei öffnet sich in Notepad, TextEdit oder jedem Code-Editor, ganz ohne spezielle Software. So genutzt funktioniert es wie ein einfacher PDF-zu-Notepad-Konverter, wenn du nur rohen, kopierfertigen Text ohne Formatierung oder Bilder möchtest.
usageYes — you can convert PDF to text free to preview; create a free account to download required. The free tier includes a generous daily allowance and covers OCR on scanned PDFs, the Formatted and Plain views, and the .txt download. If you extract text from large batches of documents every day, upgrading removes the daily limits.
pricingJa – Pixoate unterstützt die Stapel- und Massenverarbeitung. Wechseln Sie in den Stapelmodus, fügen Sie bis zu 60 PDFs bei Premium oder 200 bei Pro hinzu, legen Sie Ihre Optionen einmal fest und jedes PDF wird mit den gleichen Einstellungen verarbeitet, bevor Sie eine einzelne ZIP-Datei herunterladen. Die Massenverarbeitung ist eine Premium-Funktion; Die Ausgabe verwendet die gleiche Qualität und die gleichen Einstellungen wie im Einzelmodus.
featuresJa – bei der Massenverarbeitung konfigurieren Sie die Einstellungen einmalig und sie gelten für jedes Element im Stapel – bis zu 60 PDFs bei Premium oder 200 bei Pro. Es ist nicht erforderlich, die Einrichtung für jedes Element zu wiederholen. Temporär hochgeladene und generierte Dateien werden sicher verarbeitet und automatisch gelöscht.
usageWie PDF zu Text dir hilft, es zu erledigen
Echte Probleme, die es jeden Tag löst — für Unternehmen, Kreative und alltägliche Aufgaben. Finde den passenden Anwendungsfall und leg in Sekunden los.
Extraktion von Vorlesungs- & Kursnotizen
Studierende extrahieren reinen Text aus von Professoren bereitgestellten PDF-Vorlesungsskripten und Laborhandbüchern, um Auszüge in Notion, Obsidian und Lernkarteikarten einzufügen.
Lebenslauf-Text für Massenbewerbungen
Bewerber extrahieren reinen Text aus ihrem PDF-Lebenslauf, um ihn in ATS-Bewerbungsformulare, LinkedIn Easy Apply und Textfelder von Recruiter-Portalen einzufügen, die keine Datei-Uploads akzeptieren.
E-Mail-Entwürfe aus PDF-Berichten
Analysten extrahieren Management-Summary-Abschnitte aus langen PDF-Berichten, um sie in E-Mails, Slack-Nachrichten und Teams-Chats einzufügen, damit Stakeholder die wichtigsten Erkenntnisse schnell erfassen.
SEO-Audit bestehender PDF-Ressourcen
Marketer extrahieren Text aus alten PDF-Whitepapers und eBooks, um die Keyword-Abdeckung zu prüfen, Content-Lücken zu identifizieren und ihn als frische Blogbeiträge für die organische Suche neu zu veröffentlichen.
Vorbereitung des Übersetzungs-Workflows
Übersetzer extrahieren Text aus einer PDF-Quelle, bevor sie ihn in Translation-Memory-Tools wie Trados, MemoQ oder DeepL Pro einfügen, um schneller und genauer zu lokalisieren.
KI-Prompts aus langen PDF-Berichten
Power-User extrahieren Text aus PDF-Forschungsarbeiten und übergeben ihn an ChatGPT, Claude oder Gemini als Kontext für Zusammenfassungen, Fragen und Antworten sowie die Extraktion von Kernaussagen.
Klartext-Backup-Archive
IT- und Archivteams extrahieren reinen Text aus PDF-Dokumentenarchiven, um schlanke, zukunftssichere Backups zu erstellen, die in 20 Jahren nicht auf PDF-Viewer angewiesen sind.
Zitat- & Literaturverzeichnisse
Forschende extrahieren Literaturverzeichnisse aus PDFs als reinen Text, um sie in Zotero, Mendeley oder EndNote einzufügen, ohne jeden Eintrag manuell neu abzutippen.
Zugang über Screenreader und Text-to-Speech
Extrahiere sauberen Text aus einem PDF, damit er von Screenreadern vorgelesen oder in Text-zu-Sprache-Apps eingefügt werden kann – nützlich für sehbehinderte Leser oder um einen langen Bericht freihändig anzuhören.
Stichwortsuche für juristische E-Discovery
Rechtsanwaltsfachangestellte extrahieren Text aus eingescannten Zeugenaussagen und Beweismittelbündeln, sodass der Inhalt über Tausende Seiten hinweg durchsuchbar wird, statt reine Bild-PDFs auf der Suche nach einem Namen oder einer Klausel durchzuscrollen.
Datenpipelines für gescannte Rechnungen
Entwickler und Ops-Teams extrahieren Text aus gescannten Rechnungen und Belegen, um Regex- oder LLM-basierte Parser zu speisen und die Massen-Dateneingabe zu automatisieren, statt manuell abzutippen.
FOIA- & Leaked-Document-Untersuchungen
Investigative Journalisten extrahieren Text aus gescannten Regierungsveröffentlichungen und FOIA-Dokumenten, um Aussagen über große Dokumentensammlungen hinweg zu durchsuchen, zu zitieren und abzugleichen.
