PDF to Text (OCR)

Extract text from PDFs — free

Pull editable text out of any PDF with accurate OCR — even scanned, image-only or photo-of-document PDFs. Copy it or download as TXT, Markdown, Word, Excel or CSV.

  • Reads scanned & image-only PDFs in 30+ languages
  • Formatted or plain text — copy or download instantly
  • Private processing · Files deleted automatically

PDF · Secure processing

TXT
PDFTXT

PDF uploaden

Drop any PDF — copy its text or download it as .txt

PDF · free up to 20MB, Premium up to 50MB

What you can do with PDF naar tekst

Everything this tool helps you accomplish — no learning curve, no setup.

  • Extract plain text from any PDF
  • Pull text out of scanned or image-only PDFs
  • Copy content from PDFs that block selection
  • Read text in your document's own language
  • Re-run extraction for a cleaner result
  • Get editable text for notes or search

Settings information

Every control in PDF naar tekst, explained — what it does and when to use it.

Engine

EngineDropdown
Bepaalt welke tekstherkenningsengine je bestand leest; schakel over naar Engine 1 of Engine 2 wanneer Standaard gestileerde lettertypen of handschrift verkeerd leest — het resultaat wordt automatisch vernieuwd.Opties: StandaardEngine 1Engine 2
TaalDropdown
Stelt in in welke taal de brontekst is geschreven, zodat tekens nauwkeurig worden herkend; de doorzoekbare keuzelijst toont alleen de talen die de gekozen engine ondersteunt, met Engels als standaard.Opties: EnglishFrenchGermanSpanishItalianPortugueseDutchRussianJapaneseKoreanChinese (Simplified)Chinese (Traditional)ArabicHindiBengaliPunjabiUrduVietnameseThaiPolishSwedishDanishNorwegianFinnishTurkishUkrainianIndonesianTamilTeluguMarathiNepaliPersianGreekHebrew
Extractie opnieuw uitvoerenOne-click
Voert de extractie opnieuw uit op hetzelfde bestand met de huidige keuzes voor Engine en Taal — handig om het opnieuw te proberen na een zwakke of mislukte poging.
Uploads are encrypted in transitRemoved under our retention policy

Veelgestelde vragen

Upload je PDF en de tool detecteert of deze een echte tekstlaag bevat of slechts gescande afbeeldingen. PDF's met een tekstlaag exporteren direct. PDF's met alleen afbeeldingen (gescande boeken, gefotografeerde bonnetjes, oude rapporten) gaan automatisch door OCR. Hoe dan ook krijg je een schoon .txt-bestand met behoud van alinea's, regeleinden en sectie-afstanden.

usage

Ja. Als de PDF alleen afbeeldingen bevat (gebruikelijk bij scans, gefotografeerde pagina's of faxexports), wordt de OCR-engine automatisch geactiveerd — je hebt geen aparte tool nodig. Meertalige ondersteuning is ingebouwd, dus zelfs tweetalige of niet-Latijnse schriften (Chinees, Arabisch, Hindi) worden in dezelfde doorgang geëxtraheerd.

features

Alinea-einden, lege regels tussen secties, opsommingstekens en nummering van genummerde lijsten blijven als platte tekst behouden. Koppen komen in hoofdletters of in hun oorspronkelijke schrijfwijze door, afhankelijk van het bronlettertype. Visuele nadruk (vet, cursief) wordt niet in platte tekst gecodeerd — gebruik daarvoor de PDF-naar-Word-converter.

technical

Ja. Voer het wachtwoord in bij de prompt na het uploaden, en de tool ontgrendelt het bestand in het geheugen, net lang genoeg om de tekst te extraheren. Het wachtwoord wordt nooit op schijf opgeslagen of naar diensten van derden verzonden. Vergrendelde PDF's zonder het wachtwoord kunnen niet worden verwerkt — om veiligheidsredenen wordt er geen wachtwoord gekraakt.

features

Bestanden kunnen maximaal 20 MB groot zijn met Free, 50 MB met Premium of 120 MB met Pro, en 500 pagina's kunnen zonder problemen worden verwerkt. Grotere documenten werken ook, maar duren langer: een juridisch archief van 2000 pagina's kan enkele minuten nodig hebben voor OCR. Voor grote opdrachten kunt u de PDF eerst splitsen met de tool PDF Splitsen en elk deel afzonderlijk verwerken.

technical

Processing happens on secure servers and files are deleted within 24 hours — unless you explicitly share a result, which keeps it at a public link anyone who has it can open for up to 30 days. The .txt output is yours — no watermark, no attribution, no tracking. Researchers, journalists, lawyers and students use the tool to extract text from confidential reports knowing the source PDF is not retained beyond that window.

privacy

Ja. Open het Engine-paneel, kies de taal en OCR-engine van je document, en de pagina wordt in dat schrift gelezen — meer dan 100 talen worden ondersteund, inclusief niet-Latijnse en van rechts naar links geschreven talen. Leest de eerste poging tekens met accenten of niet-Engelse tekens verkeerd, wissel dan van taal en tik op Extractie opnieuw uitvoeren.

usage

De opgemaakte weergave behoudt de oorspronkelijke lay-out van de pagina — kolommen, witruimte en regelposities — wat handig is bij tabellen en bonnetjes. De platte weergave levert nette, opnieuw doorlopende tekst die makkelijker in een document of chatbot te plakken is. Wissel tussen beide en kopieer de tekst of download hem als .txt-bestand.

features

Deze tool geeft je de ruwe tekst om te kopiëren of als .txt op te slaan. Wil je liever de originele PDF behouden maar hem doorzoekbaar maken met Ctrl+F, haal hem dan door de tool Afbeelding naar doorzoekbare PDF — die legt een onzichtbare OCR-tekstlaag over de scan, zodat de pagina er identiek uitziet terwijl de woorden selecteerbaar worden.

tips

Begin met Standaard en de taal van je document voor veelvoorkomende talen met Latijns schrift — dat is snel en nauwkeurig voor alledaagse tekst. Als de uitvoer er verminkt uitziet of het schrift niet-Latijns is (Arabisch, Hindi, Chinees, Cyrillisch), schakel dan over naar Engine 1 of Engine 2, selecteer de bijbehorende taal in de kiezer en tik op Extractie opnieuw uitvoeren — verschillende engines zijn afgestemd op verschillende schriften, dus beide proberen kost maar seconden.

tips

Het uitvoervak is volledig bewerkbaar, zodat je snel een OCR-fout kunt opschonen of een gedeelte kunt inkorten, direct op het scherm. Naar klembord kopiëren kopieert altijd precies wat er op dat moment in het vak staat, inclusief bewerkingen — maar .txt downloaden slaat het oorspronkelijke bestand op dat door de laatste Engine/Taal-run is geproduceerd, niet je bewerkingen op het scherm. Om een correctie te behouden, gebruik je Kopiëren en plak je die in je eigen .txt-bestand, of als de fout systematisch is, wissel dan van Taal of Engine en tik op Extractie opnieuw uitvoeren in plaats van met de hand te bewerken.

features

Upload je PDF en laat de extractor de tekst eruit halen — OCR wordt automatisch uitgevoerd op gescande pagina's of pagina's die alleen afbeeldingen bevatten — en download het resultaat als platte .txt-bestand. Het bestand opent in Kladblok, TextEdit of elke code-editor, zonder speciale software. Zo gebruikt werkt het als een eenvoudige pdf-naar-kladblok-converter wanneer je alleen ruwe, direct te kopiëren tekst wilt zonder opmaak of afbeeldingen.

usage

Yes — you can convert PDF to text free to preview; create a free account to download required. The free tier includes a generous daily allowance and covers OCR on scanned PDFs, the Formatted and Plain views, and the .txt download. If you extract text from large batches of documents every day, upgrading removes the daily limits.

pricing

Ja – Pixoate ondersteunt batch- en bulkverwerking. Schakel over naar de batchmodus, voeg tot 60 PDF's toe op Premium of 200 op Pro, stel uw opties één keer in en elke PDF wordt met dezelfde instellingen verwerkt voordat u ook maar één ZIP downloadt. Bulkverwerking is een Premium-functie; de uitvoer gebruikt dezelfde kwaliteit en instellingen als de enkele modus.

features

Ja – bij bulkverwerking configureert u de instellingen één keer en ze zijn van toepassing op elk item in de batch – tot 60 PDF’s op Premium of 200 op Pro. Het is niet nodig om de instellingen per item te herhalen en tijdelijk geüploade en gegenereerde bestanden worden veilig verwerkt en automatisch verwijderd.

usage

Hoe PDF naar tekst je helpt de klus te klaren

Echte problemen die het elke dag oplost — voor bedrijven, makers en alledaagse taken. Vind de toepassing die bij je past en begin in seconden.

Opleiding

Extractie van college- en cursusnotities

Studenten halen platte tekst uit door professoren aangeleverde PDF-collegeaantekeningen en practicumhandleidingen, zodat ze fragmenten kunnen plakken in Notion, Obsidian en studiekaarten.

Persoonlijk gebruik

Cv-tekst voor bulkinzendingen

Werkzoekenden halen platte tekst uit hun PDF-cv om die te plakken in ATS-sollicitatieformulieren, LinkedIn Easy Apply en tekstvelden van recruiterportalen die geen bestandsuploads accepteren.

Voor bedrijven

E-mailconcepten uit PDF-rapporten

Analisten halen managementsamenvattingen uit lange PDF-rapporten om in e-mails, Slack-berichten en Teams-chats te plakken, zodat stakeholders de belangrijkste inzichten snel lezen.

Voor bedrijven

SEO-audit van bestaande PDF-bronnen

Marketeers halen tekst uit oude PDF-whitepapers en e-books om de zoekwoorddekking te controleren, contentgaten op te sporen en deze opnieuw te publiceren als verse blogposts voor organisch zoekverkeer.

Voor bedrijven

Voorbereiding van de vertaalworkflow

Vertalers extraheren tekst uit een PDF-bron voordat ze die plakken in vertaalgeheugentools als Trados, MemoQ of DeepL Pro voor snellere en nauwkeurigere lokalisatie.

Productiviteit

AI-prompts uit lange PDF-rapporten

Power users halen tekst uit PDF-onderzoeksrapporten en voeren die als context in ChatGPT, Claude of Gemini in voor samenvattingen, Q&A en het extraheren van kernpunten.

Voor bedrijven

Back-uparchieven in platte tekst

IT- en archiefteams halen platte tekst uit PDF-documentarchieven om lichte, toekomstbestendige back-ups te maken die over 20 jaar niet afhankelijk zijn van PDF-viewers.

Opleiding

Citaten- en literatuurlijsten

Onderzoekers halen bibliografiesecties uit PDF's als platte tekst, zodat ze die in Zotero, Mendeley of EndNote kunnen plakken zonder elke vermelding handmatig over te typen.

Persoonlijk gebruik

Toegang via schermlezer en tekst-naar-spraak

Haal schone tekst uit een PDF, zodat deze door schermlezers kan worden voorgelezen of in tekst-naar-spraak-apps kan worden geplakt — nuttig voor slechtziende lezers of om handsfree naar een lang rapport te luisteren.

Juridisch

Trefwoordzoekopdrachten voor juridische e-discovery

Juridisch medewerkers halen tekst uit gescande getuigenverklaringen en discovery-bundels, zodat de inhoud over duizenden pagina's doorzoekbaar wordt, in plaats van door PDF's met alleen afbeeldingen te scrollen op zoek naar een naam of clausule.

Voor ontwikkelaars

Datapijplijnen voor gescande facturen

Ontwikkelaars en ops-teams halen tekst uit gescande facturen en bonnen om regex- of LLM-gebaseerde parsers te voeden, waarmee ze bulkgegevensinvoer automatiseren in plaats van handmatig overtypen.

Onderzoek

FOIA- & gelekte-documentonderzoeken

Onderzoeksjournalisten extraheren tekst uit gescande overheidspublicaties en FOIA-documenten, zodat ze uitspraken kunnen doorzoeken, citeren en met elkaar vergelijken in grote documentdumps.