PDF to Text (OCR)

Extract text from PDFs — free

Pull editable text out of any PDF with accurate OCR — even scanned, image-only or photo-of-document PDFs. Copy it or download as TXT, Markdown, Word, Excel or CSV.

  • Reads scanned & image-only PDFs in 30+ languages
  • Formatted or plain text — copy or download instantly
  • Private processing · Files deleted automatically

PDF · Secure processing

TXT
PDFTXT

Ladda upp PDF

Drop any PDF — copy its text or download it as .txt

PDF · free up to 20MB, Premium up to 50MB

What you can do with PDF till text

Everything this tool helps you accomplish — no learning curve, no setup.

  • Extract plain text from any PDF
  • Pull text out of scanned or image-only PDFs
  • Copy content from PDFs that block selection
  • Read text in your document's own language
  • Re-run extraction for a cleaner result
  • Get editable text for notes or search

Settings information

Every control in PDF till text, explained — what it does and when to use it.

Motor

MotorDropdown
Väljer vilken textigenkänningsmotor som läser din fil; byt till Motor 1 eller Motor 2 när Standard läser stiliserade typsnitt eller handstil fel — resultatet uppdateras automatiskt.Alternativ: StandardMotor 1Motor 2
SpråkDropdown
Anger vilket språk källtexten är skriven på så att tecknen känns igen korrekt. Den sökbara väljaren visar bara de språk som den valda motorn stöder, med engelska som standard.Alternativ: EnglishFrenchGermanSpanishItalianPortugueseDutchRussianJapaneseKoreanChinese (Simplified)Chinese (Traditional)ArabicHindiBengaliPunjabiUrduVietnameseThaiPolishSwedishDanishNorwegianFinnishTurkishUkrainianIndonesianTamilTeluguMarathiNepaliPersianGreekHebrew
Kör extraheringen igenOne-click
Kör extraheringen igen på samma fil med aktuella val av Motor och Språk — praktiskt för att försöka igen efter ett svagt eller misslyckat försök.
Uploads are encrypted in transitRemoved under our retention policy

Vanliga frågor

Ladda upp din PDF så känner verktyget av om den innehåller ett riktigt textlager eller bara skannade bilder. PDF:er med textlager exporteras direkt. PDF:er med endast bilder (skannade böcker, fotograferade kvitton, gamla rapporter) körs automatiskt genom OCR. Hur som helst får du en ren .txt-fil med stycken, radbrytningar och avsnittsavstånd bevarade.

usage

Ja. Om PDF:en endast består av bilder (vanligt för skanningar, fotograferade sidor eller faxexporter) startar OCR-motorn automatiskt — du behöver inget separat verktyg. Stöd för flera språk är inbyggt, så att även tvåspråkiga eller icke-latinska skriftspråk (kinesiska, arabiska, hindi) extraheras i samma genomgång.

features

Styckesbrytningar, tomma rader mellan avsnitt, punktmarkörer och prefix för numrerade listor bevaras som oformaterad text. Rubriker kommer fram i versaler eller med sin ursprungliga skiftläge beroende på källtypsnittet. Visuell betoning (fet, kursiv) kodas inte i oformaterad text – för det använder du i stället konverteraren PDF till Word.

technical

Ja. Ange lösenordet i rutan efter uppladdning, så låser verktyget upp filen i minnet precis tillräckligt länge för att extrahera texten. Lösenordet lagras aldrig på disk eller överförs till tredjepartstjänster. Låsta PDF:er utan lösenord kan inte bearbetas — av säkerhetsskäl utförs ingen lösenordsknäckning.

features

Filer kan vara upp till 20 MB gratis, 50 MB med Premium eller 120 MB med Pro och 500 sidor bearbetas utan problem. Större dokument fungerar också men tar längre tid – ett 2000-sidigt juridiskt arkiv kan ta några minuter för OCR. För stora jobb, dela PDF-filen först med PDF Split-verktyget och bearbeta varje bit separat.

technical

Processing happens on secure servers and files are deleted within 24 hours — unless you explicitly share a result, which keeps it at a public link anyone who has it can open for up to 30 days. The .txt output is yours — no watermark, no attribution, no tracking. Researchers, journalists, lawyers and students use the tool to extract text from confidential reports knowing the source PDF is not retained beyond that window.

privacy

Ja. Öppna Motor-panelen, välj ditt dokuments språk och OCR-motor, så läses sidan i det skriftspråket — över 100 språk stöds, inklusive icke-latinska och högerläsande. Om den första genomgången felläser tecken med accenter eller icke-engelska tecken, byt språk och tryck på Kör om extraktion.

usage

Formaterad vy behåller sidans ursprungliga layout — kolumner, mellanrum och radpositioner — vilket hjälper med tabeller och kvitton. Enkel vy ger ren, omformaterad text som är lättare att klistra in i ett dokument eller en chattbot. Växla mellan dem och kopiera sedan texten eller ladda ner den som en .txt-fil.

features

Det här verktyget ger dig råtexten att kopiera eller spara som .txt. Om du hellre vill behålla original-PDF:en men göra den sökbar med Ctrl+F, kör den genom verktyget Bild till sökbar PDF — det lägger till ett osynligt OCR-textlager över skanningen så att sidan ser identisk ut medan orden blir markeringsbara.

tips

Börja med Standard och dokumentets språk för vanliga språk med latinsk skrift — det är snabbt och exakt för vardaglig text. Om resultatet ser förvanskat ut eller skriften är icke-latinsk (arabiska, hindi, kinesiska, kyrilliska), växla till Motor 1 eller Motor 2, välj matchande språk i väljaren och tryck på Kör extraktion igen — olika motorer är anpassade för olika skriftsystem, så att prova båda tar bara några sekunder.

tips

Utdatarutan är fullt redigerbar, så du kan snabbt städa upp ett OCR-fel eller trimma ett avsnitt direkt på skärmen. Kopiera till urklipp kopierar alltid exakt det som finns i rutan just nu, inklusive redigeringar — men Ladda ner .txt sparar den ursprungliga filen från den senaste motor-/språkkörningen, inte dina redigeringar på skärmen. För att behålla en rättelse, använd Kopiera och klistra in den i din egen .txt-fil, eller om felet är systematiskt, byt språk eller motor och tryck på Kör extraktion igen i stället för att redigera för hand.

features

Ladda upp din PDF och låt extraktorn hämta ut texten — OCR körs automatiskt på skannade sidor eller sidor med enbart bilder — ladda sedan ner resultatet som en vanlig .txt-fil. Filen öppnas i Anteckningar, TextEdit eller vilken kodredigerare som helst utan speciell programvara. Använt på det här sättet fungerar det som en enkel pdf-till-anteckningar-konverterare när du bara vill ha ren, kopieringsklar text utan formatering eller bilder.

usage

Yes — you can convert PDF to text free to preview; create a free account to download required. The free tier includes a generous daily allowance and covers OCR on scanned PDFs, the Formatted and Plain views, and the .txt download. If you extract text from large batches of documents every day, upgrading removes the daily limits.

pricing

Ja — Pixoate stöder batch- och bulkbearbetning. Växla till batchläge, lägg till upp till 60 PDF-filer på Premium eller 200 på Pro, ställ in dina alternativ en gång, och varje PDF-fil bearbetas med samma inställningar innan du laddar ner en enda ZIP. Bulkbearbetning är en Premium-funktion; utgången använder samma kvalitet och inställningar som singelläge.

features

Ja – med massbearbetning konfigurerar du inställningarna en gång och de gäller för varje objekt i partiet – upp till 60 PDF-filer på Premium eller 200 på Pro. Det finns ingen anledning att upprepa inställningarna per objekt, och tillfälligt uppladdade och genererade filer bearbetas säkert och raderas automatiskt.

usage

Så hjälper PDF till text dig att få det gjort

Verkliga problem det löser varje dag — för företag, kreatörer och vardagliga uppgifter. Hitta användningsfallet som passar dig och kom igång på några sekunder.

Utbildning

Extrahering av föreläsnings- och kursanteckningar

Studenter extraherar ren text från professorers PDF-föreläsningsanteckningar och labbmanualer så att de kan klistra in utdrag i Notion, Obsidian och studiekort.

Personligt bruk

CV-text för massutskick

Jobbsökande extraherar ren text från sitt PDF-CV för att klistra in i ATS-ansökningsformulär, LinkedIn Easy Apply och textfält i rekryteringsportaler som inte tar emot filuppladdningar.

För företag

E-postutkast från PDF-rapporter

Analytiker extraherar sammanfattningsavsnitt ur långa PDF-rapporter för att klistra in i e-post, Slack-meddelanden och Teams-chattar så att intressenter snabbt läser de viktigaste insikterna.

För företag

SEO-granskning av befintliga PDF-resurser

Marknadsförare extraherar text från gamla PDF-whitepapers och e-böcker för att granska sökordstäckning, identifiera innehållsluckor och återpublicera som färska blogginlägg för organisk sökning.

För företag

Förberedelse av översättningsarbetsflöde

Översättare extraherar text från en PDF-källa innan de klistrar in den i översättningsminnesverktyg som Trados, MemoQ eller DeepL Pro för snabbare och mer korrekt lokalisering.

Produktivitet

AI-prompter från långa PDF-rapporter

Avancerade användare extraherar text ur vetenskapliga PDF-artiklar och matar in den i ChatGPT, Claude eller Gemini som kontext för sammanfattningar, frågor och svar samt extrahering av nyckelpunkter.

För företag

Säkerhetskopior i ren text

IT- och arkivteam extraherar ren text från PDF-dokumentarkiv för att skapa lätta, framtidssäkra säkerhetskopior som inte är beroende av PDF-läsare om 20 år.

Utbildning

Käll- och referenslistor

Forskare extraherar litteraturförteckningar från PDF-filer till oformaterad text så att de kan klistra in dem i Zotero, Mendeley eller EndNote utan att manuellt skriva om varje post.

Personligt bruk

Åtkomst via skärmläsare och text-till-tal

Extrahera ren text från en PDF så att den kan läsas upp av skärmläsare eller klistras in i text-till-tal-appar — användbart för synskadade läsare eller för att lyssna på en lång rapport handsfree.

Juridik

Nyckelordssökning för juridisk e-discovery

Paralegaler extraherar text från inskannade vittnesmål och bevismaterial så att innehållet blir sökbart över tusentals sidor, i stället för att skrolla genom PDF:er med enbart bilder på jakt efter ett namn eller en klausul.

För utvecklare

Dataflöden för skannade fakturor

Utvecklare och driftteam extraherar text från skannade fakturor och kvitton för att mata regex- eller LLM-baserade parsers och automatisera massdatainmatning i stället för manuell omskrivning.

Forskning

Utredningar av FOIA- och läckta dokument

Undersökande journalister extraherar text från inskannade myndighetsutgåvor och FOIA-dokument så att de kan söka, citera och korshänvisa påståenden över stora dokumentmängder.