Ett realistiskt källdokument, följt av dokumentets faktiska tillstånd eller den utdatafil som ”PDF till text” skapar.
Efter
Före
PDF till text (OCR)

PDF till textkonverterare — Extrahera text från PDF gratis online

PDF:en är en skanning, så ingenting väljer, ingenting kopierar och sökning hittar ingenting. Extrahera texten från den ändå - PDF-filer med endast bild, 30+ språk.

  • Få text ur en skannad PDF där markering och kopiering inte gör något
  • Läser endast bild- och foto-av-dokument PDF-filer på 30+ språk
  • Ladda ner som TXT, Markdown, Word, Excel eller CSV

PDF

Ladda upp PDF

Släpp valfri PDF — kopiera texten eller ladda ner den som .txt

PDF · free up to 11MB, Premium up to 50MB

Vad du kan göra med PDF till text

Granska de viktigaste funktionerna innan du börjar.

  • Få ut text från en PDF där kopiera och klistra inte gör något
  • Hämta text ur skannade eller bildbaserade PDF:er
  • Kopiera innehåll från PDF-filer som blockerar markering
  • Läs text på ditt dokuments eget språk
  • Kör extraheringen igen för ett renare resultat
  • Få redigerbar text för anteckningar eller sökning

Inställningsreferens

Tillgängliga kontroller för PDF till text.

BearbetningslägeFörinställningar
Bearbeta en inmatning eller byt till Premiums batchläge för att bearbeta flera med samma inställningar. Vilka typer av inmatning som stöds beror på verktyget.Alternativ: Enskild filBunt

Motor

MotorRullgardinsmeny
Väljer vilken textigenkänningsmotor som läser din fil; byt till Motor 1 eller Motor 2 när Standard läser stiliserade typsnitt eller handstil fel — resultatet uppdateras automatiskt.Alternativ: StandardMotor 1Motor 2
SpråkRullgardinsmeny
Välj huvudspråket i källan. Tillgängliga språk beror på vald läsmotor och språk som inte stöds döljs. Engelska är standard. Kontrollera den extraherade texten efter igenkänningsfel.Alternativ: EngelskaFranskaTyskaspanskaItalienskaPortugisiskaNederländskaRyskaJapanskaKoreanskaKinesiska (förenklad)Kinesiska (traditionell)ArabiskahindiBengaliskaPunjabi-språkUrdu-språkvietnamesiskaThailändskaFinslipasvenskaDanskaNorskaFinskaturkiskaukrainskaIndonesiskaTamilskaTeluguspråkMarathinepalesiskaPersiskaGrekiskaHebreiska
Kör extraheringen igenEtt klick
Kör extraheringen igen på samma fil med aktuella val av Motor och Språk — praktiskt för att försöka igen efter ett svagt eller misslyckat försök.

Ladda ner

Ladda ner somRullgardinsmeny
Välj utdataformat efter textextrahering. Word- och kalkylbladsexporter skapar en fil från källan. CSV-export av PDF-tabeller innehåller en ZIP med en fil per tabell.Alternativ: Text (.txt)Markdown-dokument (.md)Word-dokument (.docx)Excel-kalkylblad (.xlsx)CSV (tabeller · .zip)
Gratis att använda · Ingen registrering krävs · Utan vattenstämpelUppladdningar krypteras under överföringBorttagen enligt vår lagringspolicy

Vanliga frågor

Ladda upp din PDF så känner verktyget av om den innehåller ett riktigt textlager eller bara skannade bilder. PDF:er med textlager exporteras direkt. PDF:er med endast bilder (skannade böcker, fotograferade kvitton, gamla rapporter) körs automatiskt genom OCR. Hur som helst får du en ren .txt-fil med stycken, radbrytningar och avsnittsavstånd bevarade.

usage

Ja. Om PDF:en endast består av bilder (vanligt för skanningar, fotograferade sidor eller faxexporter) startar OCR-motorn automatiskt — du behöver inget separat verktyg. Stöd för flera språk är inbyggt, så att även tvåspråkiga eller icke-latinska skriftspråk (kinesiska, arabiska, hindi) extraheras i samma genomgång.

features

Styckesbrytningar, tomma rader mellan avsnitt, punktmarkörer och prefix för numrerade listor bevaras som oformaterad text. Rubriker kommer fram i versaler eller med sin ursprungliga skiftläge beroende på källtypsnittet. Visuell betoning (fet, kursiv) kodas inte i oformaterad text – för det använder du i stället konverteraren PDF till Word.

technical

Ja. Ange lösenordet i rutan efter uppladdning, så låser verktyget upp filen i minnet precis tillräckligt länge för att extrahera texten. Lösenordet lagras aldrig på disk eller överförs till tredjepartstjänster. Låsta PDF:er utan lösenord kan inte bearbetas — av säkerhetsskäl utförs ingen lösenordsknäckning.

features

Både sidantal och filstorlek begränsas för att konverteringen ska vara tillförlitlig. Gratisplanen stöder upp till 30 sidor och 11 MB, Premium 200 sidor och 50 MB, Pro 500 sidor och 120 MB samt Enterprise 1000 sidor. Dela större dokument med verktyget Dela upp PDF och bearbeta varje del separat.

technical

Bearbetning sker på säkra servrar och filer tas bort enligt vår säkerhetspolicy - såvida du inte uttryckligen delar ett resultat, vilket håller det på en offentlig länk kan alla som har det öppna i upp till 30 dagar. .txt-utgången är din – ingen vattenstämpel, ingen attribution, ingen spårning. Forskare, journalister, advokater och studenter använder verktyget för att extrahera text från konfidentiella rapporter med vetskapen om att käll-PDF-filen inte sparas bortom det fönstret.

privacy

Ja. Öppna Motor-panelen, välj ditt dokuments språk och OCR-motor, så läses sidan i det skriftspråket — över 100 språk stöds, inklusive icke-latinska och högerläsande. Om den första genomgången felläser tecken med accenter eller icke-engelska tecken, byt språk och tryck på Kör om extraktion.

usage

Formaterad vy behåller sidans ursprungliga layout — kolumner, mellanrum och radpositioner — vilket hjälper med tabeller och kvitton. Enkel vy ger ren, omformaterad text som är lättare att klistra in i ett dokument eller en chattbot. Växla mellan dem och kopiera sedan texten eller ladda ner den som en .txt-fil.

features

Det här verktyget ger dig råtexten att kopiera eller spara som .txt. Om du hellre vill behålla original-PDF:en men göra den sökbar med Ctrl+F, kör den genom verktyget Bild till sökbar PDF — det lägger till ett osynligt OCR-textlager över skanningen så att sidan ser identisk ut medan orden blir markeringsbara.

tips

Börja med Standard och dokumentets språk för vanliga språk med latinsk skrift — det är snabbt och exakt för vardaglig text. Om resultatet ser förvanskat ut eller skriften är icke-latinsk (arabiska, hindi, kinesiska, kyrilliska), växla till Motor 1 eller Motor 2, välj matchande språk i väljaren och tryck på Kör extraktion igen — olika motorer är anpassade för olika skriftsystem, så att prova båda tar bara några sekunder.

tips

Utdatarutan är fullt redigerbar, så du kan snabbt städa upp ett OCR-fel eller trimma ett avsnitt direkt på skärmen. Kopiera till urklipp kopierar alltid exakt det som finns i rutan just nu, inklusive redigeringar — men Ladda ner .txt sparar den ursprungliga filen från den senaste motor-/språkkörningen, inte dina redigeringar på skärmen. För att behålla en rättelse, använd Kopiera och klistra in den i din egen .txt-fil, eller om felet är systematiskt, byt språk eller motor och tryck på Kör extraktion igen i stället för att redigera för hand.

features

Ladda upp din PDF och låt extraktorn hämta ut texten — OCR körs automatiskt på skannade sidor eller sidor med enbart bilder — ladda sedan ner resultatet som en vanlig .txt-fil. Filen öppnas i Anteckningar, TextEdit eller vilken kodredigerare som helst utan speciell programvara. Använt på det här sättet fungerar det som en enkel pdf-till-anteckningar-konverterare när du bara vill ha ren, kopieringsklar text utan formatering eller bilder.

usage

Ja — konvertera, förhandsgranska och ladda ner PDF-text utan att skapa ett konto. Den kostnadsfria ersättningen täcker OCR på skannade PDF-filer, formaterade och vanliga vyer och .txt-nedladdningen. Premium tar bort täckta dagliga gränser.

pricing

Ja — Pixoate stöder batch- och bulkbearbetning. Växla till batchläge, lägg till upp till 60 PDF-filer på Premium eller 200 på Pro, ställ in dina alternativ en gång, och varje PDF-fil bearbetas med samma inställningar innan du laddar ner en enda ZIP. Bulkbearbetning är en Premium-funktion; utgången använder samma kvalitet och inställningar som singelläge.

features

Ja – med massbearbetning konfigurerar du inställningarna en gång och de gäller för varje objekt i partiet – upp till 60 PDF-filer på Premium eller 200 på Pro. Det finns ingen anledning att upprepa inställningarna per objekt, och tillfälligt uppladdade och genererade filer bearbetas säkert och raderas automatiskt.

usage

Det beror nästan alltid på en av tre saker. Filen överskrider den kostnadsfria uppladdningsgränsen på 11 MB – Premium tillåter 50 MB och Pro 120 MB. Formatet kanske inte stöds av verktyget; kontrollera listan i uppladdningspanelen. Eller så har filen egentligen inte det format som filnamnet anger: att byta namn på en fil ändrar inte innehållet, och därför kan en PDF som ser giltig ut ändå nekas.

troubleshooting

En PDF-fil lagrar var varje tecken sitter på sidan, inte styckena och stilarna som en ordbehandlare arbetar i, så att konvertera innebär att man bygger om strukturen genom slutledning. Komplexa kolumner, tabeller och text lindad runt bilder är där det driver. Om utseendet betyder mer än redigerbarhet, välj det visuella läget; om du behöver skriva i det, välj det redigerbara läget och förvänta dig att fixa den udda rubriken.

troubleshooting

Nej. Du kan köra PDF till text och ladda ner det kostnadsfria resultatet utan ett konto, och det har ingen vattenstämpel. Premium är vad du köper när gränserna börjar bita: upp till 60 filer i en batch, större uppladdningar, inget dagligt tak och resultatet med originalupplösning. Ingenting avslöjas vid nedladdningssteget som inte var synligt innan du började.

pricing

Nej — PDF till text körs i webbläsaren på skrivbordet och telefonen. Det finns inget att installera, ingen testversion att starta och ingen licens att köpa innan du kan se om den gör vad du behöver. Prova det på filen du faktiskt har fastnat med snarare än ett prov.

troubleshooting

Så hjälper PDF till text dig att få det gjort

Verkliga problem den löser varje dag - för företag, kreatörer och vardagliga uppgifter. Hitta det användningsfall som passar dig och börja.

Utbildning

Extrahering av föreläsnings- och kursanteckningar

Studenter extraherar ren text från professorers PDF-föreläsningsanteckningar och labbmanualer så att de kan klistra in utdrag i Notion, Obsidian och studiekort.

Personligt bruk

CV-text för massutskick

Jobbsökande extraherar ren text från sitt PDF-CV för att klistra in i ATS-ansökningsformulär, LinkedIn Easy Apply och textfält i rekryteringsportaler som inte tar emot filuppladdningar.

För företag

E-postutkast från PDF-rapporter

Analytiker extraherar sammanfattningsavsnitt ur långa PDF-rapporter för att klistra in i e-post, Slack-meddelanden och Teams-chattar så att intressenter snabbt läser de viktigaste insikterna.

För företag

SEO-granskning av befintliga PDF-resurser

Marknadsförare extraherar text från gamla PDF-whitepapers och e-böcker för att granska sökordstäckning, identifiera innehållsluckor och återpublicera som färska blogginlägg för organisk sökning.

För företag

Förberedelse av översättningsarbetsflöde

Översättare extraherar text från en PDF-källa innan de klistrar in den i översättningsminnesverktyg som Trados, MemoQ eller DeepL Pro för snabbare och mer korrekt lokalisering.

Produktivitet

AI-prompter från långa PDF-rapporter

Avancerade användare extraherar text ur vetenskapliga PDF-artiklar och matar in den i ChatGPT, Claude eller Gemini som kontext för sammanfattningar, frågor och svar samt extrahering av nyckelpunkter.

För företag

Säkerhetskopior i ren text

IT- och arkivteam extraherar ren text från PDF-dokumentarkiv för att skapa lätta, framtidssäkra säkerhetskopior som inte är beroende av PDF-läsare om 20 år.

Utbildning

Käll- och referenslistor

Forskare extraherar litteraturförteckningar från PDF-filer till oformaterad text så att de kan klistra in dem i Zotero, Mendeley eller EndNote utan att manuellt skriva om varje post.

Personligt bruk

Åtkomst via skärmläsare och text-till-tal

Extrahera ren text från en PDF så att den kan läsas upp av skärmläsare eller klistras in i text-till-tal-appar — användbart för synskadade läsare eller för att lyssna på en lång rapport handsfree.

Rättslig

Nyckelordssökning för juridisk e-discovery

Paralegaler extraherar text från inskannade vittnesmål och bevismaterial så att innehållet blir sökbart över tusentals sidor, i stället för att skrolla genom PDF:er med enbart bilder på jakt efter ett namn eller en klausul.

För utvecklare

Dataflöden för skannade fakturor

Utvecklare och driftteam extraherar text från skannade fakturor och kvitton för att mata regex- eller LLM-baserade parsers och automatisera massdatainmatning i stället för manuell omskrivning.

Forskning

Utredningar av FOIA- och läckta dokument

Undersökande journalister extraherar text från inskannade myndighetsutgåvor och FOIA-dokument så att de kan söka, citera och korshänvisa påståenden över stora dokumentmängder.

Titta på varje transformationsland

Varje foto korsar snedstrecket orört och kommer ut på andra sidan färdigt.