PDF to Text (OCR)

Extract text from PDFs — free

Pull editable text out of any PDF with accurate OCR — even scanned, image-only or photo-of-document PDFs. Copy it or download as TXT, Markdown, Word, Excel or CSV.

  • Reads scanned & image-only PDFs in 30+ languages
  • Formatted or plain text — copy or download instantly
  • Private processing · Files deleted automatically

PDF · Secure processing

TXT
PDFTXT

Last opp PDF

Drop any PDF — copy its text or download it as .txt

PDF · free up to 20MB, Premium up to 50MB

What you can do with PDF til tekst

Everything this tool helps you accomplish — no learning curve, no setup.

  • Extract plain text from any PDF
  • Pull text out of scanned or image-only PDFs
  • Copy content from PDFs that block selection
  • Read text in your document's own language
  • Re-run extraction for a cleaner result
  • Get editable text for notes or search

Settings information

Every control in PDF til tekst, explained — what it does and when to use it.

Motor

MotorDropdown
Velger hvilken tekstgjenkjenningsmotor som leser filen din; bytt til Motor 1 eller Motor 2 når Standard leser stiliserte skrifter eller håndskrift feil — resultatet oppdateres automatisk.Alternativer: StandardMotor 1Motor 2
SpråkDropdown
Angir hvilket språk kildeteksten er skrevet på, slik at tegnene gjenkjennes nøyaktig. Den søkbare velgeren viser bare språkene den valgte motoren støtter, og står på engelsk som standard.Alternativer: EnglishFrenchGermanSpanishItalianPortugueseDutchRussianJapaneseKoreanChinese (Simplified)Chinese (Traditional)ArabicHindiBengaliPunjabiUrduVietnameseThaiPolishSwedishDanishNorwegianFinnishTurkishUkrainianIndonesianTamilTeluguMarathiNepaliPersianGreekHebrew
Kjør uttrekk på nyttOne-click
Kjører uttrekket på nytt på den samme filen med gjeldende valg for Motor og Språk — praktisk for å prøve igjen etter et svakt eller mislykket forsøk.
Uploads are encrypted in transitRemoved under our retention policy

Ofte stilte spørsmål

Last opp PDF-en din, så oppdager verktøyet om den inneholder et ekte tekstlag eller bare skannede bilder. PDF-er med tekstlag eksporteres umiddelbart. PDF-er med kun bilder (skannede bøker, fotograferte kvitteringer, gamle rapporter) kjøres automatisk gjennom OCR. Uansett får du en ren .txt-fil med bevarte avsnitt, linjeskift og seksjonsavstand.

usage

Ja. Hvis PDF-en bare inneholder bilder (vanlig for skanninger, fotograferte sider eller fakseksporter), starter OCR-motoren automatisk – du trenger ikke et eget verktøy. Flerspråklig støtte er innebygd, så selv tospråklige eller ikke-latinske skrifter (kinesisk, arabisk, hindi) hentes ut i samme operasjon.

features

Avsnittsskift, tomme linjer mellom seksjoner, punktmerker og prefikser for nummererte lister bevares som ren tekst. Overskrifter kommer ut i store bokstaver eller med sin opprinnelige bokstavstørrelse avhengig av kildefonten. Visuell utheving (fet, kursiv) lagres ikke i ren tekst – bruk konvertereren PDF til Word for det i stedet.

technical

Ja. Skriv inn passordet i ledeteksten etter opplasting, så låser verktøyet opp filen i minnet akkurat lenge nok til å hente ut teksten. Passordet lagres aldri på disk eller overføres til tredjepartstjenester. Låste PDF-er uten passordet kan ikke behandles – av sikkerhetshensyn utføres ingen passordknekking.

features

Filer kan være opptil 20 MB gratis, 50 MB med Premium eller 120 MB med Pro, og 500 sider behandles uten problemer. Større dokumenter fungerer også, men tar lengre tid - et 2000-siders juridisk arkiv kan ta noen minutter for OCR. For store jobber, del opp PDF-en først med PDF Split-verktøyet og behandle hver del separat.

technical

Processing happens on secure servers and files are deleted within 24 hours — unless you explicitly share a result, which keeps it at a public link anyone who has it can open for up to 30 days. The .txt output is yours — no watermark, no attribution, no tracking. Researchers, journalists, lawyers and students use the tool to extract text from confidential reports knowing the source PDF is not retained beyond that window.

privacy

Ja. Åpne Motor-panelet, velg dokumentets språk og OCR-motor, så leses siden i det skriftsystemet – over 100 språk støttes, inkludert ikke-latinske og høyre-til-venstre-språk. Hvis det første forsøket feiltolker tegn med aksent eller ikke-engelske tegn, bytt språk og trykk Kjør utdraget på nytt.

usage

Formatert visning beholder sidens opprinnelige layout — kolonner, mellomrom og linjeplassering — noe som hjelper med tabeller og kvitteringer. Ren visning gir oversiktlig, omflytt tekst som er enklere å lime inn i et dokument eller en chatbot. Veksle mellom dem, og kopier deretter teksten eller last den ned som en .txt-fil.

features

Dette verktøyet gir deg rådataen til å kopiere eller lagre som .txt. Hvis du heller vil beholde den opprinnelige PDF-en, men gjøre den søkbar med Ctrl+F, kjør den gjennom Bilde til søkbar PDF-verktøyet – det legger til et usynlig OCR-tekstlag over skanningen, slik at siden ser identisk ut samtidig som ordene blir merkbare.

tips

Start med Standard og dokumentets språk for vanlige språk med latinsk skrift — det er raskt og nøyaktig for hverdagstekst. Hvis resultatet ser forvrengt ut eller skriften er ikke-latinsk (arabisk, hindi, kinesisk, kyrillisk), bytt til Motor 1 eller Motor 2, velg det tilsvarende språket fra velgeren, og trykk Kjør uttrekk på nytt — ulike motorer er tilpasset ulike skrifter, så det tar bare sekunder å prøve begge.

tips

Utdataboksen kan redigeres fritt, så du kan raskt rette en OCR-feil eller kutte en del rett på skjermen. Kopier til utklippstavle kopierer alltid nøyaktig det som ligger i boksen nå, inkludert redigeringer – men Last ned .txt lagrer originalfilen fra siste kjøring av Motor/Språk, ikke redigeringene på skjermen. For å beholde en rettelse, bruk Kopier og lim den inn i din egen .txt-fil, eller hvis feilen er systematisk, bytt Språk eller Motor og trykk Kjør uttrekk på nytt i stedet for å redigere for hånd.

features

Last opp PDF-filen din, og la ekstraheringsverktøyet hente ut teksten — OCR kjøres automatisk på skannede sider eller sider som bare inneholder bilder — og last deretter ned resultatet som en ren .txt-fil. Filen åpnes i Notisblokk, TextEdit eller en hvilken som helst kodeeditor uten behov for spesiell programvare. Brukt på denne måten fungerer det som en enkel pdf-til-notisblokk-konverter når du bare vil ha rå, kopieringsklar tekst uten formatering eller bilder.

usage

Yes — you can convert PDF to text free to preview; create a free account to download required. The free tier includes a generous daily allowance and covers OCR on scanned PDFs, the Formatted and Plain views, and the .txt download. If you extract text from large batches of documents every day, upgrading removes the daily limits.

pricing

Ja — Pixoate støtter batch- og bulkbehandling. Bytt til batch-modus, legg til opptil 60 PDF-filer på Premium eller 200 på Pro, angi alternativene én gang, og hver PDF behandles med de samme innstillingene før du laster ned en enkelt ZIP. Massebehandling er en Premium-funksjon; utgangen bruker samme kvalitet og innstillinger som enkeltmodus.

features

Ja – med massebehandling konfigurerer du innstillingene én gang, og de gjelder for hvert element i partiet – opptil 60 PDF-filer på Premium eller 200 på Pro. Det er ikke nødvendig å gjenta oppsettet per element, og midlertidige opplastede og genererte filer behandles sikkert og slettes automatisk.

usage

Slik hjelper PDF til tekst deg med å få jobben gjort

Ekte problemer det løser hver dag — for bedrifter, skapere og dagligdagse oppgaver. Finn bruksområdet som passer deg, og kom i gang på sekunder.

Utdanning

Uttrekk av forelesnings- og kursnotater

Studenter henter ren tekst fra forelesningsnotater og laboratoriemanualer i PDF levert av professoren, slik at de kan lime inn utdrag i Notion, Obsidian og studiekort.

Personlig bruk

CV-tekst for masseinnsendinger

Jobbsøkere henter ut ren tekst fra PDF-CV-en for å lime den inn i ATS-søknadsskjemaer, LinkedIn Easy Apply og tekstfelter i rekrutteringsportaler som ikke godtar filopplasting.

For bedrifter

E-postutkast fra PDF-rapporter

Analytikere henter ut sammendragsseksjoner fra lange PDF-rapporter for å lime dem inn i e-poster, Slack-meldinger og Teams-chatter slik at interessenter raskt får med seg de viktigste innsiktene.

For bedrifter

SEO-revisjon av eksisterende PDF-ressurser

Markedsførere henter ut tekst fra gamle PDF-whitepapers og e-bøker for å vurdere søkeordsdekning, identifisere innholdshull og publisere på nytt som ferske blogginnlegg for organisk søk.

For bedrifter

Klargjøring av oversettelsesarbeidsflyt

Oversettere henter ut tekst fra en PDF-kilde før de limer den inn i oversettelsesminneverktøy som Trados, MemoQ eller DeepL Pro for raskere og mer nøyaktig lokalisering.

Produktivitet

AI-prompter fra lange PDF-rapporter

Erfarne brukere henter ut tekst fra PDF-forskningsartikler og mater den inn i ChatGPT, Claude eller Gemini som kontekst for sammendrag, spørsmål og svar samt uthenting av nøkkelpunkter.

For bedrifter

Sikkerhetskopiarkiver i ren tekst

IT- og arkivteam henter ut ren tekst fra PDF-dokumentarkiver for å lage lette, fremtidssikre sikkerhetskopier som ikke er avhengige av PDF-lesere om 20 år.

Utdanning

Kilde- og referanselister

Forskere trekker ut litteraturlistedeler fra PDF-er til ren tekst slik at de kan lime dem inn i Zotero, Mendeley eller EndNote uten å skrive inn hver oppføring manuelt på nytt.

Personlig bruk

Tilgang med skjermleser og tekst-til-tale

Hent ut ren tekst fra en PDF slik at den kan leses høyt av skjermlesere eller limes inn i tekst-til-tale-apper — nyttig for synshemmede lesere eller for å lytte til en lang rapport håndfritt.

Juridisk

Nøkkelordsøk for juridisk e-oppdaging

Advokatassistenter henter ut tekst fra skannede vitneforklaringer og bevisbunter, slik at innholdet blir søkbart på tvers av tusenvis av sider, i stedet for å bla gjennom rene bilde-PDF-er på jakt etter et navn eller en klausul.

For utviklere

Datapipelines for skannede fakturaer

Utviklere og driftsteam trekker ut tekst fra skannede fakturaer og kvitteringer for å mate regex- eller LLM-baserte parsere, og automatiserer masseregistrering av data i stedet for manuell inntasting.

Forskning

FOIA- og lekket-dokument-undersøkelser

Undersøkende journalister trekker ut tekst fra skannede offentlige utgivelser og innsynsdokumenter slik at de kan søke i, sitere og kryssreferere påstander på tvers av store dokumentmengder.