PDF to Text (OCR)

Extract text from PDFs — free

Pull editable text out of any PDF with accurate OCR — even scanned, image-only or photo-of-document PDFs. Copy it or download as TXT, Markdown, Word, Excel or CSV.

  • Reads scanned & image-only PDFs in 30+ languages
  • Formatted or plain text — copy or download instantly
  • Private processing · Files deleted automatically

PDF · Secure processing

TXT
PDFTXT

Lähetä PDF

Drop any PDF — copy its text or download it as .txt

PDF · free up to 20MB, Premium up to 50MB

What you can do with PDF tekstiksi

Everything this tool helps you accomplish — no learning curve, no setup.

  • Extract plain text from any PDF
  • Pull text out of scanned or image-only PDFs
  • Copy content from PDFs that block selection
  • Read text in your document's own language
  • Re-run extraction for a cleaner result
  • Get editable text for notes or search

Settings information

Every control in PDF tekstiksi, explained — what it does and when to use it.

Moottori

MoottoriDropdown
Valitsee, mikä tekstintunnistusmoottori lukee tiedostosi; vaihda Moottoriin 1 tai Moottoriin 2, jos Oletus tulkitsee koristeelliset fontit tai käsialan väärin — tulos päivittyy automaattisesti.Asetukset: OletusMoottori 1Moottori 2
KieliDropdown
Määrittää kielen, jolla lähdeteksti on kirjoitettu, jotta merkit tunnistetaan tarkasti. Haettava valitsin näyttää vain valitun tunnistusmoottorin tukemat kielet, ja oletuksena on englanti.Asetukset: EnglishFrenchGermanSpanishItalianPortugueseDutchRussianJapaneseKoreanChinese (Simplified)Chinese (Traditional)ArabicHindiBengaliPunjabiUrduVietnameseThaiPolishSwedishDanishNorwegianFinnishTurkishUkrainianIndonesianTamilTeluguMarathiNepaliPersianGreekHebrew
Suorita poiminta uudelleenOne-click
Suorittaa poiminnan uudelleen samalle tiedostolle nykyisillä Moottori- ja Kieli-valinnoilla – kätevä uuteen yritykseen heikon tai epäonnistuneen ajon jälkeen.
Uploads are encrypted in transitRemoved under our retention policy

Usein kysytyt kysymykset

Lähetä PDF-tiedostosi, niin työkalu tunnistaa, sisältääkö se oikean tekstitason vai pelkkiä skannattuja kuvia. Tekstitason PDF-tiedostot viedään heti. Pelkät kuva-PDF-tiedostot (skannatut kirjat, valokuvatut kuitit, vanhat raportit) kulkevat OCR:n läpi automaattisesti. Joka tapauksessa saat siistin .txt-tiedoston, jossa kappaleet, rivinvaihdot ja osioiden välistys säilyvät.

usage

Kyllä. Jos PDF on pelkästään kuvapohjainen (yleistä skannauksissa, valokuvatuissa sivuissa tai faksivienneissä), OCR-moottori käynnistyy automaattisesti – et tarvitse erillistä työkalua. Monikielinen tuki on sisäänrakennettu, joten myös kaksikieliset tai ei-latinalaiset kirjoitukset (kiina, arabia, hindi) poimitaan samalla kierroksella.

features

Kappalevaihdot, osioiden väliset tyhjät rivit, luettelomerkit ja numeroitujen luetteloiden etuliitteet säilyvät pelkkänä tekstinä. Otsikot tulevat läpi joko isoin kirjaimin tai alkuperäisellä kirjainkoollaan lähdefontista riippuen. Visuaalista korostusta (lihavointi, kursivointi) ei koodata pelkkään tekstiin – käytä siihen PDF Wordiksi -muunninta.

technical

Kyllä. Syötä salasana kehotteeseen lataamisen jälkeen, niin työkalu avaa tiedoston muistissa juuri sen verran, että teksti saadaan poimittua. Salasanaa ei koskaan tallenneta levylle eikä välitetä kolmansien osapuolten palveluihin. Lukittuja PDF-tiedostoja ilman salasanaa ei voi käsitellä – turvallisuussyistä salasanojen murtamista ei suoriteta.

features

Tiedostot voivat olla jopa 20 Mt ilmaisversiossa, 50 Mt Premiumissa tai 120 Mt Prossa, ja 500 sivua voidaan käsitellä ilman ongelmia. Myös suuremmat asiakirjat toimivat, mutta vievät kauemmin – 2000-sivuinen lakiarkiston tekstintunnistus voi kestää muutaman minuutin. Suuria töitä varten jaa PDF ensin PDF Split -työkalulla ja käsittele jokainen kappale erikseen.

technical

Processing happens on secure servers and files are deleted within 24 hours — unless you explicitly share a result, which keeps it at a public link anyone who has it can open for up to 30 days. The .txt output is yours — no watermark, no attribution, no tracking. Researchers, journalists, lawyers and students use the tool to extract text from confidential reports knowing the source PDF is not retained beyond that window.

privacy

Kyllä. Avaa Moottori-paneeli, valitse asiakirjasi kieli ja OCR-moottori, ja sivu luetaan kyseisellä kirjoitusjärjestelmällä — yli 100 kieltä tuetaan, mukaan lukien ei-latinalaiset ja oikealta vasemmalle kirjoitettavat. Jos ensimmäinen käsittelykerta lukee väärin tarkkeelliset tai muut kuin englanninkieliset merkit, vaihda kieltä ja napauta Suorita tunnistus uudelleen.

usage

Muotoiltu näkymä säilyttää sivun alkuperäisen asettelun — sarakkeet, välistyksen ja rivien sijainnit — mikä auttaa taulukoiden ja kuittien kanssa. Pelkkä teksti -näkymä tuottaa siistiä, uudelleen muotoiltua tekstiä, joka on helpompi liittää asiakirjaan tai chatbotiin. Vaihda näkymien välillä ja kopioi teksti tai lataa se .txt-tiedostona.

features

Tämä työkalu antaa sinulle raakatekstin kopioitavaksi tai tallennettavaksi .txt-tiedostona. Jos haluat mieluummin säilyttää alkuperäisen PDF:n mutta tehdä siitä Ctrl+F-haettavan, aja se Kuva haettavaksi PDF:ksi -työkalun läpi — se lisää näkymättömän OCR-tekstikerroksen skannauksen päälle, joten sivu näyttää samalta, mutta sanat tulevat valittaviksi.

tips

Aloita Oletus-asetuksella ja asiakirjasi kielellä yleisten latinalaisiin kirjaimiin perustuvien kielten kohdalla — se on nopea ja tarkka jokapäiväiselle tekstille. Jos tulos näyttää sekavalta tai kirjoitus ei ole latinalaista (arabia, hindi, kiina, kyrillinen), vaihda Moottori 1:een tai Moottori 2:een, valitse vastaava kieli valitsimesta ja napauta Suorita tunnistus uudelleen — eri moottorit on viritetty eri kirjoitusjärjestelmille, joten molempien kokeileminen vie vain sekunteja.

tips

Tulostuslaatikko on täysin muokattava, joten voit nopeasti siivota OCR-virheen tai leikata osan suoraan näytöllä. Kopioi leikepöydälle kopioi aina tarkalleen sen, mikä laatikossa parhaillaan on, muokkaukset mukaan lukien — mutta Lataa .txt tallentaa viimeisen Moottori/Kieli-ajon tuottaman alkuperäisen tiedoston, ei näytöllä tehtyjä muokkauksia. Säilyttääksesi korjauksen käytä Kopioi-toimintoa ja liitä se omaan .txt-tiedostoosi, tai jos virhe on järjestelmällinen, vaihda Kieli tai Moottori ja napauta Suorita tunnistus uudelleen käsin muokkaamisen sijaan.

features

Lataa PDF-tiedostosi ja anna erotustyökalun poimia teksti — tekstintunnistus (OCR) käynnistyy automaattisesti skannatuilla tai pelkkiä kuvia sisältävillä sivuilla — ja lataa sitten tulos pelkkänä .txt-tiedostona. Tiedosto avautuu Muistiossa, TextEditissä tai missä tahansa koodieditorissa ilman erityistä ohjelmistoa. Näin käytettynä se toimii yksinkertaisena pdf-muistio-muuntimena, kun haluat vain raakaa, kopiointivalmista tekstiä ilman muotoilua tai kuvia.

usage

Yes — you can convert PDF to text free to preview; create a free account to download required. The free tier includes a generous daily allowance and covers OCR on scanned PDFs, the Formatted and Plain views, and the .txt download. If you extract text from large batches of documents every day, upgrading removes the daily limits.

pricing

Kyllä — Pixoate tukee erä- ja joukkokäsittelyä. Vaihda erätilaan, lisää jopa 60 PDF-tiedostoa Premiumissa tai 200 Prossa, aseta asetukset kerran, ja jokainen PDF käsitellään samoilla asetuksilla ennen kuin lataat yhden ZIP-tiedoston. Joukkokäsittely on Premium-ominaisuus; lähtö käyttää samaa laatua ja asetuksia kuin yksitila.

features

Kyllä – joukkokäsittelyssä määrität asetukset kerran, ja ne koskevat kaikkia erän kohteita – jopa 60 PDF-tiedostoa Premiumissa tai 200 Prossa. Kohdekohtaista asetusta ei tarvitse toistaa, ja väliaikaisesti ladatut ja luodut tiedostot käsitellään turvallisesti ja poistetaan automaattisesti.

usage

Miten PDF tekstiksi auttaa sinua saamaan sen tehtyä

Todelliset ongelmat, jotka se ratkaisee joka päivä — yrityksille, tekijöille ja arkisiin tehtäviin. Löydä sinulle sopiva käyttötapa ja aloita sekunneissa.

Koulutus

Luento- ja kurssimuistiinpanojen poiminta

Opiskelijat poimivat pelkän tekstin professorin toimittamista PDF-luentomuistiinpanoista ja laboratorio-oppaista, jotta he voivat liittää otteita Notioniin, Obsidianiin ja kertauskortteihin.

Henkilökohtainen käyttö

Ansioluettelon teksti joukkolähetyksiin

Työnhakijat poimivat PDF-ansioluettelostaan pelkän tekstin liittääkseen sen ATS-hakulomakkeisiin, LinkedIn Easy Apply -hakuihin ja rekrytointiportaalien tekstikenttiin, jotka eivät hyväksy tiedostojen lataamista.

Yrityksille

Sähköpostiluonnokset PDF-raporteista

Analyytikot poimivat tiivistelmäosiot pitkistä PDF-raporteista liitettäväksi sähköposteihin, Slack-viesteihin ja Teams-keskusteluihin, jotta sidosryhmät lukevat keskeiset havainnot nopeasti.

Yrityksille

Olemassa olevien PDF-resurssien SEO-auditointi

Markkinoijat poimivat tekstiä vanhoista PDF-julkaisuista ja e-kirjoista tarkastaakseen avainsanojen kattavuuden, tunnistaakseen sisältöaukot ja julkaistakseen sisällön uudelleen tuoreina blogikirjoituksina orgaanista hakua varten.

Yrityksille

Käännöstyönkulun valmistelu

Kääntäjät poimivat tekstin PDF-lähteestä ennen sen liittämistä käännösmuistityökaluihin, kuten Trados, MemoQ tai DeepL Pro, nopeampaa ja tarkempaa lokalisointia varten.

Tuottavuus

Tekoälykehotteet pitkistä PDF-raporteista

Tehokäyttäjät poimivat tekstiä PDF-tutkimusartikkeleista ja syöttävät sen ChatGPT:lle, Claudelle tai Geminille kontekstiksi tiivistelmiä, kysymyksiä ja keskeisten kohtien poimintaa varten.

Yrityksille

Pelkkätekstiset varmuuskopioarkistot

IT- ja arkistotiimit poimivat pelkän tekstin PDF-dokumenttiarkistoista luodakseen kevyitä, tulevaisuudenkestäviä varmuuskopioita, jotka eivät ole riippuvaisia PDF-katseluohjelmista 20 vuoden kuluttua.

Koulutus

Lähde- ja viiteluettelot

Tutkijat poimivat PDF-tiedostojen lähdeluettelo-osiot tekstimuotoon, jotta he voivat liittää ne Zoteroon, Mendeleyhin tai EndNoteen kirjoittamatta jokaista viitettä uudelleen käsin.

Henkilökohtainen käyttö

Ruudunlukija- ja tekstistä puheeksi -käyttö

Poimi puhdas teksti PDF:stä, jotta ruudunlukuohjelmat voivat lukea sen ääneen tai sen voi liittää tekstistä puheeksi -sovelluksiin — hyödyllinen näkövammaisille lukijoille tai pitkän raportin kuuntelemiseen kädet vapaana.

Oikeudelliset tiedot

Juridisen sähköisen todisteiden haun avainsanahaku

Lakiavustajat poimivat tekstiä skannatuista lausunnoista ja todisteaineistoista, jotta sisällöstä tulee haettavaa tuhansien sivujen läpi – sen sijaan että selaisivat pelkkiä kuva-PDF:iä etsien nimeä tai lauseketta.

Kehittäjille

Skannattujen laskujen dataputket

Kehittäjät ja käyttötiimit poimivat tekstiä skannatuista laskuista ja kuiteista syöttääkseen sen regex- tai LLM-pohjaisiin jäsentimiin, automatisoiden massatietojen syötön manuaalisen uudelleenkirjoituksen sijaan.

Tutkimus

FOIA- ja vuodettujen asiakirjojen tutkinnat

Tutkivat journalistit poimivat tekstiä skannatuista viranomaisjulkaisuista ja FOIA-asiakirjoista, jotta he voivat hakea, siteerata ja ristiviitata väitteitä suurissa asiakirjakokonaisuuksissa.