Extract text from PDFs — free
Pull editable text out of any PDF with accurate OCR — even scanned, image-only or photo-of-document PDFs. Copy it or download as TXT, Markdown, Word, Excel or CSV.
- Reads scanned & image-only PDFs in 30+ languages
- Formatted or plain text — copy or download instantly
- Private processing · Files deleted automatically
PDF · Secure processing
Lähetä PDF
Drop any PDF — copy its text or download it as .txt
PDF · free up to 20MB, Premium up to 50MB
What you can do with PDF tekstiksi
Everything this tool helps you accomplish — no learning curve, no setup.
- Extract plain text from any PDF
- Pull text out of scanned or image-only PDFs
- Copy content from PDFs that block selection
- Read text in your document's own language
- Re-run extraction for a cleaner result
- Get editable text for notes or search
Settings information
3 settings
Every control in PDF tekstiksi, explained — what it does and when to use it.
Moottori
- MoottoriDropdown
- Valitsee, mikä tekstintunnistusmoottori lukee tiedostosi; vaihda Moottoriin 1 tai Moottoriin 2, jos Oletus tulkitsee koristeelliset fontit tai käsialan väärin — tulos päivittyy automaattisesti.Asetukset: OletusMoottori 1Moottori 2
- KieliDropdown
- Määrittää kielen, jolla lähdeteksti on kirjoitettu, jotta merkit tunnistetaan tarkasti. Haettava valitsin näyttää vain valitun tunnistusmoottorin tukemat kielet, ja oletuksena on englanti.Asetukset: EnglishFrenchGermanSpanishItalianPortugueseDutchRussianJapaneseKoreanChinese (Simplified)Chinese (Traditional)ArabicHindiBengaliPunjabiUrduVietnameseThaiPolishSwedishDanishNorwegianFinnishTurkishUkrainianIndonesianTamilTeluguMarathiNepaliPersianGreekHebrew
- Suorita poiminta uudelleenOne-click
- Suorittaa poiminnan uudelleen samalle tiedostolle nykyisillä Moottori- ja Kieli-valinnoilla – kätevä uuteen yritykseen heikon tai epäonnistuneen ajon jälkeen.
Valmis työkalun PDF tekstiksi kanssa? Kokeile näitä seuraavaksi
Käsin valitut työkalut, jotka sopivat hyvin työkalun PDF tekstiksi kanssa. Jatka menettämättä tiedostoasi.
PDF Wordiksi
Stop retyping locked PDFs. Get a clean .docx with fonts, tables and layout preserved that opens in Word, Pages or Google Docs — ready in seconds. Free to start, no credit card.
Kokeile nytPDF HTML:ksi
Get semantic HTML with real table markup you can paste straight into your site or CMS — works on scanned PDFs too, done in seconds. Free to start, no credit card.
Kokeile nytKuvasta tekstiksi (OCR)
Stop retyping screenshots and scans. Upload any image and get clean, editable text in 30+ languages — ready to copy in seconds. Free to start.
Kokeile nytYhdistä PDF
Stop emailing five attachments. Drop your PDFs, drag them into order, and download a single merged file in seconds. Free to start, no watermark, files auto-deleted.
Kokeile nytPakkaa PDF
Rejected by an upload limit or bounced by email? Pick a quality preset and get a much smaller PDF in seconds — same document, lighter file. Free to start, no watermark.
Kokeile nytSanalaskuri
Essay limits and character caps sneak up on you. Paste or type to see words, characters, sentences, paragraphs and reading time update live. Free to use and copy — no account needed.
Kokeile nytUsein kysytyt kysymykset
Lähetä PDF-tiedostosi, niin työkalu tunnistaa, sisältääkö se oikean tekstitason vai pelkkiä skannattuja kuvia. Tekstitason PDF-tiedostot viedään heti. Pelkät kuva-PDF-tiedostot (skannatut kirjat, valokuvatut kuitit, vanhat raportit) kulkevat OCR:n läpi automaattisesti. Joka tapauksessa saat siistin .txt-tiedoston, jossa kappaleet, rivinvaihdot ja osioiden välistys säilyvät.
usageKyllä. Jos PDF on pelkästään kuvapohjainen (yleistä skannauksissa, valokuvatuissa sivuissa tai faksivienneissä), OCR-moottori käynnistyy automaattisesti – et tarvitse erillistä työkalua. Monikielinen tuki on sisäänrakennettu, joten myös kaksikieliset tai ei-latinalaiset kirjoitukset (kiina, arabia, hindi) poimitaan samalla kierroksella.
featuresKappalevaihdot, osioiden väliset tyhjät rivit, luettelomerkit ja numeroitujen luetteloiden etuliitteet säilyvät pelkkänä tekstinä. Otsikot tulevat läpi joko isoin kirjaimin tai alkuperäisellä kirjainkoollaan lähdefontista riippuen. Visuaalista korostusta (lihavointi, kursivointi) ei koodata pelkkään tekstiin – käytä siihen PDF Wordiksi -muunninta.
technicalKyllä. Syötä salasana kehotteeseen lataamisen jälkeen, niin työkalu avaa tiedoston muistissa juuri sen verran, että teksti saadaan poimittua. Salasanaa ei koskaan tallenneta levylle eikä välitetä kolmansien osapuolten palveluihin. Lukittuja PDF-tiedostoja ilman salasanaa ei voi käsitellä – turvallisuussyistä salasanojen murtamista ei suoriteta.
featuresTiedostot voivat olla jopa 20 Mt ilmaisversiossa, 50 Mt Premiumissa tai 120 Mt Prossa, ja 500 sivua voidaan käsitellä ilman ongelmia. Myös suuremmat asiakirjat toimivat, mutta vievät kauemmin – 2000-sivuinen lakiarkiston tekstintunnistus voi kestää muutaman minuutin. Suuria töitä varten jaa PDF ensin PDF Split -työkalulla ja käsittele jokainen kappale erikseen.
technicalProcessing happens on secure servers and files are deleted within 24 hours — unless you explicitly share a result, which keeps it at a public link anyone who has it can open for up to 30 days. The .txt output is yours — no watermark, no attribution, no tracking. Researchers, journalists, lawyers and students use the tool to extract text from confidential reports knowing the source PDF is not retained beyond that window.
privacyKyllä. Avaa Moottori-paneeli, valitse asiakirjasi kieli ja OCR-moottori, ja sivu luetaan kyseisellä kirjoitusjärjestelmällä — yli 100 kieltä tuetaan, mukaan lukien ei-latinalaiset ja oikealta vasemmalle kirjoitettavat. Jos ensimmäinen käsittelykerta lukee väärin tarkkeelliset tai muut kuin englanninkieliset merkit, vaihda kieltä ja napauta Suorita tunnistus uudelleen.
usageMuotoiltu näkymä säilyttää sivun alkuperäisen asettelun — sarakkeet, välistyksen ja rivien sijainnit — mikä auttaa taulukoiden ja kuittien kanssa. Pelkkä teksti -näkymä tuottaa siistiä, uudelleen muotoiltua tekstiä, joka on helpompi liittää asiakirjaan tai chatbotiin. Vaihda näkymien välillä ja kopioi teksti tai lataa se .txt-tiedostona.
featuresTämä työkalu antaa sinulle raakatekstin kopioitavaksi tai tallennettavaksi .txt-tiedostona. Jos haluat mieluummin säilyttää alkuperäisen PDF:n mutta tehdä siitä Ctrl+F-haettavan, aja se Kuva haettavaksi PDF:ksi -työkalun läpi — se lisää näkymättömän OCR-tekstikerroksen skannauksen päälle, joten sivu näyttää samalta, mutta sanat tulevat valittaviksi.
tipsAloita Oletus-asetuksella ja asiakirjasi kielellä yleisten latinalaisiin kirjaimiin perustuvien kielten kohdalla — se on nopea ja tarkka jokapäiväiselle tekstille. Jos tulos näyttää sekavalta tai kirjoitus ei ole latinalaista (arabia, hindi, kiina, kyrillinen), vaihda Moottori 1:een tai Moottori 2:een, valitse vastaava kieli valitsimesta ja napauta Suorita tunnistus uudelleen — eri moottorit on viritetty eri kirjoitusjärjestelmille, joten molempien kokeileminen vie vain sekunteja.
tipsTulostuslaatikko on täysin muokattava, joten voit nopeasti siivota OCR-virheen tai leikata osan suoraan näytöllä. Kopioi leikepöydälle kopioi aina tarkalleen sen, mikä laatikossa parhaillaan on, muokkaukset mukaan lukien — mutta Lataa .txt tallentaa viimeisen Moottori/Kieli-ajon tuottaman alkuperäisen tiedoston, ei näytöllä tehtyjä muokkauksia. Säilyttääksesi korjauksen käytä Kopioi-toimintoa ja liitä se omaan .txt-tiedostoosi, tai jos virhe on järjestelmällinen, vaihda Kieli tai Moottori ja napauta Suorita tunnistus uudelleen käsin muokkaamisen sijaan.
featuresLataa PDF-tiedostosi ja anna erotustyökalun poimia teksti — tekstintunnistus (OCR) käynnistyy automaattisesti skannatuilla tai pelkkiä kuvia sisältävillä sivuilla — ja lataa sitten tulos pelkkänä .txt-tiedostona. Tiedosto avautuu Muistiossa, TextEditissä tai missä tahansa koodieditorissa ilman erityistä ohjelmistoa. Näin käytettynä se toimii yksinkertaisena pdf-muistio-muuntimena, kun haluat vain raakaa, kopiointivalmista tekstiä ilman muotoilua tai kuvia.
usageYes — you can convert PDF to text free to preview; create a free account to download required. The free tier includes a generous daily allowance and covers OCR on scanned PDFs, the Formatted and Plain views, and the .txt download. If you extract text from large batches of documents every day, upgrading removes the daily limits.
pricingKyllä — Pixoate tukee erä- ja joukkokäsittelyä. Vaihda erätilaan, lisää jopa 60 PDF-tiedostoa Premiumissa tai 200 Prossa, aseta asetukset kerran, ja jokainen PDF käsitellään samoilla asetuksilla ennen kuin lataat yhden ZIP-tiedoston. Joukkokäsittely on Premium-ominaisuus; lähtö käyttää samaa laatua ja asetuksia kuin yksitila.
featuresKyllä – joukkokäsittelyssä määrität asetukset kerran, ja ne koskevat kaikkia erän kohteita – jopa 60 PDF-tiedostoa Premiumissa tai 200 Prossa. Kohdekohtaista asetusta ei tarvitse toistaa, ja väliaikaisesti ladatut ja luodut tiedostot käsitellään turvallisesti ja poistetaan automaattisesti.
usageMiten PDF tekstiksi auttaa sinua saamaan sen tehtyä
Todelliset ongelmat, jotka se ratkaisee joka päivä — yrityksille, tekijöille ja arkisiin tehtäviin. Löydä sinulle sopiva käyttötapa ja aloita sekunneissa.
Luento- ja kurssimuistiinpanojen poiminta
Opiskelijat poimivat pelkän tekstin professorin toimittamista PDF-luentomuistiinpanoista ja laboratorio-oppaista, jotta he voivat liittää otteita Notioniin, Obsidianiin ja kertauskortteihin.
Ansioluettelon teksti joukkolähetyksiin
Työnhakijat poimivat PDF-ansioluettelostaan pelkän tekstin liittääkseen sen ATS-hakulomakkeisiin, LinkedIn Easy Apply -hakuihin ja rekrytointiportaalien tekstikenttiin, jotka eivät hyväksy tiedostojen lataamista.
Sähköpostiluonnokset PDF-raporteista
Analyytikot poimivat tiivistelmäosiot pitkistä PDF-raporteista liitettäväksi sähköposteihin, Slack-viesteihin ja Teams-keskusteluihin, jotta sidosryhmät lukevat keskeiset havainnot nopeasti.
Olemassa olevien PDF-resurssien SEO-auditointi
Markkinoijat poimivat tekstiä vanhoista PDF-julkaisuista ja e-kirjoista tarkastaakseen avainsanojen kattavuuden, tunnistaakseen sisältöaukot ja julkaistakseen sisällön uudelleen tuoreina blogikirjoituksina orgaanista hakua varten.
Käännöstyönkulun valmistelu
Kääntäjät poimivat tekstin PDF-lähteestä ennen sen liittämistä käännösmuistityökaluihin, kuten Trados, MemoQ tai DeepL Pro, nopeampaa ja tarkempaa lokalisointia varten.
Tekoälykehotteet pitkistä PDF-raporteista
Tehokäyttäjät poimivat tekstiä PDF-tutkimusartikkeleista ja syöttävät sen ChatGPT:lle, Claudelle tai Geminille kontekstiksi tiivistelmiä, kysymyksiä ja keskeisten kohtien poimintaa varten.
Pelkkätekstiset varmuuskopioarkistot
IT- ja arkistotiimit poimivat pelkän tekstin PDF-dokumenttiarkistoista luodakseen kevyitä, tulevaisuudenkestäviä varmuuskopioita, jotka eivät ole riippuvaisia PDF-katseluohjelmista 20 vuoden kuluttua.
Lähde- ja viiteluettelot
Tutkijat poimivat PDF-tiedostojen lähdeluettelo-osiot tekstimuotoon, jotta he voivat liittää ne Zoteroon, Mendeleyhin tai EndNoteen kirjoittamatta jokaista viitettä uudelleen käsin.
Ruudunlukija- ja tekstistä puheeksi -käyttö
Poimi puhdas teksti PDF:stä, jotta ruudunlukuohjelmat voivat lukea sen ääneen tai sen voi liittää tekstistä puheeksi -sovelluksiin — hyödyllinen näkövammaisille lukijoille tai pitkän raportin kuuntelemiseen kädet vapaana.
Juridisen sähköisen todisteiden haun avainsanahaku
Lakiavustajat poimivat tekstiä skannatuista lausunnoista ja todisteaineistoista, jotta sisällöstä tulee haettavaa tuhansien sivujen läpi – sen sijaan että selaisivat pelkkiä kuva-PDF:iä etsien nimeä tai lauseketta.
Skannattujen laskujen dataputket
Kehittäjät ja käyttötiimit poimivat tekstiä skannatuista laskuista ja kuiteista syöttääkseen sen regex- tai LLM-pohjaisiin jäsentimiin, automatisoiden massatietojen syötön manuaalisen uudelleenkirjoituksen sijaan.
FOIA- ja vuodettujen asiakirjojen tutkinnat
Tutkivat journalistit poimivat tekstiä skannatuista viranomaisjulkaisuista ja FOIA-asiakirjoista, jotta he voivat hakea, siteerata ja ristiviitata väitteitä suurissa asiakirjakokonaisuuksissa.
