

PDF-tekstimuunnin – Pura teksti PDF-tiedostosta ilmaiseksi verkossa
PDF on skannaus, joten mikään ei valitse, mikään ei kopioi ja haku ei löydä mitään. Pura teksti siitä joka tapauksessa – mukana vain kuvalliset PDF-tiedostot, yli 30 kieltä.
- Hae tekstiä skannatusta PDF-tiedostosta, jossa valinta ja kopiointi eivät tee mitään
- Lukee vain kuva- ja valokuva-pdf-tiedostoja yli 30 kielellä
- Lataa TXT-, Markdown-, Word-, Excel- tai CSV-muodossa
Lähetä PDF
Pudota mikä tahansa PDF – kopioi sen teksti tai lataa se .txt-tiedostona
PDF · free up to 11MB, Premium up to 50MB
Mitä voit tehdä sovelluksella PDF tekstiksi
Tarkista tärkeimmät ominaisuudet ennen kuin aloitat.
- Hae tekstiä PDF-tiedostosta, jossa kopioiminen ja liittäminen ei tee mitään
- Vedä teksti ulos skannatuista tai vain kuvia sisältävistä PDF-tiedostoista
- Kopioi sisältöä PDF-tiedostoista, jotka estävät valinnan
- Lue tekstiä asiakirjasi omalla kielellä
- Suorita uutto uudelleen puhtaamman tuloksen saamiseksi
- Hanki muokattava teksti muistiinpanoja tai hakua varten
Asetusten viite
5-asetukset
Käytettävissä olevat ohjaimet kohteelle PDF tekstiksi.
- KäsittelytilaEsiasetukset
- Käsittele yksi syöte tai siirry Premiumin erätilaan käsittelemään useita syötteitä samoilla asetuksilla. Käytettävissä olevat syötetyypit riippuvat työkalusta.Asetukset: Yksittäinen tiedostoErä
Moottori
- MoottoriPudotusvalikko
- Valitsee, mikä tekstintunnistusmoottori lukee tiedostosi; vaihda Moottoriin 1 tai Moottoriin 2, jos Oletus tulkitsee koristeelliset fontit tai käsialan väärin — tulos päivittyy automaattisesti.Asetukset: OletusMoottori 1Moottori 2
- KieliPudotusvalikko
- Valitse lähteen pääkieli. Vaihtoehdot riippuvat valitusta tunnistusmoottorista. Kielet, joita ei tueta, piilotetaan. Englanti on oletus. Tarkista poimittu teksti tunnistusvirheiden varalta.Asetukset: englantiranskalainensaksaksiespanjaitalialainenportugalihollantilainenvenäjäksijapanilainenkorealainenkiina (yksinkertaistettu)kiina (perinteinen)arabiahindibengaliPandžabiurduvietnamilainenthaimaalainenpuolalainenruotsinkielinentanskalainennorjalainensuomalainenturkkilainenukrainalainenIndonesialainentamilitelugumarathiNepalipersialainenkreikkalainenheprea
- Suorita poiminta uudelleenYksi napsautus
- Suorittaa poiminnan uudelleen samalle tiedostolle nykyisillä Moottori- ja Kieli-valinnoilla – kätevä uuteen yritykseen heikon tai epäonnistuneen ajon jälkeen.
Lataa
- Lataa muodossaPudotusvalikko
- Valitse tulostyyppi tekstin poiminnan jälkeen. Word- ja laskentataulukkoviennit valmistelevat tiedoston lähteestä. PDF-taulukoiden CSV-vienti sisältää ZIP-paketin, jossa on yksi tiedosto taulukkoa kohti.Asetukset: Teksti (.txt)Markdown-tiedosto (.md)Word-asiakirja (.docx)Excel-taulukko (.xlsx)CSV-taulukot (.zip)
Aiheeseen liittyvät työkalut kohteelle PDF tekstiksi
Työkalut yleisiä seuraavia vaiheita varten PDF tekstiksi jälkeen.
PDF ja asiakirjat
PDF Wordiksi
Rakenna tuettu sisältö uudelleen muokattavaksi DOCX:ksi tai sijoita jokainen sivu Wordiin kuvana visuaalisen uskollisuuden vuoksi.
Kokeile nytPDF ja asiakirjat
PDF HTML:ksi
Säilytä PDF-sivut visuaalisesti ehjinä yhdessä HTML-tiedostossa tai rakenna tuettu sisältö uudelleen semanttiseksi HTML:ksi OCR:n avulla.
Kokeile nytOCR ja tiedonpoiminta
Kuvasta tekstiksi (OCR)
Poimi muokattava teksti kuvakaappauksesta, valokuvasta tai skannauksesta yli 30 tuetulla kielellä.
Kokeile nytUsein kysytyt kysymykset
Lähetä PDF-tiedostosi, niin työkalu tunnistaa, sisältääkö se oikean tekstitason vai pelkkiä skannattuja kuvia. Tekstitason PDF-tiedostot viedään heti. Pelkät kuva-PDF-tiedostot (skannatut kirjat, valokuvatut kuitit, vanhat raportit) kulkevat OCR:n läpi automaattisesti. Joka tapauksessa saat siistin .txt-tiedoston, jossa kappaleet, rivinvaihdot ja osioiden välistys säilyvät.
usageKyllä. Jos PDF on pelkästään kuvapohjainen (yleistä skannauksissa, valokuvatuissa sivuissa tai faksivienneissä), OCR-moottori käynnistyy automaattisesti – et tarvitse erillistä työkalua. Monikielinen tuki on sisäänrakennettu, joten myös kaksikieliset tai ei-latinalaiset kirjoitukset (kiina, arabia, hindi) poimitaan samalla kierroksella.
featuresKappalevaihdot, osioiden väliset tyhjät rivit, luettelomerkit ja numeroitujen luetteloiden etuliitteet säilyvät pelkkänä tekstinä. Otsikot tulevat läpi joko isoin kirjaimin tai alkuperäisellä kirjainkoollaan lähdefontista riippuen. Visuaalista korostusta (lihavointi, kursivointi) ei koodata pelkkään tekstiin – käytä siihen PDF Wordiksi -muunninta.
technicalKyllä. Syötä salasana kehotteeseen lataamisen jälkeen, niin työkalu avaa tiedoston muistissa juuri sen verran, että teksti saadaan poimittua. Salasanaa ei koskaan tallenneta levylle eikä välitetä kolmansien osapuolten palveluihin. Lukittuja PDF-tiedostoja ilman salasanaa ei voi käsitellä – turvallisuussyistä salasanojen murtamista ei suoriteta.
featuresSekä sivumäärää että tiedostokokoa rajoitetaan muunnoksen luotettavuuden varmistamiseksi. Ilmainen tilaus tukee enintään 30 sivua ja 11 MB, Premium 200 sivua ja 50 MB, Pro 500 sivua ja 120 MB sekä Enterprise 1000 sivua. Jaa suuret asiakirjat PDF Split -työkalulla ja käsittele kukin osa erikseen.
technicalKäsittely tapahtuu suojatuilla palvelimilla, ja tiedostot poistetaan tietoturvakäytäntömme mukaisesti – ellet jaa tulosta erikseen, jolloin tulos pysyy julkisessa linkissä, joka voi avata sen 30 päivää. .txt-tulostus on sinun – ei vesileimaa, ei merkintää, ei seurantaa. Tutkijat, toimittajat, lakimiehet ja opiskelijat käyttävät työkalua tekstin poimimiseen luottamuksellisista raporteista tietäen, että lähde-PDF-tiedostoa ei säilytetä tämän ikkunan jälkeen.
privacyKyllä. Avaa Moottori-paneeli, valitse asiakirjasi kieli ja OCR-moottori, ja sivu luetaan kyseisellä kirjoitusjärjestelmällä — yli 100 kieltä tuetaan, mukaan lukien ei-latinalaiset ja oikealta vasemmalle kirjoitettavat. Jos ensimmäinen käsittelykerta lukee väärin tarkkeelliset tai muut kuin englanninkieliset merkit, vaihda kieltä ja napauta Suorita tunnistus uudelleen.
usageMuotoiltu näkymä säilyttää sivun alkuperäisen asettelun — sarakkeet, välistyksen ja rivien sijainnit — mikä auttaa taulukoiden ja kuittien kanssa. Pelkkä teksti -näkymä tuottaa siistiä, uudelleen muotoiltua tekstiä, joka on helpompi liittää asiakirjaan tai chatbotiin. Vaihda näkymien välillä ja kopioi teksti tai lataa se .txt-tiedostona.
featuresTämä työkalu antaa sinulle raakatekstin kopioitavaksi tai tallennettavaksi .txt-tiedostona. Jos haluat mieluummin säilyttää alkuperäisen PDF:n mutta tehdä siitä Ctrl+F-haettavan, aja se Kuva haettavaksi PDF:ksi -työkalun läpi — se lisää näkymättömän OCR-tekstikerroksen skannauksen päälle, joten sivu näyttää samalta, mutta sanat tulevat valittaviksi.
tipsAloita Oletus-asetuksella ja asiakirjasi kielellä yleisten latinalaisiin kirjaimiin perustuvien kielten kohdalla — se on nopea ja tarkka jokapäiväiselle tekstille. Jos tulos näyttää sekavalta tai kirjoitus ei ole latinalaista (arabia, hindi, kiina, kyrillinen), vaihda Moottori 1:een tai Moottori 2:een, valitse vastaava kieli valitsimesta ja napauta Suorita tunnistus uudelleen — eri moottorit on viritetty eri kirjoitusjärjestelmille, joten molempien kokeileminen vie vain sekunteja.
tipsTulostuslaatikko on täysin muokattava, joten voit nopeasti siivota OCR-virheen tai leikata osan suoraan näytöllä. Kopioi leikepöydälle kopioi aina tarkalleen sen, mikä laatikossa parhaillaan on, muokkaukset mukaan lukien — mutta Lataa .txt tallentaa viimeisen Moottori/Kieli-ajon tuottaman alkuperäisen tiedoston, ei näytöllä tehtyjä muokkauksia. Säilyttääksesi korjauksen käytä Kopioi-toimintoa ja liitä se omaan .txt-tiedostoosi, tai jos virhe on järjestelmällinen, vaihda Kieli tai Moottori ja napauta Suorita tunnistus uudelleen käsin muokkaamisen sijaan.
featuresLataa PDF-tiedostosi ja anna erotustyökalun poimia teksti — tekstintunnistus (OCR) käynnistyy automaattisesti skannatuilla tai pelkkiä kuvia sisältävillä sivuilla — ja lataa sitten tulos pelkkänä .txt-tiedostona. Tiedosto avautuu Muistiossa, TextEditissä tai missä tahansa koodieditorissa ilman erityistä ohjelmistoa. Näin käytettynä se toimii yksinkertaisena pdf-muistio-muuntimena, kun haluat vain raakaa, kopiointivalmista tekstiä ilman muotoilua tai kuvia.
usageKyllä – muunna, esikatsele ja lataa PDF-teksti luomatta tiliä. Ilmainen korvaus kattaa skannattujen PDF-tiedostojen tekstintunnistusta, muotoiltuja ja tavallisia näkymiä sekä .txt-latauksen. Premium poistaa katetut päivärajat.
pricingKyllä — Pixoate tukee erä- ja joukkokäsittelyä. Vaihda erätilaan, lisää jopa 60 PDF-tiedostoa Premiumissa tai 200 Prossa, aseta asetukset kerran, ja jokainen PDF käsitellään samoilla asetuksilla ennen kuin lataat yhden ZIP-tiedoston. Joukkokäsittely on Premium-ominaisuus; lähtö käyttää samaa laatua ja asetuksia kuin yksitila.
featuresKyllä – joukkokäsittelyssä määrität asetukset kerran, ja ne koskevat kaikkia erän kohteita – jopa 60 PDF-tiedostoa Premiumissa tai 200 Prossa. Kohdekohtaista asetusta ei tarvitse toistaa, ja väliaikaisesti ladatut ja luodut tiedostot käsitellään turvallisesti ja poistetaan automaattisesti.
usageSyynä on lähes aina jokin kolmesta asiasta. Tiedosto ylittää ilmaisen lähetyksen 11 MB:n rajan — Premium hyväksyy enintään 50 MB ja Pro 120 MB. Työkalu ei ehkä tue tiedostomuotoa, joten tarkista lähetyspaneelissa näkyvä luettelo. Tiedoston todellinen muoto ei myöskään välttämättä vastaa sen nimeä: tiedoston nimeäminen uudelleen ei muuta sen sisältöä, minkä vuoksi kelvolliselta näyttävä PDF voidaan hylätä.
troubleshootingPDF tallentaa sivun jokaisen merkin sijaintipaikan, ei tekstinkäsittelyohjelman käyttämiä kappaleita ja tyylejä, joten muuntaminen tarkoittaa rakenteen uudelleen rakentamista päättelyn avulla. Monimutkaiset sarakkeet, taulukot ja kuvien ympärille kääritty teksti ovat siellä, missä se ajautuu. Jos ulkonäkö on tärkeämpää kuin muokattavuus, valitse visuaalinen tila; Jos sinun on kirjoitettava siihen, valitse muokattava tila ja odota parittoman otsikon korjaamista.
troubleshootingEi. Voit suorittaa PDF-tiedoston tekstiksi ja ladata ilmaisen tuloksen ilman tiliä, eikä siinä ole vesileimaa. Premium on mitä ostat, kun rajat alkavat purra: jopa 60 tiedostoa yhdessä erässä, suuremmat lataukset, ei päivittäistä enimmäismäärää ja alkuperäisen resoluution tulos. Latausvaiheessa ei paljasteta mitään, mikä ei ollut näkyvissä ennen aloittamista.
pricingEi. PDF kohteeksi Text toimii selaimessa tietokoneella ja puhelimella. Mitään ei tarvitse asentaa, kokeilua aloittaa tai lisenssiä ostaa ennen kuin näet, sopiiko se tarpeeseesi. Kokeile sitä omalla ongelmatiedostollasi esimerkin sijaan.
troubleshootingMiten PDF tekstiksi auttaa sinua saamaan sen tehtyä
Se ratkaisee todellisia ongelmia joka päivä – yrityksille, sisällöntuottajille ja jokapäiväisille tehtäville. Etsi itsellesi sopiva käyttötapa ja aloita.
Luento- ja kurssimuistiinpanojen poiminta
Opiskelijat poimivat pelkän tekstin professorin toimittamista PDF-luentomuistiinpanoista ja laboratorio-oppaista, jotta he voivat liittää otteita Notioniin, Obsidianiin ja kertauskortteihin.
Ansioluettelon teksti joukkolähetyksiin
Työnhakijat poimivat PDF-ansioluettelostaan pelkän tekstin liittääkseen sen ATS-hakulomakkeisiin, LinkedIn Easy Apply -hakuihin ja rekrytointiportaalien tekstikenttiin, jotka eivät hyväksy tiedostojen lataamista.
Sähköpostiluonnokset PDF-raporteista
Analyytikot poimivat tiivistelmäosiot pitkistä PDF-raporteista liitettäväksi sähköposteihin, Slack-viesteihin ja Teams-keskusteluihin, jotta sidosryhmät lukevat keskeiset havainnot nopeasti.
Olemassa olevien PDF-resurssien SEO-auditointi
Markkinoijat poimivat tekstiä vanhoista PDF-julkaisuista ja e-kirjoista tarkastaakseen avainsanojen kattavuuden, tunnistaakseen sisältöaukot ja julkaistakseen sisällön uudelleen tuoreina blogikirjoituksina orgaanista hakua varten.
Käännöstyönkulun valmistelu
Kääntäjät poimivat tekstin PDF-lähteestä ennen sen liittämistä käännösmuistityökaluihin, kuten Trados, MemoQ tai DeepL Pro, nopeampaa ja tarkempaa lokalisointia varten.
Tekoälykehotteet pitkistä PDF-raporteista
Tehokäyttäjät poimivat tekstiä PDF-tutkimusartikkeleista ja syöttävät sen ChatGPT:lle, Claudelle tai Geminille kontekstiksi tiivistelmiä, kysymyksiä ja keskeisten kohtien poimintaa varten.
Pelkkätekstiset varmuuskopioarkistot
IT- ja arkistotiimit poimivat pelkän tekstin PDF-dokumenttiarkistoista luodakseen kevyitä, tulevaisuudenkestäviä varmuuskopioita, jotka eivät ole riippuvaisia PDF-katseluohjelmista 20 vuoden kuluttua.
Lähde- ja viiteluettelot
Tutkijat poimivat PDF-tiedostojen lähdeluettelo-osiot tekstimuotoon, jotta he voivat liittää ne Zoteroon, Mendeleyhin tai EndNoteen kirjoittamatta jokaista viitettä uudelleen käsin.
Ruudunlukija- ja tekstistä puheeksi -käyttö
Poimi puhdas teksti PDF:stä, jotta ruudunlukuohjelmat voivat lukea sen ääneen tai sen voi liittää tekstistä puheeksi -sovelluksiin — hyödyllinen näkövammaisille lukijoille tai pitkän raportin kuuntelemiseen kädet vapaana.
Juridisen sähköisen todisteiden haun avainsanahaku
Lakiavustajat poimivat tekstiä skannatuista lausunnoista ja todisteaineistoista, jotta sisällöstä tulee haettavaa tuhansien sivujen läpi – sen sijaan että selaisivat pelkkiä kuva-PDF:iä etsien nimeä tai lauseketta.
Skannattujen laskujen dataputket
Kehittäjät ja käyttötiimit poimivat tekstiä skannatuista laskuista ja kuiteista syöttääkseen sen regex- tai LLM-pohjaisiin jäsentimiin, automatisoiden massatietojen syötön manuaalisen uudelleenkirjoituksen sijaan.
FOIA- ja vuodettujen asiakirjojen tutkinnat
Tutkivat journalistit poimivat tekstiä skannatuista viranomaisjulkaisuista ja FOIA-asiakirjoista, jotta he voivat hakea, siteerata ja ristiviitata väitteitä suurissa asiakirjakokonaisuuksissa.
Tämän työkalun oppaat
- PDF Word-muotoon: mikä muunnin todella säilyttää muotoilun?Useimmat PDF–Word-muuntimet rikkovat taulukot, sotkevat fontit tai jättävät kuvat kokonaan pois. Katso, millainen on hyvä muunnin, miksi skannatut PDF-tiedostot tarvitsevat OCR:n ja miten eri PDF-tyyppejä käsitellään.
- How to Extract Invoice Numbers, Due Dates and Totals from ImagesExtract invoice numbers, due dates and totals from images with Pixoate. Define useful fields and review the results before updating business records.
Katso jokainen muunnos valmiina
Every kuva crosses slash untouched ja comes out other side finished.


























