Todentuntuinen lähdeasiakirja ja sen jälkeen asiakirjan todellinen tila tai tulostiedosto toiminnon ”PDF tekstiksi” jälkeen.
Jälkeen
Ennen
PDF tekstiksi (OCR)

PDF-tekstimuunnin – Pura teksti PDF-tiedostosta ilmaiseksi verkossa

PDF on skannaus, joten mikään ei valitse, mikään ei kopioi ja haku ei löydä mitään. Pura teksti siitä joka tapauksessa – mukana vain kuvalliset PDF-tiedostot, yli 30 kieltä.

  • Hae tekstiä skannatusta PDF-tiedostosta, jossa valinta ja kopiointi eivät tee mitään
  • Lukee vain kuva- ja valokuva-pdf-tiedostoja yli 30 kielellä
  • Lataa TXT-, Markdown-, Word-, Excel- tai CSV-muodossa

PDF

Lähetä PDF

Pudota mikä tahansa PDF – kopioi sen teksti tai lataa se .txt-tiedostona

PDF · free up to 11MB, Premium up to 50MB

Mitä voit tehdä sovelluksella PDF tekstiksi

Tarkista tärkeimmät ominaisuudet ennen kuin aloitat.

  • Hae tekstiä PDF-tiedostosta, jossa kopioiminen ja liittäminen ei tee mitään
  • Vedä teksti ulos skannatuista tai vain kuvia sisältävistä PDF-tiedostoista
  • Kopioi sisältöä PDF-tiedostoista, jotka estävät valinnan
  • Lue tekstiä asiakirjasi omalla kielellä
  • Suorita uutto uudelleen puhtaamman tuloksen saamiseksi
  • Hanki muokattava teksti muistiinpanoja tai hakua varten

Asetusten viite

Käytettävissä olevat ohjaimet kohteelle PDF tekstiksi.

KäsittelytilaEsiasetukset
Käsittele yksi syöte tai siirry Premiumin erätilaan käsittelemään useita syötteitä samoilla asetuksilla. Käytettävissä olevat syötetyypit riippuvat työkalusta.Asetukset: Yksittäinen tiedostoErä

Moottori

MoottoriPudotusvalikko
Valitsee, mikä tekstintunnistusmoottori lukee tiedostosi; vaihda Moottoriin 1 tai Moottoriin 2, jos Oletus tulkitsee koristeelliset fontit tai käsialan väärin — tulos päivittyy automaattisesti.Asetukset: OletusMoottori 1Moottori 2
KieliPudotusvalikko
Valitse lähteen pääkieli. Vaihtoehdot riippuvat valitusta tunnistusmoottorista. Kielet, joita ei tueta, piilotetaan. Englanti on oletus. Tarkista poimittu teksti tunnistusvirheiden varalta.Asetukset: englantiranskalainensaksaksiespanjaitalialainenportugalihollantilainenvenäjäksijapanilainenkorealainenkiina (yksinkertaistettu)kiina (perinteinen)arabiahindibengaliPandžabiurduvietnamilainenthaimaalainenpuolalainenruotsinkielinentanskalainennorjalainensuomalainenturkkilainenukrainalainenIndonesialainentamilitelugumarathiNepalipersialainenkreikkalainenheprea
Suorita poiminta uudelleenYksi napsautus
Suorittaa poiminnan uudelleen samalle tiedostolle nykyisillä Moottori- ja Kieli-valinnoilla – kätevä uuteen yritykseen heikon tai epäonnistuneen ajon jälkeen.

Lataa

Lataa muodossaPudotusvalikko
Valitse tulostyyppi tekstin poiminnan jälkeen. Word- ja laskentataulukkoviennit valmistelevat tiedoston lähteestä. PDF-taulukoiden CSV-vienti sisältää ZIP-paketin, jossa on yksi tiedosto taulukkoa kohti.Asetukset: Teksti (.txt)Markdown-tiedosto (.md)Word-asiakirja (.docx)Excel-taulukko (.xlsx)CSV-taulukot (.zip)
Ilmainen käyttää · Ei rekisteröitymistä · Ei vesileimaaLataukset salataan siirron aikanaPoistettu säilytyskäytäntömme mukaisesti

Usein kysytyt kysymykset

Lähetä PDF-tiedostosi, niin työkalu tunnistaa, sisältääkö se oikean tekstitason vai pelkkiä skannattuja kuvia. Tekstitason PDF-tiedostot viedään heti. Pelkät kuva-PDF-tiedostot (skannatut kirjat, valokuvatut kuitit, vanhat raportit) kulkevat OCR:n läpi automaattisesti. Joka tapauksessa saat siistin .txt-tiedoston, jossa kappaleet, rivinvaihdot ja osioiden välistys säilyvät.

usage

Kyllä. Jos PDF on pelkästään kuvapohjainen (yleistä skannauksissa, valokuvatuissa sivuissa tai faksivienneissä), OCR-moottori käynnistyy automaattisesti – et tarvitse erillistä työkalua. Monikielinen tuki on sisäänrakennettu, joten myös kaksikieliset tai ei-latinalaiset kirjoitukset (kiina, arabia, hindi) poimitaan samalla kierroksella.

features

Kappalevaihdot, osioiden väliset tyhjät rivit, luettelomerkit ja numeroitujen luetteloiden etuliitteet säilyvät pelkkänä tekstinä. Otsikot tulevat läpi joko isoin kirjaimin tai alkuperäisellä kirjainkoollaan lähdefontista riippuen. Visuaalista korostusta (lihavointi, kursivointi) ei koodata pelkkään tekstiin – käytä siihen PDF Wordiksi -muunninta.

technical

Kyllä. Syötä salasana kehotteeseen lataamisen jälkeen, niin työkalu avaa tiedoston muistissa juuri sen verran, että teksti saadaan poimittua. Salasanaa ei koskaan tallenneta levylle eikä välitetä kolmansien osapuolten palveluihin. Lukittuja PDF-tiedostoja ilman salasanaa ei voi käsitellä – turvallisuussyistä salasanojen murtamista ei suoriteta.

features

Sekä sivumäärää että tiedostokokoa rajoitetaan muunnoksen luotettavuuden varmistamiseksi. Ilmainen tilaus tukee enintään 30 sivua ja 11 MB, Premium 200 sivua ja 50 MB, Pro 500 sivua ja 120 MB sekä Enterprise 1000 sivua. Jaa suuret asiakirjat PDF Split -työkalulla ja käsittele kukin osa erikseen.

technical

Käsittely tapahtuu suojatuilla palvelimilla, ja tiedostot poistetaan tietoturvakäytäntömme mukaisesti – ellet jaa tulosta erikseen, jolloin tulos pysyy julkisessa linkissä, joka voi avata sen 30 päivää. .txt-tulostus on sinun – ei vesileimaa, ei merkintää, ei seurantaa. Tutkijat, toimittajat, lakimiehet ja opiskelijat käyttävät työkalua tekstin poimimiseen luottamuksellisista raporteista tietäen, että lähde-PDF-tiedostoa ei säilytetä tämän ikkunan jälkeen.

privacy

Kyllä. Avaa Moottori-paneeli, valitse asiakirjasi kieli ja OCR-moottori, ja sivu luetaan kyseisellä kirjoitusjärjestelmällä — yli 100 kieltä tuetaan, mukaan lukien ei-latinalaiset ja oikealta vasemmalle kirjoitettavat. Jos ensimmäinen käsittelykerta lukee väärin tarkkeelliset tai muut kuin englanninkieliset merkit, vaihda kieltä ja napauta Suorita tunnistus uudelleen.

usage

Muotoiltu näkymä säilyttää sivun alkuperäisen asettelun — sarakkeet, välistyksen ja rivien sijainnit — mikä auttaa taulukoiden ja kuittien kanssa. Pelkkä teksti -näkymä tuottaa siistiä, uudelleen muotoiltua tekstiä, joka on helpompi liittää asiakirjaan tai chatbotiin. Vaihda näkymien välillä ja kopioi teksti tai lataa se .txt-tiedostona.

features

Tämä työkalu antaa sinulle raakatekstin kopioitavaksi tai tallennettavaksi .txt-tiedostona. Jos haluat mieluummin säilyttää alkuperäisen PDF:n mutta tehdä siitä Ctrl+F-haettavan, aja se Kuva haettavaksi PDF:ksi -työkalun läpi — se lisää näkymättömän OCR-tekstikerroksen skannauksen päälle, joten sivu näyttää samalta, mutta sanat tulevat valittaviksi.

tips

Aloita Oletus-asetuksella ja asiakirjasi kielellä yleisten latinalaisiin kirjaimiin perustuvien kielten kohdalla — se on nopea ja tarkka jokapäiväiselle tekstille. Jos tulos näyttää sekavalta tai kirjoitus ei ole latinalaista (arabia, hindi, kiina, kyrillinen), vaihda Moottori 1:een tai Moottori 2:een, valitse vastaava kieli valitsimesta ja napauta Suorita tunnistus uudelleen — eri moottorit on viritetty eri kirjoitusjärjestelmille, joten molempien kokeileminen vie vain sekunteja.

tips

Tulostuslaatikko on täysin muokattava, joten voit nopeasti siivota OCR-virheen tai leikata osan suoraan näytöllä. Kopioi leikepöydälle kopioi aina tarkalleen sen, mikä laatikossa parhaillaan on, muokkaukset mukaan lukien — mutta Lataa .txt tallentaa viimeisen Moottori/Kieli-ajon tuottaman alkuperäisen tiedoston, ei näytöllä tehtyjä muokkauksia. Säilyttääksesi korjauksen käytä Kopioi-toimintoa ja liitä se omaan .txt-tiedostoosi, tai jos virhe on järjestelmällinen, vaihda Kieli tai Moottori ja napauta Suorita tunnistus uudelleen käsin muokkaamisen sijaan.

features

Lataa PDF-tiedostosi ja anna erotustyökalun poimia teksti — tekstintunnistus (OCR) käynnistyy automaattisesti skannatuilla tai pelkkiä kuvia sisältävillä sivuilla — ja lataa sitten tulos pelkkänä .txt-tiedostona. Tiedosto avautuu Muistiossa, TextEditissä tai missä tahansa koodieditorissa ilman erityistä ohjelmistoa. Näin käytettynä se toimii yksinkertaisena pdf-muistio-muuntimena, kun haluat vain raakaa, kopiointivalmista tekstiä ilman muotoilua tai kuvia.

usage

Kyllä – muunna, esikatsele ja lataa PDF-teksti luomatta tiliä. Ilmainen korvaus kattaa skannattujen PDF-tiedostojen tekstintunnistusta, muotoiltuja ja tavallisia näkymiä sekä .txt-latauksen. Premium poistaa katetut päivärajat.

pricing

Kyllä — Pixoate tukee erä- ja joukkokäsittelyä. Vaihda erätilaan, lisää jopa 60 PDF-tiedostoa Premiumissa tai 200 Prossa, aseta asetukset kerran, ja jokainen PDF käsitellään samoilla asetuksilla ennen kuin lataat yhden ZIP-tiedoston. Joukkokäsittely on Premium-ominaisuus; lähtö käyttää samaa laatua ja asetuksia kuin yksitila.

features

Kyllä – joukkokäsittelyssä määrität asetukset kerran, ja ne koskevat kaikkia erän kohteita – jopa 60 PDF-tiedostoa Premiumissa tai 200 Prossa. Kohdekohtaista asetusta ei tarvitse toistaa, ja väliaikaisesti ladatut ja luodut tiedostot käsitellään turvallisesti ja poistetaan automaattisesti.

usage

Syynä on lähes aina jokin kolmesta asiasta. Tiedosto ylittää ilmaisen lähetyksen 11 MB:n rajan — Premium hyväksyy enintään 50 MB ja Pro 120 MB. Työkalu ei ehkä tue tiedostomuotoa, joten tarkista lähetyspaneelissa näkyvä luettelo. Tiedoston todellinen muoto ei myöskään välttämättä vastaa sen nimeä: tiedoston nimeäminen uudelleen ei muuta sen sisältöä, minkä vuoksi kelvolliselta näyttävä PDF voidaan hylätä.

troubleshooting

PDF tallentaa sivun jokaisen merkin sijaintipaikan, ei tekstinkäsittelyohjelman käyttämiä kappaleita ja tyylejä, joten muuntaminen tarkoittaa rakenteen uudelleen rakentamista päättelyn avulla. Monimutkaiset sarakkeet, taulukot ja kuvien ympärille kääritty teksti ovat siellä, missä se ajautuu. Jos ulkonäkö on tärkeämpää kuin muokattavuus, valitse visuaalinen tila; Jos sinun on kirjoitettava siihen, valitse muokattava tila ja odota parittoman otsikon korjaamista.

troubleshooting

Ei. Voit suorittaa PDF-tiedoston tekstiksi ja ladata ilmaisen tuloksen ilman tiliä, eikä siinä ole vesileimaa. Premium on mitä ostat, kun rajat alkavat purra: jopa 60 tiedostoa yhdessä erässä, suuremmat lataukset, ei päivittäistä enimmäismäärää ja alkuperäisen resoluution tulos. Latausvaiheessa ei paljasteta mitään, mikä ei ollut näkyvissä ennen aloittamista.

pricing

Ei. PDF kohteeksi Text toimii selaimessa tietokoneella ja puhelimella. Mitään ei tarvitse asentaa, kokeilua aloittaa tai lisenssiä ostaa ennen kuin näet, sopiiko se tarpeeseesi. Kokeile sitä omalla ongelmatiedostollasi esimerkin sijaan.

troubleshooting

Miten PDF tekstiksi auttaa sinua saamaan sen tehtyä

Se ratkaisee todellisia ongelmia joka päivä – yrityksille, sisällöntuottajille ja jokapäiväisille tehtäville. Etsi itsellesi sopiva käyttötapa ja aloita.

Koulutus

Luento- ja kurssimuistiinpanojen poiminta

Opiskelijat poimivat pelkän tekstin professorin toimittamista PDF-luentomuistiinpanoista ja laboratorio-oppaista, jotta he voivat liittää otteita Notioniin, Obsidianiin ja kertauskortteihin.

Henkilökohtainen käyttö

Ansioluettelon teksti joukkolähetyksiin

Työnhakijat poimivat PDF-ansioluettelostaan pelkän tekstin liittääkseen sen ATS-hakulomakkeisiin, LinkedIn Easy Apply -hakuihin ja rekrytointiportaalien tekstikenttiin, jotka eivät hyväksy tiedostojen lataamista.

Yrityksille

Sähköpostiluonnokset PDF-raporteista

Analyytikot poimivat tiivistelmäosiot pitkistä PDF-raporteista liitettäväksi sähköposteihin, Slack-viesteihin ja Teams-keskusteluihin, jotta sidosryhmät lukevat keskeiset havainnot nopeasti.

Yrityksille

Olemassa olevien PDF-resurssien SEO-auditointi

Markkinoijat poimivat tekstiä vanhoista PDF-julkaisuista ja e-kirjoista tarkastaakseen avainsanojen kattavuuden, tunnistaakseen sisältöaukot ja julkaistakseen sisällön uudelleen tuoreina blogikirjoituksina orgaanista hakua varten.

Yrityksille

Käännöstyönkulun valmistelu

Kääntäjät poimivat tekstin PDF-lähteestä ennen sen liittämistä käännösmuistityökaluihin, kuten Trados, MemoQ tai DeepL Pro, nopeampaa ja tarkempaa lokalisointia varten.

Tuottavuus

Tekoälykehotteet pitkistä PDF-raporteista

Tehokäyttäjät poimivat tekstiä PDF-tutkimusartikkeleista ja syöttävät sen ChatGPT:lle, Claudelle tai Geminille kontekstiksi tiivistelmiä, kysymyksiä ja keskeisten kohtien poimintaa varten.

Yrityksille

Pelkkätekstiset varmuuskopioarkistot

IT- ja arkistotiimit poimivat pelkän tekstin PDF-dokumenttiarkistoista luodakseen kevyitä, tulevaisuudenkestäviä varmuuskopioita, jotka eivät ole riippuvaisia PDF-katseluohjelmista 20 vuoden kuluttua.

Koulutus

Lähde- ja viiteluettelot

Tutkijat poimivat PDF-tiedostojen lähdeluettelo-osiot tekstimuotoon, jotta he voivat liittää ne Zoteroon, Mendeleyhin tai EndNoteen kirjoittamatta jokaista viitettä uudelleen käsin.

Henkilökohtainen käyttö

Ruudunlukija- ja tekstistä puheeksi -käyttö

Poimi puhdas teksti PDF:stä, jotta ruudunlukuohjelmat voivat lukea sen ääneen tai sen voi liittää tekstistä puheeksi -sovelluksiin — hyödyllinen näkövammaisille lukijoille tai pitkän raportin kuuntelemiseen kädet vapaana.

Lakiasiat

Juridisen sähköisen todisteiden haun avainsanahaku

Lakiavustajat poimivat tekstiä skannatuista lausunnoista ja todisteaineistoista, jotta sisällöstä tulee haettavaa tuhansien sivujen läpi – sen sijaan että selaisivat pelkkiä kuva-PDF:iä etsien nimeä tai lauseketta.

Kehittäjille

Skannattujen laskujen dataputket

Kehittäjät ja käyttötiimit poimivat tekstiä skannatuista laskuista ja kuiteista syöttääkseen sen regex- tai LLM-pohjaisiin jäsentimiin, automatisoiden massatietojen syötön manuaalisen uudelleenkirjoituksen sijaan.

Tutkimus

FOIA- ja vuodettujen asiakirjojen tutkinnat

Tutkivat journalistit poimivat tekstiä skannatuista viranomaisjulkaisuista ja FOIA-asiakirjoista, jotta he voivat hakea, siteerata ja ristiviitata väitteitä suurissa asiakirjakokonaisuuksissa.

Katso jokainen muunnos valmiina

Every kuva crosses slash untouched ja comes out other side finished.