Extract text from PDFs — free
Pull editable text out of any PDF with accurate OCR — even scanned, image-only or photo-of-document PDFs. Copy it or download as TXT, Markdown, Word, Excel or CSV.
- Reads scanned & image-only PDFs in 30+ languages
- Formatted or plain text — copy or download instantly
- Private processing · Files deleted automatically
PDF · Secure processing
Unggah PDF
Drop any PDF — copy its text or download it as .txt
PDF · free up to 20MB, Premium up to 50MB
What you can do with PDF ke Teks
Everything this tool helps you accomplish — no learning curve, no setup.
- Extract plain text from any PDF
- Pull text out of scanned or image-only PDFs
- Copy content from PDFs that block selection
- Read text in your document's own language
- Re-run extraction for a cleaner result
- Get editable text for notes or search
Settings information
3 settings
Every control in PDF ke Teks, explained — what it does and when to use it.
Mesin
- MesinDropdown
- Menentukan mesin pengenalan teks mana yang membaca berkas Anda; beralihlah ke Mesin 1 atau Mesin 2 bila Bawaan salah membaca font bergaya atau tulisan tangan — hasilnya diperbarui otomatis.Opsi: BawaanMesin 1Mesin 2
- BahasaDropdown
- Menentukan bahasa penulisan teks sumber agar karakternya dikenali secara akurat; pemilih yang bisa dicari ini hanya menampilkan bahasa yang didukung engine terpilih, dengan bawaan Inggris.Opsi: EnglishFrenchGermanSpanishItalianPortugueseDutchRussianJapaneseKoreanChinese (Simplified)Chinese (Traditional)ArabicHindiBengaliPunjabiUrduVietnameseThaiPolishSwedishDanishNorwegianFinnishTurkishUkrainianIndonesianTamilTeluguMarathiNepaliPersianGreekHebrew
- Jalankan ulang ekstraksiOne-click
- Menjalankan ulang ekstraksi pada file yang sama menggunakan pilihan Mesin dan Bahasa saat ini — praktis untuk mencoba lagi setelah hasil yang lemah atau gagal.
Selesai dengan PDF ke Teks? Coba yang berikut ini
Alat pilihan yang cocok dipadukan dengan PDF ke Teks. Terus lanjutkan tanpa kehilangan file Anda.
PDF ke Word
Stop retyping locked PDFs. Get a clean .docx with fonts, tables and layout preserved that opens in Word, Pages or Google Docs — ready in seconds. Free to start, no credit card.
Coba sekarangPDF ke HTML
Get semantic HTML with real table markup you can paste straight into your site or CMS — works on scanned PDFs too, done in seconds. Free to start, no credit card.
Coba sekarangGambar ke Teks (OCR)
Stop retyping screenshots and scans. Upload any image and get clean, editable text in 30+ languages — ready to copy in seconds. Free to start.
Coba sekarangGabungkan PDF
Stop emailing five attachments. Drop your PDFs, drag them into order, and download a single merged file in seconds. Free to start, no watermark, files auto-deleted.
Coba sekarangKompres PDF
Rejected by an upload limit or bounced by email? Pick a quality preset and get a much smaller PDF in seconds — same document, lighter file. Free to start, no watermark.
Coba sekarangPenghitung Kata
Essay limits and character caps sneak up on you. Paste or type to see words, characters, sentences, paragraphs and reading time update live. Free to use and copy — no account needed.
Coba sekarangPertanyaan yang Sering Diajukan
Unggah PDF Anda dan alat ini mendeteksi apakah PDF tersebut berisi lapisan teks asli atau hanya gambar hasil pindai. PDF berlapis teks diekspor seketika. PDF yang hanya berisi gambar (buku hasil pindai, foto struk, laporan lama) diproses melalui OCR secara otomatis. Dengan cara apa pun, Anda mendapatkan file .txt yang rapi dengan paragraf, jeda baris, dan spasi bagian yang tetap terjaga.
usageYa. Jika PDF hanya berupa gambar (umum untuk hasil pindai, halaman yang difoto, atau ekspor faks), mesin OCR otomatis aktif — Anda tidak memerlukan alat terpisah. Dukungan multibahasa sudah terpasang, sehingga bahkan dokumen dwibahasa atau aksara non-Latin (Mandarin, Arab, Hindi) ikut diekstraksi dalam proses yang sama.
featuresJeda paragraf, baris kosong antar bagian, penanda poin, dan awalan daftar bernomor dipertahankan sebagai teks biasa. Judul muncul dalam huruf kapital atau sesuai kapitalisasi aslinya tergantung font sumber. Penekanan visual (tebal, miring) tidak dikodekan dalam teks biasa — untuk itu, gunakan konverter PDF ke Word.
technicalYa. Masukkan kata sandi pada prompt setelah unggah, dan alat ini membuka kunci file di memori hanya selama cukup untuk mengekstrak teks. Kata sandi tidak pernah disimpan di disk atau dikirim ke layanan pihak ketiga. PDF terkunci tanpa kata sandi tidak dapat diproses — demi keamanan, tidak ada pembobolan kata sandi yang dilakukan.
featuresFile bisa berukuran hingga 20 MB secara Gratis, 50 MB dengan Premium atau 120 MB dengan Pro, dan 500 halaman diproses tanpa masalah. Dokumen yang lebih besar juga dapat digunakan, namun membutuhkan waktu lebih lama — arsip hukum setebal 2000 halaman mungkin memerlukan waktu beberapa menit untuk OCR. Untuk pekerjaan berukuran besar, pisahkan PDF terlebih dahulu dengan alat PDF Split dan proses setiap bagian secara terpisah.
technicalProcessing happens on secure servers and files are deleted within 24 hours — unless you explicitly share a result, which keeps it at a public link anyone who has it can open for up to 30 days. The .txt output is yours — no watermark, no attribution, no tracking. Researchers, journalists, lawyers and students use the tool to extract text from confidential reports knowing the source PDF is not retained beyond that window.
privacyYa. Buka panel Mesin, pilih bahasa dokumen Anda dan mesin OCR, lalu halaman akan dibaca dalam aksara tersebut — lebih dari 100 bahasa didukung, termasuk yang non-Latin dan kanan-ke-kiri. Jika pembacaan pertama salah membaca karakter beraksen atau non-Inggris, ganti bahasanya dan ketuk Jalankan ulang ekstraksi.
usageTampilan terformat mempertahankan tata letak asli halaman — kolom, spasi, dan posisi baris — yang membantu untuk tabel dan struk. Tampilan polos memberi teks bersih yang tersusun ulang sehingga lebih mudah ditempel ke dokumen atau chatbot. Beralih di antara keduanya, lalu salin teksnya atau unduh sebagai file .txt.
featuresAlat ini memberi Anda teks mentah untuk disalin atau disimpan sebagai .txt. Jika Anda lebih suka mempertahankan PDF asli tetapi membuatnya dapat dicari dengan Ctrl+F, jalankan melalui alat Gambar ke PDF yang Dapat Dicari — alat ini menambahkan lapisan teks OCR tak terlihat di atas pindaian sehingga halaman tampak identik sementara kata-katanya bisa diseleksi.
tipsMulai dengan Default dan bahasa dokumen Anda untuk bahasa beraksara Latin umum — cepat dan akurat untuk teks sehari-hari. Jika hasilnya berantakan atau aksaranya non-Latin (Arab, Hindi, Mandarin, Sirilik), beralih ke Engine 1 atau Engine 2, pilih bahasa yang sesuai dari pemilih, dan ketuk Re-run extraction — engine yang berbeda dioptimalkan untuk aksara yang berbeda, jadi mencoba keduanya hanya butuh beberapa detik.
tipsKotak keluaran dapat sepenuhnya diedit, sehingga Anda dapat dengan cepat membersihkan kesalahan OCR atau memangkas bagian langsung di layar. Copy to clipboard selalu menyalin persis apa yang saat ini ada di kotak, termasuk hasil edit — tetapi Download .txt menyimpan berkas asli yang dihasilkan oleh proses Engine/Language terakhir, bukan hasil edit di layar Anda. Untuk menyimpan koreksi, gunakan Copy dan tempel ke berkas .txt Anda sendiri, atau jika kesalahannya sistematis, ganti Language atau Engine dan ketuk Re-run extraction alih-alih mengedit secara manual.
featuresUpload PDF Anda dan biarkan ekstraktor menarik teksnya — OCR berjalan otomatis pada halaman hasil scan atau yang hanya berupa gambar — lalu unduh hasilnya sebagai file .txt biasa. File ini terbuka di Notepad, TextEdit, atau editor kode apa pun tanpa software khusus. Dipakai dengan cara ini, alat ini berfungsi seperti konverter pdf ke notepad sederhana saat Anda hanya butuh teks mentah yang siap disalin tanpa format atau gambar.
usageYes — you can convert PDF to text free to preview; create a free account to download required. The free tier includes a generous daily allowance and covers OCR on scanned PDFs, the Formatted and Plain views, and the .txt download. If you extract text from large batches of documents every day, upgrading removes the daily limits.
pricingYa — Pixoate mendukung pemrosesan batch dan massal. Beralih ke mode Batch, tambahkan hingga 60 PDF di Premium atau 200 di Pro, atur pilihan Anda satu kali, dan setiap PDF diproses dengan pengaturan yang sama sebelum Anda mengunduh satu ZIP. Pemrosesan massal adalah fitur Premium; outputnya menggunakan kualitas dan pengaturan yang sama dengan mode tunggal.
featuresYa — dengan pemrosesan massal, Anda mengonfigurasi pengaturan satu kali dan pengaturan tersebut berlaku untuk setiap item dalam batch — hingga 60 PDF di Premium atau 200 di Pro. Tidak perlu mengulangi pengaturan per item, dan file yang diunggah dan dibuat sementara diproses dengan aman dan dihapus secara otomatis.
usageBagaimana PDF ke Teks membantu Anda menyelesaikannya
Masalah nyata yang diselesaikannya setiap hari — untuk bisnis, kreator, dan tugas sehari-hari. Temukan kasus penggunaan yang cocok untuk Anda dan mulai dalam hitungan detik.
Ekstraksi Catatan Kuliah & Kursus
Pelajar mengekstrak teks polos dari catatan kuliah PDF dan panduan laboratorium yang diberikan dosen sehingga mereka dapat menempelkan kutipan ke Notion, Obsidian, dan kartu belajar.
Teks Resume untuk Pengiriman Massal
Pencari kerja mengekstrak teks polos dari resume PDF mereka untuk ditempelkan ke formulir lamaran ATS, LinkedIn Easy Apply, dan kolom teks portal perekrut yang tidak menerima unggahan berkas.
Draf Email dari Laporan PDF
Analis mengekstrak bagian ringkasan eksekutif dari laporan PDF yang panjang untuk ditempelkan ke email, pesan Slack, dan obrolan Teams agar pemangku kepentingan membaca wawasan utama dengan cepat.
Audit SEO untuk Sumber Daya PDF yang Ada
Pemasar mengekstrak teks dari whitepaper dan eBook PDF lama untuk mengaudit cakupan kata kunci, mengidentifikasi celah konten, dan menerbitkannya kembali sebagai postingan blog baru untuk pencarian organik.
Persiapan Alur Kerja Penerjemahan
Penerjemah mengekstrak teks dari sumber PDF sebelum menempelkannya ke alat memori terjemahan seperti Trados, MemoQ, atau DeepL Pro untuk lokalisasi yang lebih cepat dan akurat.
Prompt AI dari Laporan PDF Panjang
Pengguna mahir mengekstrak teks dari makalah penelitian PDF dan memasukkannya ke ChatGPT, Claude, atau Gemini sebagai konteks untuk ringkasan, tanya jawab, dan ekstraksi poin penting.
Arsip Cadangan Teks Biasa
Tim IT dan kearsipan mengekstrak teks polos dari arsip dokumen PDF untuk membuat cadangan yang ringan dan tahan masa depan yang tidak bergantung pada penampil PDF dalam 20 tahun ke depan.
Daftar Kutipan & Referensi
Peneliti mengekstrak bagian bibliografi dari PDF menjadi teks polos sehingga mereka dapat menempelkannya ke Zotero, Mendeley, atau EndNote tanpa mengetik ulang setiap entri secara manual.
Akses Pembaca Layar & Text-to-Speech
Ekstrak teks bersih dari PDF sehingga dapat dibacakan oleh pembaca layar atau ditempelkan ke aplikasi text-to-speech — berguna bagi pembaca tunanetra atau untuk mendengarkan laporan panjang secara bebas genggam.
Pencarian Kata Kunci E-Discovery Hukum
Paralegal mengekstrak teks dari hasil pindaian deposisi dan berkas discovery agar isinya dapat dicari di ribuan halaman, alih-alih menggulir PDF yang hanya berupa gambar untuk mencari sebuah nama atau klausul.
Pipeline Data Faktur Terpindai
Tim pengembang dan operasional mengekstrak teks dari faktur dan struk yang dipindai untuk memberi masukan pada parser berbasis regex atau LLM, mengotomatiskan entri data massal alih-alih mengetik ulang secara manual.
Investigasi FOIA & Dokumen Bocor
Jurnalis investigatif mengekstrak teks dari rilis pemerintah yang dipindai dan dokumen FOIA sehingga mereka bisa mencari, mengutip, dan merujuk silang klaim di seluruh kumpulan dokumen besar.
