PDF to Text (OCR)

Extract text from PDFs — free

Pull editable text out of any PDF with accurate OCR — even scanned, image-only or photo-of-document PDFs. Copy it or download as TXT, Markdown, Word, Excel or CSV.

  • Reads scanned & image-only PDFs in 30+ languages
  • Formatted or plain text — copy or download instantly
  • Private processing · Files deleted automatically

PDF · Secure processing

TXT
PDFTXT

Unggah PDF

Drop any PDF — copy its text or download it as .txt

PDF · free up to 20MB, Premium up to 50MB

What you can do with PDF ke Teks

Everything this tool helps you accomplish — no learning curve, no setup.

  • Extract plain text from any PDF
  • Pull text out of scanned or image-only PDFs
  • Copy content from PDFs that block selection
  • Read text in your document's own language
  • Re-run extraction for a cleaner result
  • Get editable text for notes or search

Settings information

Every control in PDF ke Teks, explained — what it does and when to use it.

Mesin

MesinDropdown
Menentukan mesin pengenalan teks mana yang membaca berkas Anda; beralihlah ke Mesin 1 atau Mesin 2 bila Bawaan salah membaca font bergaya atau tulisan tangan — hasilnya diperbarui otomatis.Opsi: BawaanMesin 1Mesin 2
BahasaDropdown
Menentukan bahasa penulisan teks sumber agar karakternya dikenali secara akurat; pemilih yang bisa dicari ini hanya menampilkan bahasa yang didukung engine terpilih, dengan bawaan Inggris.Opsi: EnglishFrenchGermanSpanishItalianPortugueseDutchRussianJapaneseKoreanChinese (Simplified)Chinese (Traditional)ArabicHindiBengaliPunjabiUrduVietnameseThaiPolishSwedishDanishNorwegianFinnishTurkishUkrainianIndonesianTamilTeluguMarathiNepaliPersianGreekHebrew
Jalankan ulang ekstraksiOne-click
Menjalankan ulang ekstraksi pada file yang sama menggunakan pilihan Mesin dan Bahasa saat ini — praktis untuk mencoba lagi setelah hasil yang lemah atau gagal.
Uploads are encrypted in transitRemoved under our retention policy

Pertanyaan yang Sering Diajukan

Unggah PDF Anda dan alat ini mendeteksi apakah PDF tersebut berisi lapisan teks asli atau hanya gambar hasil pindai. PDF berlapis teks diekspor seketika. PDF yang hanya berisi gambar (buku hasil pindai, foto struk, laporan lama) diproses melalui OCR secara otomatis. Dengan cara apa pun, Anda mendapatkan file .txt yang rapi dengan paragraf, jeda baris, dan spasi bagian yang tetap terjaga.

usage

Ya. Jika PDF hanya berupa gambar (umum untuk hasil pindai, halaman yang difoto, atau ekspor faks), mesin OCR otomatis aktif — Anda tidak memerlukan alat terpisah. Dukungan multibahasa sudah terpasang, sehingga bahkan dokumen dwibahasa atau aksara non-Latin (Mandarin, Arab, Hindi) ikut diekstraksi dalam proses yang sama.

features

Jeda paragraf, baris kosong antar bagian, penanda poin, dan awalan daftar bernomor dipertahankan sebagai teks biasa. Judul muncul dalam huruf kapital atau sesuai kapitalisasi aslinya tergantung font sumber. Penekanan visual (tebal, miring) tidak dikodekan dalam teks biasa — untuk itu, gunakan konverter PDF ke Word.

technical

Ya. Masukkan kata sandi pada prompt setelah unggah, dan alat ini membuka kunci file di memori hanya selama cukup untuk mengekstrak teks. Kata sandi tidak pernah disimpan di disk atau dikirim ke layanan pihak ketiga. PDF terkunci tanpa kata sandi tidak dapat diproses — demi keamanan, tidak ada pembobolan kata sandi yang dilakukan.

features

File bisa berukuran hingga 20 MB secara Gratis, 50 MB dengan Premium atau 120 MB dengan Pro, dan 500 halaman diproses tanpa masalah. Dokumen yang lebih besar juga dapat digunakan, namun membutuhkan waktu lebih lama — arsip hukum setebal 2000 halaman mungkin memerlukan waktu beberapa menit untuk OCR. Untuk pekerjaan berukuran besar, pisahkan PDF terlebih dahulu dengan alat PDF Split dan proses setiap bagian secara terpisah.

technical

Processing happens on secure servers and files are deleted within 24 hours — unless you explicitly share a result, which keeps it at a public link anyone who has it can open for up to 30 days. The .txt output is yours — no watermark, no attribution, no tracking. Researchers, journalists, lawyers and students use the tool to extract text from confidential reports knowing the source PDF is not retained beyond that window.

privacy

Ya. Buka panel Mesin, pilih bahasa dokumen Anda dan mesin OCR, lalu halaman akan dibaca dalam aksara tersebut — lebih dari 100 bahasa didukung, termasuk yang non-Latin dan kanan-ke-kiri. Jika pembacaan pertama salah membaca karakter beraksen atau non-Inggris, ganti bahasanya dan ketuk Jalankan ulang ekstraksi.

usage

Tampilan terformat mempertahankan tata letak asli halaman — kolom, spasi, dan posisi baris — yang membantu untuk tabel dan struk. Tampilan polos memberi teks bersih yang tersusun ulang sehingga lebih mudah ditempel ke dokumen atau chatbot. Beralih di antara keduanya, lalu salin teksnya atau unduh sebagai file .txt.

features

Alat ini memberi Anda teks mentah untuk disalin atau disimpan sebagai .txt. Jika Anda lebih suka mempertahankan PDF asli tetapi membuatnya dapat dicari dengan Ctrl+F, jalankan melalui alat Gambar ke PDF yang Dapat Dicari — alat ini menambahkan lapisan teks OCR tak terlihat di atas pindaian sehingga halaman tampak identik sementara kata-katanya bisa diseleksi.

tips

Mulai dengan Default dan bahasa dokumen Anda untuk bahasa beraksara Latin umum — cepat dan akurat untuk teks sehari-hari. Jika hasilnya berantakan atau aksaranya non-Latin (Arab, Hindi, Mandarin, Sirilik), beralih ke Engine 1 atau Engine 2, pilih bahasa yang sesuai dari pemilih, dan ketuk Re-run extraction — engine yang berbeda dioptimalkan untuk aksara yang berbeda, jadi mencoba keduanya hanya butuh beberapa detik.

tips

Kotak keluaran dapat sepenuhnya diedit, sehingga Anda dapat dengan cepat membersihkan kesalahan OCR atau memangkas bagian langsung di layar. Copy to clipboard selalu menyalin persis apa yang saat ini ada di kotak, termasuk hasil edit — tetapi Download .txt menyimpan berkas asli yang dihasilkan oleh proses Engine/Language terakhir, bukan hasil edit di layar Anda. Untuk menyimpan koreksi, gunakan Copy dan tempel ke berkas .txt Anda sendiri, atau jika kesalahannya sistematis, ganti Language atau Engine dan ketuk Re-run extraction alih-alih mengedit secara manual.

features

Upload PDF Anda dan biarkan ekstraktor menarik teksnya — OCR berjalan otomatis pada halaman hasil scan atau yang hanya berupa gambar — lalu unduh hasilnya sebagai file .txt biasa. File ini terbuka di Notepad, TextEdit, atau editor kode apa pun tanpa software khusus. Dipakai dengan cara ini, alat ini berfungsi seperti konverter pdf ke notepad sederhana saat Anda hanya butuh teks mentah yang siap disalin tanpa format atau gambar.

usage

Yes — you can convert PDF to text free to preview; create a free account to download required. The free tier includes a generous daily allowance and covers OCR on scanned PDFs, the Formatted and Plain views, and the .txt download. If you extract text from large batches of documents every day, upgrading removes the daily limits.

pricing

Ya — Pixoate mendukung pemrosesan batch dan massal. Beralih ke mode Batch, tambahkan hingga 60 PDF di Premium atau 200 di Pro, atur pilihan Anda satu kali, dan setiap PDF diproses dengan pengaturan yang sama sebelum Anda mengunduh satu ZIP. Pemrosesan massal adalah fitur Premium; outputnya menggunakan kualitas dan pengaturan yang sama dengan mode tunggal.

features

Ya — dengan pemrosesan massal, Anda mengonfigurasi pengaturan satu kali dan pengaturan tersebut berlaku untuk setiap item dalam batch — hingga 60 PDF di Premium atau 200 di Pro. Tidak perlu mengulangi pengaturan per item, dan file yang diunggah dan dibuat sementara diproses dengan aman dan dihapus secara otomatis.

usage

Bagaimana PDF ke Teks membantu Anda menyelesaikannya

Masalah nyata yang diselesaikannya setiap hari — untuk bisnis, kreator, dan tugas sehari-hari. Temukan kasus penggunaan yang cocok untuk Anda dan mulai dalam hitungan detik.

Pendidikan

Ekstraksi Catatan Kuliah & Kursus

Pelajar mengekstrak teks polos dari catatan kuliah PDF dan panduan laboratorium yang diberikan dosen sehingga mereka dapat menempelkan kutipan ke Notion, Obsidian, dan kartu belajar.

Penggunaan Pribadi

Teks Resume untuk Pengiriman Massal

Pencari kerja mengekstrak teks polos dari resume PDF mereka untuk ditempelkan ke formulir lamaran ATS, LinkedIn Easy Apply, dan kolom teks portal perekrut yang tidak menerima unggahan berkas.

Untuk Bisnis

Draf Email dari Laporan PDF

Analis mengekstrak bagian ringkasan eksekutif dari laporan PDF yang panjang untuk ditempelkan ke email, pesan Slack, dan obrolan Teams agar pemangku kepentingan membaca wawasan utama dengan cepat.

Untuk Bisnis

Audit SEO untuk Sumber Daya PDF yang Ada

Pemasar mengekstrak teks dari whitepaper dan eBook PDF lama untuk mengaudit cakupan kata kunci, mengidentifikasi celah konten, dan menerbitkannya kembali sebagai postingan blog baru untuk pencarian organik.

Untuk Bisnis

Persiapan Alur Kerja Penerjemahan

Penerjemah mengekstrak teks dari sumber PDF sebelum menempelkannya ke alat memori terjemahan seperti Trados, MemoQ, atau DeepL Pro untuk lokalisasi yang lebih cepat dan akurat.

Produktivitas

Prompt AI dari Laporan PDF Panjang

Pengguna mahir mengekstrak teks dari makalah penelitian PDF dan memasukkannya ke ChatGPT, Claude, atau Gemini sebagai konteks untuk ringkasan, tanya jawab, dan ekstraksi poin penting.

Untuk Bisnis

Arsip Cadangan Teks Biasa

Tim IT dan kearsipan mengekstrak teks polos dari arsip dokumen PDF untuk membuat cadangan yang ringan dan tahan masa depan yang tidak bergantung pada penampil PDF dalam 20 tahun ke depan.

Pendidikan

Daftar Kutipan & Referensi

Peneliti mengekstrak bagian bibliografi dari PDF menjadi teks polos sehingga mereka dapat menempelkannya ke Zotero, Mendeley, atau EndNote tanpa mengetik ulang setiap entri secara manual.

Penggunaan Pribadi

Akses Pembaca Layar & Text-to-Speech

Ekstrak teks bersih dari PDF sehingga dapat dibacakan oleh pembaca layar atau ditempelkan ke aplikasi text-to-speech — berguna bagi pembaca tunanetra atau untuk mendengarkan laporan panjang secara bebas genggam.

Legalitas

Pencarian Kata Kunci E-Discovery Hukum

Paralegal mengekstrak teks dari hasil pindaian deposisi dan berkas discovery agar isinya dapat dicari di ribuan halaman, alih-alih menggulir PDF yang hanya berupa gambar untuk mencari sebuah nama atau klausul.

Untuk Developer

Pipeline Data Faktur Terpindai

Tim pengembang dan operasional mengekstrak teks dari faktur dan struk yang dipindai untuk memberi masukan pada parser berbasis regex atau LLM, mengotomatiskan entri data massal alih-alih mengetik ulang secara manual.

Riset

Investigasi FOIA & Dokumen Bocor

Jurnalis investigatif mengekstrak teks dari rilis pemerintah yang dipindai dan dokumen FOIA sehingga mereka bisa mencari, mengutip, dan merujuk silang klaim di seluruh kumpulan dokumen besar.