Dokumen sumber yang menyerupai penggunaan nyata, diikuti keadaan dokumen atau berkas keluaran yang benar-benar dihasilkan oleh “PDF ke Teks”.
Sesudah
Sebelum
PDF ke Teks (OCR)

Konverter PDF ke Teks — Ekstrak Teks dari PDF Online Gratis

PDF adalah hasil scan, jadi tidak ada yang diseleksi, tidak ada yang disalin dan pencarian tidak menemukan apa pun. Ekstrak teksnya tetap — termasuk PDF hanya gambar, 30+ bahasa.

  • Dapatkan teks dari PDF yang dipindai di mana pilih dan salin tidak melakukan apa pun
  • Membaca PDF hanya gambar dan foto dokumen dalam 30+ bahasa
  • Unduh sebagai TXT, Markdown, Word, Excel, atau CSV

PDF

Unggah PDF

Letakkan PDF apa pun — salin teksnya atau unduh sebagai .txt

PDF · free up to 11MB, Premium up to 50MB

Apa yang dapat Anda lakukan dengan PDF ke Teks

Tinjau kemampuan utama sebelum Anda mulai.

  • Dapatkan teks dari PDF tanpa perlu melakukan salin dan tempel
  • Tarik teks dari PDF yang dipindai atau hanya gambar
  • Salin konten dari PDF yang memblokir pilihan
  • Membaca teks dalam bahasa dokumen Anda sendiri
  • Jalankan kembali ekstraksi untuk hasil yang lebih bersih
  • Dapatkan teks yang dapat diedit untuk catatan atau pencarian

Referensi pengaturan

Kontrol yang tersedia untuk PDF ke Teks.

Mode pemrosesanPreset
Proses satu masukan atau beralih ke mode massal Premium untuk memproses beberapa masukan dengan pengaturan yang sama. Jenis masukan yang tersedia bergantung pada alat.Opsi: Berkas tunggalMassal

Mesin

Mesintarik-turun
Menentukan mesin pengenalan teks mana yang membaca berkas Anda; beralihlah ke Mesin 1 atau Mesin 2 bila Bawaan salah membaca font bergaya atau tulisan tangan — hasilnya diperbarui otomatis.Opsi: BawaanMesin 1Mesin 2
Bahasatarik-turun
Choose the main language in the source. The available choices depend on the selected reader; unsupported languages are hidden. English is the default. Review the extracted text for recognition errors.Opsi: bahasa InggrisPerancisJermanSpanyolItaliaPortugisBelandaRusiaJepangKoreaCina (Sederhana)Cina (Tradisional)Arabbahasa Hindibahasa BengaliPunjabibahasa UrduVietnamThailandPolandiaSwediaDenmarkNorwegiaFinlandiaTurkiUkrainabahasa IndonesiaTamilTeluguMarathiNepalPersiaYunaniIbrani
Jalankan ulang ekstraksiSatu klik
Menjalankan ulang ekstraksi pada file yang sama menggunakan pilihan Mesin dan Bahasa saat ini — praktis untuk mencoba lagi setelah hasil yang lemah atau gagal.

Unduh

Unduh sebagaitarik-turun
Choose the output type after extracting text. Word and spreadsheet exports prepare a file from the source; PDF table CSV exports contain a ZIP of per-table files.Opsi: Teks (.txt)Markdown (.md)Word (.docx)Excel (.xlsx)CSV (tables · .zip)
Gratis digunakan · Tanpa perlu mendaftar · Tanpa tanda airUnggahan dienkripsi saat transitDihapus berdasarkan kebijakan penyimpanan kami

Pertanyaan yang Sering Diajukan

Unggah PDF Anda dan alat ini mendeteksi apakah PDF tersebut berisi lapisan teks asli atau hanya gambar hasil pindai. PDF berlapis teks diekspor seketika. PDF yang hanya berisi gambar (buku hasil pindai, foto struk, laporan lama) diproses melalui OCR secara otomatis. Dengan cara apa pun, Anda mendapatkan file .txt yang rapi dengan paragraf, jeda baris, dan spasi bagian yang tetap terjaga.

usage

Ya. Jika PDF hanya berupa gambar (umum untuk hasil pindai, halaman yang difoto, atau ekspor faks), mesin OCR otomatis aktif — Anda tidak memerlukan alat terpisah. Dukungan multibahasa sudah terpasang, sehingga bahkan dokumen dwibahasa atau aksara non-Latin (Mandarin, Arab, Hindi) ikut diekstraksi dalam proses yang sama.

features

Jeda paragraf, baris kosong antar bagian, penanda poin, dan awalan daftar bernomor dipertahankan sebagai teks biasa. Judul muncul dalam huruf kapital atau sesuai kapitalisasi aslinya tergantung font sumber. Penekanan visual (tebal, miring) tidak dikodekan dalam teks biasa — untuk itu, gunakan konverter PDF ke Word.

technical

Ya. Masukkan kata sandi pada prompt setelah unggah, dan alat ini membuka kunci file di memori hanya selama cukup untuk mengekstrak teks. Kata sandi tidak pernah disimpan di disk atau dikirim ke layanan pihak ketiga. PDF terkunci tanpa kata sandi tidak dapat diproses — demi keamanan, tidak ada pembobolan kata sandi yang dilakukan.

features

Jumlah halaman dan ukuran file sama-sama dibatasi agar konversi andal. Gratis mendukung hingga 30 halaman dan 11 MB, Premium 200 halaman dan 50 MB, Pro 500 halaman dan 120 MB, serta Enterprise 1000 halaman. Pisahkan dokumen besar dengan alat Pisahkan PDF dan proses setiap bagian secara terpisah.

technical

Pemrosesan terjadi di server yang aman dan file dihapus berdasarkan kebijakan Keamanan kami — kecuali Anda secara eksplisit membagikan hasilnya, yang menyimpannya di tautan publik, siapa pun yang memilikinya dapat membukanya hingga 30 hari. Output .txt adalah milik Anda — tanpa tanda air, tanpa atribusi, tanpa pelacakan. Peneliti, jurnalis, pengacara, dan mahasiswa menggunakan alat ini untuk mengekstrak teks dari laporan rahasia dengan mengetahui bahwa sumber PDF tidak disimpan di luar jendela tersebut.

privacy

Ya. Buka panel Mesin, pilih bahasa dokumen Anda dan mesin OCR, lalu halaman akan dibaca dalam aksara tersebut — lebih dari 100 bahasa didukung, termasuk yang non-Latin dan kanan-ke-kiri. Jika pembacaan pertama salah membaca karakter beraksen atau non-Inggris, ganti bahasanya dan ketuk Jalankan ulang ekstraksi.

usage

Tampilan terformat mempertahankan tata letak asli halaman — kolom, spasi, dan posisi baris — yang membantu untuk tabel dan struk. Tampilan polos memberi teks bersih yang tersusun ulang sehingga lebih mudah ditempel ke dokumen atau chatbot. Beralih di antara keduanya, lalu salin teksnya atau unduh sebagai file .txt.

features

Alat ini memberi Anda teks mentah untuk disalin atau disimpan sebagai .txt. Jika Anda lebih suka mempertahankan PDF asli tetapi membuatnya dapat dicari dengan Ctrl+F, jalankan melalui alat Gambar ke PDF yang Dapat Dicari — alat ini menambahkan lapisan teks OCR tak terlihat di atas pindaian sehingga halaman tampak identik sementara kata-katanya bisa diseleksi.

tips

Mulai dengan Default dan bahasa dokumen Anda untuk bahasa beraksara Latin umum — cepat dan akurat untuk teks sehari-hari. Jika hasilnya berantakan atau aksaranya non-Latin (Arab, Hindi, Mandarin, Sirilik), beralih ke Engine 1 atau Engine 2, pilih bahasa yang sesuai dari pemilih, dan ketuk Re-run extraction — engine yang berbeda dioptimalkan untuk aksara yang berbeda, jadi mencoba keduanya hanya butuh beberapa detik.

tips

Kotak keluaran dapat sepenuhnya diedit, sehingga Anda dapat dengan cepat membersihkan kesalahan OCR atau memangkas bagian langsung di layar. Copy to clipboard selalu menyalin persis apa yang saat ini ada di kotak, termasuk hasil edit — tetapi Download .txt menyimpan berkas asli yang dihasilkan oleh proses Engine/Language terakhir, bukan hasil edit di layar Anda. Untuk menyimpan koreksi, gunakan Copy dan tempel ke berkas .txt Anda sendiri, atau jika kesalahannya sistematis, ganti Language atau Engine dan ketuk Re-run extraction alih-alih mengedit secara manual.

features

Upload PDF Anda dan biarkan ekstraktor menarik teksnya — OCR berjalan otomatis pada halaman hasil scan atau yang hanya berupa gambar — lalu unduh hasilnya sebagai file .txt biasa. File ini terbuka di Notepad, TextEdit, atau editor kode apa pun tanpa software khusus. Dipakai dengan cara ini, alat ini berfungsi seperti konverter pdf ke notepad sederhana saat Anda hanya butuh teks mentah yang siap disalin tanpa format atau gambar.

usage

Ya — konversi, pratinjau, dan unduh teks PDF tanpa membuat akun. Tunjangan gratis mencakup OCR pada PDF yang dipindai, tampilan Terformat dan Biasa, serta unduhan .txt. Premium menghilangkan batasan harian yang tercakup.

pricing

Ya — Pixoate mendukung pemrosesan batch dan massal. Beralih ke mode Batch, tambahkan hingga 60 PDF di Premium atau 200 di Pro, atur pilihan Anda satu kali, dan setiap PDF diproses dengan pengaturan yang sama sebelum Anda mengunduh satu ZIP. Pemrosesan massal adalah fitur Premium; outputnya menggunakan kualitas dan pengaturan yang sama dengan mode tunggal.

features

Ya — dengan pemrosesan massal, Anda mengonfigurasi pengaturan satu kali dan pengaturan tersebut berlaku untuk setiap item dalam batch — hingga 60 PDF di Premium atau 200 di Pro. Tidak perlu mengulangi pengaturan per item, dan file yang diunggah dan dibuat sementara diproses dengan aman dan dihapus secara otomatis.

usage

Hampir selalu ada satu dari tiga penyebab. Ukuran file melebihi batas unggahan gratis 11 MB — Premium menerima 50 MB dan Pro 120 MB. Formatnya mungkin tidak didukung alat ini; periksa daftar di panel unggahan. Atau isi file tidak sesuai dengan format pada namanya: mengganti nama tidak mengubah isi, sehingga PDF yang tampak valid ditolak.

troubleshooting

PDF menyimpan tempat setiap karakter berada di halaman, bukan paragraf dan gaya yang digunakan pengolah kata, jadi mengonversi berarti membangun kembali struktur tersebut dengan inferensi. Kolom, tabel, dan teks kompleks yang membungkus gambar adalah tempatnya. Jika tampilan lebih penting daripada kemampuan mengedit, pilih mode visual; jika Anda perlu mengetikkannya, pilih mode yang dapat diedit dan perkirakan untuk memperbaiki judul yang aneh.

troubleshooting

Tidak. Anda dapat menjalankan PDF ke Teks dan mengunduh hasil gratisnya tanpa akun, dan tidak ada tanda air. Premium adalah apa yang Anda beli ketika batasan mulai berlaku: hingga 60 file dalam satu batch, unggahan lebih besar, tanpa batas harian, dan hasil resolusi asli. Tidak ada yang terungkap pada langkah pengunduhan yang tidak terlihat sebelum Anda memulai.

pricing

Tidak — PDF to Text berjalan langsung di browser pada desktop dan ponsel. Tidak ada yang perlu diinstal, tidak ada uji coba yang perlu dimulai, dan tidak ada lisensi yang perlu dibeli sebelum Anda mengetahui apakah alat ini memenuhi kebutuhan Anda. Coba langsung pada file yang sedang Anda tangani, bukan pada contoh.

troubleshooting

Bagaimana PDF ke Teks membantu Anda menyelesaikannya

Masalah nyata yang dipecahkannya setiap hari — untuk bisnis, kreator, dan tugas sehari-hari. Temukan kasus penggunaan yang cocok untuk Anda dan mulailah.

Pendidikan

Ekstraksi Catatan Kuliah & Kursus

Pelajar mengekstrak teks polos dari catatan kuliah PDF dan panduan laboratorium yang diberikan dosen sehingga mereka dapat menempelkan kutipan ke Notion, Obsidian, dan kartu belajar.

Penggunaan Pribadi

Teks Resume untuk Pengiriman Massal

Pencari kerja mengekstrak teks polos dari resume PDF mereka untuk ditempelkan ke formulir lamaran ATS, LinkedIn Easy Apply, dan kolom teks portal perekrut yang tidak menerima unggahan berkas.

Untuk Bisnis

Draf Email dari Laporan PDF

Analis mengekstrak bagian ringkasan eksekutif dari laporan PDF yang panjang untuk ditempelkan ke email, pesan Slack, dan obrolan Teams agar pemangku kepentingan membaca wawasan utama dengan cepat.

Untuk Bisnis

Audit SEO untuk Sumber Daya PDF yang Ada

Pemasar mengekstrak teks dari whitepaper dan eBook PDF lama untuk mengaudit cakupan kata kunci, mengidentifikasi celah konten, dan menerbitkannya kembali sebagai postingan blog baru untuk pencarian organik.

Untuk Bisnis

Persiapan Alur Kerja Penerjemahan

Penerjemah mengekstrak teks dari sumber PDF sebelum menempelkannya ke alat memori terjemahan seperti Trados, MemoQ, atau DeepL Pro untuk lokalisasi yang lebih cepat dan akurat.

Produktivitas

Prompt AI dari Laporan PDF Panjang

Pengguna mahir mengekstrak teks dari makalah penelitian PDF dan memasukkannya ke ChatGPT, Claude, atau Gemini sebagai konteks untuk ringkasan, tanya jawab, dan ekstraksi poin penting.

Untuk Bisnis

Arsip Cadangan Teks Biasa

Tim IT dan kearsipan mengekstrak teks polos dari arsip dokumen PDF untuk membuat cadangan yang ringan dan tahan masa depan yang tidak bergantung pada penampil PDF dalam 20 tahun ke depan.

Pendidikan

Daftar Kutipan & Referensi

Peneliti mengekstrak bagian bibliografi dari PDF menjadi teks polos sehingga mereka dapat menempelkannya ke Zotero, Mendeley, atau EndNote tanpa mengetik ulang setiap entri secara manual.

Penggunaan Pribadi

Akses Pembaca Layar & Text-to-Speech

Ekstrak teks bersih dari PDF sehingga dapat dibacakan oleh pembaca layar atau ditempelkan ke aplikasi text-to-speech — berguna bagi pembaca tunanetra atau untuk mendengarkan laporan panjang secara bebas genggam.

Hukum

Pencarian Kata Kunci E-Discovery Hukum

Paralegal mengekstrak teks dari hasil pindaian deposisi dan berkas discovery agar isinya dapat dicari di ribuan halaman, alih-alih menggulir PDF yang hanya berupa gambar untuk mencari sebuah nama atau klausul.

Untuk Developer

Pipeline Data Faktur Terpindai

Tim pengembang dan operasional mengekstrak teks dari faktur dan struk yang dipindai untuk memberi masukan pada parser berbasis regex atau LLM, mengotomatiskan entri data massal alih-alih mengetik ulang secara manual.

Riset

Investigasi FOIA & Dokumen Bocor

Jurnalis investigatif mengekstrak teks dari rilis pemerintah yang dipindai dan dokumen FOIA sehingga mereka bisa mencari, mengutip, dan merujuk silang klaim di seluruh kumpulan dokumen besar.

Saksikan setiap transformasi selesai

Setiap foto crosses the slash untouched and comes out the other side finished.