Ekstrak teks dari PDF

File Anda tetap di perangkat — tidak ada yang diunggah.

Cara kerjanya

PDF ke teks mengambil lapisan teks dari sebuah dokumen dan mengembalikannya sebagai teks biasa yang bisa Anda tempel ke editor, penerjemah, atau skrip. Keluarannya benar-benar teks polos: pergantian baris disusun ulang dari posisi kata di halaman, tetapi kolom, tabel, jenis huruf, dan tata letaknya tidak dipertahankan. Kalau tidak ada yang keluar, berarti PDF-nya memang tidak punya lapisan teks sama sekali — isinya hasil pindai atau gambar halaman, dan mengubahnya menjadi kata-kata butuh OCR. Pengambilan teks berjalan sepenuhnya di browser Anda, jadi PDF maupun teksnya tidak pernah dikirim ke server.

  1. Letakkan PDF ke halaman ini.
  2. Tekan “Ekstrak teks” — halaman dibaca satu per satu dan penghitungnya menunjukkan sudah sampai mana.
  3. Baca pratinjaunya. Dokumen panjang dipotong di layar, tetapi file yang Anda unduh selalu berisi teks lengkapnya.
  4. Salin teksnya langsung ke papan klip, atau unduh file .txt UTF-8 biasa yang tiap halamannya dipisahkan satu baris kosong.