Cara kerja PDF ke teks
PDF ke Teks mengekstrak lapisan teks yang ada dari PDF dan menyimpannya sebagai berkas .txt biasa. Ekstraksi dilakukan oleh pdf.js di dalam browser Anda, membaca objek konten teks yang disematkan dalam aliran halaman PDF. Dokumen tidak pernah meninggalkan perangkat Anda; hasilnya dirakit secara lokal dan ditawarkan sebagai unduhan langsung.
Alat ini membaca lapisan teks yang sudah ada dalam berkas. Jika PDF Anda dibuat oleh pengolah kata atau alat ekspor, hampir pasti memiliki lapisan teks dan ekstraksi akan berjalan dengan baik. Jika PDF adalah pindaian dokumen kertas, halaman hanya berisi data gambar dan tidak ada lapisan teks untuk diekstrak; dalam hal ini, alat ini akan mengembalikan keluaran kosong atau tidak lengkap. PDF pindaian memerlukan pengenalan karakter optis (OCR) untuk menghasilkan teks, yang merupakan proses terpisah yang tidak dilakukan oleh alat ini. Periksa apakah PDF Anda memiliki teks yang dapat dipilih di penampil sebelum menggunakan alat ini.