Cara PDF ke teks berfungsi
PDF to Text mengekstrak lapisan teks sedia ada daripada PDF dan menyimpannya sebagai fail .txt biasa. Pengekstrakan dilakukan oleh pdf.js di dalam pelayar anda, yang membaca objek kandungan teks yang tertanam dalam aliran halaman PDF. Dokumen tidak pernah meninggalkan peranti anda; hasilnya dihimpunkan secara setempat dan ditawarkan sebagai muat turun langsung.
Alat ini membaca lapisan teks yang sudah terdapat dalam fail. Jika PDF anda dicipta oleh pemproses kata atau alat eksport, kemungkinan besar ia mempunyai lapisan teks dan pengekstrakan akan berfungsi dengan baik. Jika PDF adalah imbasan dokumen kertas, halaman mengandungi data imej sahaja dan tiada lapisan teks untuk diekstrak; dalam kes itu, alat ini akan mengembalikan output yang kosong atau tidak lengkap. PDF yang diimbas memerlukan pengecaman aksara optik (OCR) untuk menghasilkan teks, yang merupakan proses berasingan yang tidak dilakukan oleh alat ini. Periksa sama ada PDF anda mempunyai teks yang boleh dipilih dalam pemapar sebelum menggunakan alat ini.