PDF เป็นข้อความ ทำงานอย่างไร
PDF to Text ดึงชั้นข้อความที่มีอยู่จาก PDF และบันทึกเป็นไฟล์ .txt ธรรมดา การดึงข้อมูลทำโดย pdf.js ภายในเบราว์เซอร์ของคุณ อ่าน text content object ที่ฝังอยู่ใน page stream ของ PDF เอกสารไม่เคยออกจากอุปกรณ์ของคุณ ผลลัพธ์ถูกประกอบในท้องถิ่นและเสนอให้ดาวน์โหลดโดยตรง
เครื่องมือนี้อ่านชั้นข้อความที่มีอยู่แล้วในไฟล์ หาก PDF ของคุณถูกสร้างโดยโปรแกรมประมวลคำหรือเครื่องมือส่งออก มักจะมีชั้นข้อความและการดึงข้อมูลจะทำงานได้ดี หาก PDF เป็นสแกนของเอกสารกระดาษ หน้าต่างๆ มีข้อมูลภาพเท่านั้นและไม่มีชั้นข้อความให้ดึง ในกรณีนั้น เครื่องมือนี้จะส่งคืนผลลัพธ์ว่างเปล่าหรือไม่ครบถ้วน PDF ที่สแกนต้องการ optical character recognition (OCR) เพื่อสร้างข้อความ ซึ่งเป็นกระบวนการแยกต่างหากที่ไม่ทำโดยเครื่องมือนี้ ตรวจสอบว่า PDF ของคุณมีข้อความที่เลือกได้ในโปรแกรมดูก่อนใช้เครื่องมือนี้