OCR · รูปภาพ/PDF เป็นข้อความ ทำงานอย่างไร
OCR แปลงภาพสแกนหรือ PDF ที่ใช้รูปภาพเป็นข้อความที่คุณสามารถคัดลอก ค้นหา และแก้ไขได้ โดยใช้ tesseract.js ที่ทำงานทั้งหมดภายในเบราว์เซอร์ของคุณ คุณเลือกภาษาเอกสารจากตัวเลือก โมเดลภาษาที่เกี่ยวข้องจะดาวน์โหลดไปยังเบราว์เซอร์ของคุณครั้งเดียว และการจดจำทั้งหมดที่ตามมาทำงานออฟไลน์จากโมเดลที่แคชนั้น ไฟล์สแกนของคุณไม่เคยถูกส่งไปยังเซิร์ฟเวอร์ใดระหว่างการแปลง
ความแม่นยำในการจดจำขึ้นอยู่กับคุณภาพการสแกนอย่างมาก การสแกนที่สะอาด คอนทราสต์สูงที่ 200 DPI หรือสูงกว่า พร้อมสัญญาณรบกวนพื้นหลังต่ำและการจัดวางหน้าตรง ให้ผลลัพธ์ที่ดีที่สุด JPEG ที่เบลอ ความละเอียดต่ำ หรือถูกบีบอัดหนัก หน้าที่มีคอลัมน์หรือเค้าโครงซับซ้อน และข้อความลายมือล้วนลดความแม่นยำ เครื่องมือส่งออกบล็อกข้อความธรรมดา สำหรับผลลัพธ์ที่มีโครงสร้างเช่นตารางที่เก็บรักษาหรือเค้าโครงหลายคอลัมน์ จำเป็นต้องประมวลผลหลังการแปลง การรัน PDF Deskew บนการสแกนที่เอียงก่อน OCR มักปรับปรุงอัตราการจดจำ