CORE_CAPABILITY
OCR และ Document Intelligence
แปลงเอกสารกระดาษและไฟล์สแกนภาษาไทย-อังกฤษ ให้เป็นข้อมูลที่มีโครงสร้าง ค้นหาได้ และนำไปใช้ต่อในระบบอื่นได้ทันที
เอกสารสแกนนับหมื่นหน้าเป็นข้อมูลที่ “มีอยู่แต่ใช้ไม่ได้” ตราบใดที่ยังค้นหาไม่ได้และไม่มีโครงสร้าง งาน OCR ภาษาไทยยังมีความท้าทายเฉพาะตัว ทั้งการตัดคำ สระบนล่าง และเอกสารที่ปนภาษาไทยกับอังกฤษ
เราสร้างไปป์ไลน์ที่มากกว่าการอ่านตัวอักษร: วิเคราะห์โครงสร้างเอกสาร (Layout Analysis) สกัดข้อมูลเป็นฟิลด์ที่กำหนด ตรวจสอบความถูกต้องด้วยกติกาทางธุรกิจ และส่งรายการที่ไม่มั่นใจให้มนุษย์ตรวจทานผ่านหน้าจอที่ออกแบบมาโดยเฉพาะ
- OCR ภาษาไทยและอังกฤษ รวมถึงเอกสารปนสองภาษา
- วิเคราะห์โครงสร้างเอกสาร ตาราง และแบบฟอร์ม
- สกัดข้อมูลเป็นฟิลด์ที่มีโครงสร้าง พร้อมค่าความมั่นใจ
- หน้าจอตรวจทานสำหรับรายการที่ระบบไม่มั่นใจ
- จัดเก็บเป็นคลังเอกสารที่ค้นหาข้อความเต็มได้
FEATURE_MATRIX
ฟีเจอร์สำคัญ
OCR ไทย-อังกฤษ
ออกแบบไปป์ไลน์สำหรับเอกสารไทยโดยเฉพาะ รองรับแบบฟอร์มราชการและเอกสารธุรกิจ
สกัดข้อมูลเป็นโครงสร้าง
แปลงเอกสารเป็นฟิลด์ข้อมูลที่กำหนดเอง พร้อมระดับความมั่นใจของแต่ละค่า
ตรวจทานอย่างมีระบบ
รายการที่ค่าความมั่นใจต่ำถูกส่งเข้าคิวตรวจทาน เพื่อให้ข้อมูลสุดท้ายเชื่อถือได้
คลังเอกสารค้นหาได้
เอกสารทั้งหมดถูกจัดเก็บพร้อมดัชนีค้นหา เชื่อมต่อระบบอื่นผ่าน API ได้