ข้ามไปยังเนื้อหา
45intIntelligence Delivered
โซลูชัน

CORE_CAPABILITY

OCR และ Document Intelligence

แปลงเอกสารกระดาษและไฟล์สแกนภาษาไทย-อังกฤษ ให้เป็นข้อมูลที่มีโครงสร้าง ค้นหาได้ และนำไปใช้ต่อในระบบอื่นได้ทันที

OCR PipelinesLayout AnalysisLLMPythonPostgreSQLMinIO

เอกสารสแกนนับหมื่นหน้าเป็นข้อมูลที่ “มีอยู่แต่ใช้ไม่ได้” ตราบใดที่ยังค้นหาไม่ได้และไม่มีโครงสร้าง งาน OCR ภาษาไทยยังมีความท้าทายเฉพาะตัว ทั้งการตัดคำ สระบนล่าง และเอกสารที่ปนภาษาไทยกับอังกฤษ

เราสร้างไปป์ไลน์ที่มากกว่าการอ่านตัวอักษร: วิเคราะห์โครงสร้างเอกสาร (Layout Analysis) สกัดข้อมูลเป็นฟิลด์ที่กำหนด ตรวจสอบความถูกต้องด้วยกติกาทางธุรกิจ และส่งรายการที่ไม่มั่นใจให้มนุษย์ตรวจทานผ่านหน้าจอที่ออกแบบมาโดยเฉพาะ

  • OCR ภาษาไทยและอังกฤษ รวมถึงเอกสารปนสองภาษา
  • วิเคราะห์โครงสร้างเอกสาร ตาราง และแบบฟอร์ม
  • สกัดข้อมูลเป็นฟิลด์ที่มีโครงสร้าง พร้อมค่าความมั่นใจ
  • หน้าจอตรวจทานสำหรับรายการที่ระบบไม่มั่นใจ
  • จัดเก็บเป็นคลังเอกสารที่ค้นหาข้อความเต็มได้

FEATURE_MATRIX

ฟีเจอร์สำคัญ

OCR ไทย-อังกฤษ

ออกแบบไปป์ไลน์สำหรับเอกสารไทยโดยเฉพาะ รองรับแบบฟอร์มราชการและเอกสารธุรกิจ

สกัดข้อมูลเป็นโครงสร้าง

แปลงเอกสารเป็นฟิลด์ข้อมูลที่กำหนดเอง พร้อมระดับความมั่นใจของแต่ละค่า

ตรวจทานอย่างมีระบบ

รายการที่ค่าความมั่นใจต่ำถูกส่งเข้าคิวตรวจทาน เพื่อให้ข้อมูลสุดท้ายเชื่อถือได้

คลังเอกสารค้นหาได้

เอกสารทั้งหมดถูกจัดเก็บพร้อมดัชนีค้นหา เชื่อมต่อระบบอื่นผ่าน API ได้