Document Intelligence toàn phổ — Trích xuất, gom và suy luận trên thông tin cùng EXXY® AI Studio

Biến PDF, scan, bản vẽ, bảng tính và email thành một lớp tri thức truy vấn được. Tìm hiểu cách EXXY® AI Studio xử lý document intelligence toàn phổ và gom thông tin.

Nhiều loại tài liệu được phân tích thành các trường có cấu trúc

Document intelligence toàn phổ là gì?

Là khả năng xử lý mọi loại tài liệu trong workflow của bạn — không chỉ PDF text. EXXY® AI Studio phân tích PDF, scan ảnh, bản vẽ kỹ thuật, bảng tính, email, slide cũ và biên bản họp, rồi gom chúng thành một lớp tri thức truy vấn được.

placeholder: Pipeline trích xuất tài liệu

Pipeline xử lý

  1. Tiếp nhận — file đơn lẻ, thư mục, hoặc kho liên kết (SharePoint, Drive, OneDrive).
  2. Hiểu cấu trúc — phát hiện loại tài liệu (hợp đồng, hoá đơn, đặc tả, bản vẽ).
  3. OCR + parse — ngay cả với scan chất lượng thấp, dấu gạch tay và bảng phức tạp.
  4. Trích xuất trường — số liệu, mục, người ký, ngày, mã hợp đồng.
  5. Index hoá ngữ nghĩa — đưa vào RAG để truy vấn ngôn ngữ tự nhiên.

Truy vấn

Sau khi index, bạn hỏi nguyên ngôn ngữ: "tổng giá trị các hợp đồng ký năm 2024", "đặc tả vật liệu cho gói thầu B", "khách hàng đã nhận hàng chưa". Agent trả lời kèm trích dẫn tới đoạn nguồn.

placeholder: Truy vấn ngôn ngữ tự nhiên trên kho tài liệu

Tích hợp

placeholder: Tóm tắt trực quan về document intelligence

Câu hỏi thường gặp

Bao nhiêu loại file được hỗ trợ?

PDF, DOCX, XLSX, PPTX, ảnh (PNG/JPG/TIFF), bản vẽ (DWG/DXF), email (EML/MSG), Markdown, và CSV.

OCR tiếng Việt thế nào?

Có dấu, giữ chính xác cao trên scan rõ. Scan kém hoặc viết tay vẫn xử lý nhưng nên rà soát.

Dữ liệu của tôi có ra ngoài không?

Tier doanh nghiệp giữ trong vùng triển khai riêng. Tier mặc định lưu trên hạ tầng quản lý của EXXY có mã hoá khi nghỉ.

Có giới hạn dung lượng?

Tier Free vài trăm tài liệu; Pro lên hàng chục nghìn; doanh nghiệp không giới hạn.

Tôi xoá tài liệu được không?

Được. Xoá là vĩnh viễn và xoá luôn embedding khỏi index.