Document intelligence toàn phổ là gì?
Là khả năng xử lý mọi loại tài liệu trong workflow của bạn — không chỉ PDF text. EXXY® AI Studio phân tích PDF, scan ảnh, bản vẽ kỹ thuật, bảng tính, email, slide cũ và biên bản họp, rồi gom chúng thành một lớp tri thức truy vấn được.

Pipeline xử lý
- Tiếp nhận — file đơn lẻ, thư mục, hoặc kho liên kết (SharePoint, Drive, OneDrive).
- Hiểu cấu trúc — phát hiện loại tài liệu (hợp đồng, hoá đơn, đặc tả, bản vẽ).
- OCR + parse — ngay cả với scan chất lượng thấp, dấu gạch tay và bảng phức tạp.
- Trích xuất trường — số liệu, mục, người ký, ngày, mã hợp đồng.
- Index hoá ngữ nghĩa — đưa vào RAG để truy vấn ngôn ngữ tự nhiên.
Truy vấn
Sau khi index, bạn hỏi nguyên ngôn ngữ: "tổng giá trị các hợp đồng ký năm 2024", "đặc tả vật liệu cho gói thầu B", "khách hàng đã nhận hàng chưa". Agent trả lời kèm trích dẫn tới đoạn nguồn.

Tích hợp
- Nuôi trợ lý cuộc họp để có ngữ cảnh dự án.
- Cấp dữ liệu cho đặc tả & tuân thủ HITL.
- Cấp số liệu cho bài trình bày Agent.

Câu hỏi thường gặp
Bao nhiêu loại file được hỗ trợ?
PDF, DOCX, XLSX, PPTX, ảnh (PNG/JPG/TIFF), bản vẽ (DWG/DXF), email (EML/MSG), Markdown, và CSV.
OCR tiếng Việt thế nào?
Có dấu, giữ chính xác cao trên scan rõ. Scan kém hoặc viết tay vẫn xử lý nhưng nên rà soát.
Dữ liệu của tôi có ra ngoài không?
Tier doanh nghiệp giữ trong vùng triển khai riêng. Tier mặc định lưu trên hạ tầng quản lý của EXXY có mã hoá khi nghỉ.
Có giới hạn dung lượng?
Tier Free vài trăm tài liệu; Pro lên hàng chục nghìn; doanh nghiệp không giới hạn.
Tôi xoá tài liệu được không?
Được. Xoá là vĩnh viễn và xoá luôn embedding khỏi index.
