|
EstiScan
CASE STUDY
Đây không phải kiểu “giao hết cho VLM tự động hoàn toàn”. Phương pháp xác định đảm nhận tọa độ & kích thước, AI đảm nhận ngữ nghĩa & tiếng Nhật, còn điểm rủi ro được kiểm tra bởi con người. Chúng tôi bóc tách khối lượng từ dữ liệu có cấu trúc, truy vết được, không phải ước lượng.
Nếu phó mặc cho VLM đơn lẻ, kích thước trở thành “ước lượng”, và việc đếm sót cùng ảo giác lan truyền vào bóc tách khối lượng (= chi phí).
TIFF chỉ có điểm ảnh khiến máy không hiểu được đường nét, chữ và cấu kiện. Chỉ dùng VLM đơn lẻ thì kích thước trở thành giá trị ước lượng.
Đếm sót và ảo giác (hallucination) lan rộng thành sai lệch chi phí qua phép bóc tách đơn giá × số lượng.
Không thể truy vết hay kiểm toán “vì sao có giá trị đó”. Không thể giải thích căn cứ chi phí về sau.
▣ Xác định= tọa độ & kích thước (mm) ◆ AI= ngữ nghĩa & tiếng Nhật 👤 Con người= kiểm tra điểm rủi ro
Tiền xử lý & vector hóa chuyển điểm ảnh thành các đoạn thẳng có điểm đầu/điểm cuối và tọa độ. Kích thước được xác định theo hình học, không phải AI ước lượng.
Xây dựng chủ yếu trên OSS có thể dùng thương mại như OpenCV / DeepLSD / PaddleOCR / Detectron2 / Qwen2.5-VL, tránh phụ thuộc nhà cung cấp (vendor lock-in).
Nhấp để trải nghiệm luồng xử lý thực tế (dữ liệu mô phỏng) ngay trên trình duyệt.