|
EstiScan
CASE STUDY
「全自動でVLMに丸投げ」ではありません。確定的手法が座標・寸法を、 AIが意味・日本語を担い、リスク箇所は人が確認。 推定ではなく、追跡可能な構造化データから積算します。
VLM単体に任せると寸法は「推定」になり、数え漏れ・幻覚が積算(=金額)に伝播する。
画素だけのTIFFは、線・文字・部材を機械が理解できない。VLM単体では寸法が推定値になる。
数え漏れ・幻覚(hallucination)が、単価×数量の積算で金額の誤差として拡大していく。
「なぜその値か」を追跡・監査できない。金額の根拠を後から説明できない。
▣ 確定的=座標・寸法(mm) ◆ AI=意味・日本語 👤 人=リスク箇所の確認
前処理・ベクタ化で、画素を始点・終点を持つ線分と座標へ変換。寸法はAIの推定ではなく、幾何的に確定します。
OpenCV / DeepLSD / PaddleOCR / Detectron2 / Qwen2.5-VL など商用利用可能なOSS中心で構成。ベンダーロックインを回避します。
クリックすると、実際の処理フロー(モックデータ)をブラウザ上で体験できます。