課題
導入前
TIFFスキャン図面は「画素」しか持たず、線・文字・部材を機械が理解できない。VLM単体に任せると寸法は「推定」になり、数え漏れ・幻覚(hallucination)が積算(=金額)に伝播する。
-
画素だけのTIFFを構造化データに変換したい線・文字・部材を機械が理解できない
-
寸法を正確に測り、数量を100%数えたいVLM単体は推定・数え漏れ・幻覚が発生
-
誤差を積算(金額)に伝播させたくない推定値は単価×数量で誤差が拡大
-
「なぜその値か」を追跡・監査できるようにしたいブラックボックスでは説明できない
ソリューション
導入後
「適材適所」のハイブリッド・パイプライン。前処理・ベクタ化(確定的)で正確な座標・寸法を、OCR・物体認識(AI)で意味・日本語を担当し、構造化で信頼度を付与。リスク箇所のみ人が確認。出力は信頼度付き構造化データ(JSON/部材表/IFC)で積算・見積へ接続。OSS中心でベンダーロックインを回避。
ベクタ化+AI抽出 → 信頼度付き部材表 → 積算・見積