櫃算盤的 AI 抄圖不是黑箱:每一版辨識程式上線前,都在一套 合成樣本+真實圖面的測試集上跑分——建商客變圖、設計師 CAD 立面、 屋主手繪草圖、拍螢幕的規劃器截圖、塞滿的櫃內實照。 下面的數字就是最近一輪的結果,持續更新,不挑好看的貼。
測試集:合成樣本 18 張+真實圖面 19 張(來源:公開裝修分享,僅內部測試用,不重製展示)。 單輪評測有 ±5% 左右的模型波動;規則調整以多輪驗證為準。
每張測試圖先由 AI 以外的人逐張判讀、再與產品負責人逐條討論定案——格數怎麼算、拉盤算不算抽屜、 吊桿多高算長掛,累積成 13 條公開一致的計數規則。答案不是 AI 自己出的考卷。
評測直接編譯生產環境的判讀程式——prompt、解析、換算一字不差。測到幾分,你用到的就是幾分, 沒有「demo 特調版」。
模型只把圖面「逐格轉錄」成清單(這格是層板、那段是吊桿、淨高幾公分); 格數加總、長短掛分類、單位換算全部由確定性程式計算。機率留在感知層,判斷不交給機率。