Ordilux 內部說明
AI 改完程式,
要怎麼證明「真的做完了」?
這一頁用白話解釋我們的 AI 開發驗收流程:AI 每改完一段程式,都必須一關一關留下證據,證明它不是「自己說做完就算做完」。
🏠
一句話比喻:就像裝修完工要逐項驗收、每一項都留收據,不能師傅自己說「好了」就算好。這套流程做的事,就是把「逐項驗收+留收據」搬到 AI 寫程式這件事上。
第 1 節
這套機制在防什麼?
先講清楚設計目標,才不會期待錯地方。它防的是「偷懶與自欺」,不是「蓄意造假的內鬼」。
防得住偷懶與自欺
- 😴 忘了跑測試,就直接說「改好了」
- 📄 拿上次的舊報告充當這次的成績單
- 🙈 只做了一半,卻回報「全部完成」
- 🎭 測試其實整批被跳過,看起來卻一片綠燈
不防蓄意偽造的內鬼
- 🕵️ 存心偽造每一張收據的惡意行為者
- 🧨 供應鏈攻擊、被入侵的驗證機器
- 🔐 需要密碼學等級簽章才擋得住的威脅
💡 為什麼這樣劃線?就像家裡記帳,防的是記錯與漏記,不是防專業偽鈔集團。要防偽鈔得蓋一座銀行金庫,日常記帳就會動彈不得;先把「漏記與記錯」防死,效益最大。
第 2 節
核心流程:十一個關卡
從接到需求到結案,AI 要依序通過十一站。點每一站可以展開白話說明,以及「這一站在防什麼偷懶」。
第 3 節
收據制度:七種狀態
每一關都要留「收據」:做了什麼、在哪個版本上做的、證據放在哪。收據的狀態只有七種,點卡片看說明。
🚦 最重要的一條規則:「沒交收據」會被算成「還沒跑」,絕不會被當成通過。就像報帳缺了一張發票,不是「當它沒發生」,而是「這筆不能核銷」。
🧪 動手試試:聚合判定模擬器
假設這次變更有四個必要關卡。點每張收據可以切換它的狀態,看看最後放不放行。
第 4 節
三種專案,三條路
不是每個專案都有同樣的設備。流程會依專案「有什麼可用的驗證工具」分成三條路,但每條路的精神一樣:留下可回查的證據。
第 5 節
這份設計本身,也被驗收過
這套流程的設計稿,交給三個不同的 AI(GPT-5.6、Gemini 3.7、Claude)互相挑毛病,一共來回八輪。最嚴格的那一位,挑到第八輪才說「沒問題了」。點下面的圓格看每一輪發生什麼事。