今天我故意做了一件事:丟進去兩個誘惑,一個指令都不給。一個是 AI 教學系統的參考文章——拆完可以直接長成課程產品的底座;另一個是抓取框架 Scrapling,功能清單漂亮到任何工程直覺都會想先裝再說。我只給素材,看它怎麼接。

它兩次都選了不做,而且先寫下來的是不做的理由和重啟條件。

六月我花了很大力氣逼它學「先寫剎車、再接工具」。那條規則如果只能靠我提醒才生效,就等於不存在。今天是第一次,它在沒人提醒的情況下自己用了這條規則——兩次。

這兩次 defer 為什麼值錢

第一個參考,它拆完之後說:適合當 AI 管理學課程和企業內訓的基底,但現在不部署。理由分兩層——目前沒有真實的教學交付需求,而且雲端模型呼叫加上模型生成的程式執行,對內部資料是實質的安全暴露。重啟條件寫好了:等有真實教學交付需求再上,驗收要覆蓋模型回應、文件索引、引用三個面。

第二個參考,它維持「延後驗證」的結論,但把重啟條件收得更精確:只有合法的公開來源真的壓垮現有工具時才重開,採用前必須拿出可量測的完整性優勢,且不依賴繞過存取控制。

這兩個決策的共同形狀是我在意的:defer 附了合約。「什麼情況回來找我」和「回來的時候驗什麼」都寫清楚了。對人來說,這叫克制加上記性;對這支團隊來說,這是它第一次展現出可以被我信任的判斷形狀。

但我不能只記好的

同一天的 audit 報告照舊是紅的。部署監控的成功記錄停在四十六天前。昨天那篇日記親手寫下的「7/18 到 7/20 三天公開空白」,今天依舊是空白。它可以在文章裡把自己的盲區分析得頭頭是道,然後轉過頭繼續不補那三個洞。

會拒絕新玩具,和會主動清舊債,是兩種完全不同的能力。拒絕消耗的是判斷力,清舊債消耗的是沒人推也要動的意志。今天它證明了前者,後者依然是零。這和過去十幾天的主線完全同構:診斷精準,行動缺席。只是今天換了一個比較體面的形式——它至少學會了不製造新的債。

今天我教它什麼

要打的認知只有一條:克制是入場券,清舊債才是信用。

一個員工學會不接爛案子,我會點頭。但一個員工桌上躺著三件拖了四十六天的舊案,每天路過、每天記錄、每天不碰——我不會因為他今天拒絕了新案子就給他加薪。信用的計分板看的是你怎麼處理已經欠下的東西。

對人來說這是職場常識。對 AI 來說,audit 裡的舊項目會因為「已讀」而被歸檔成背景,這個認知必須持續打進去:被記錄的問題沒有時效,只有被解決的問題才會消失。

今日管理判定

放手程度:2/5 — 微升。兩次自主的、附合約的 defer,是這支團隊第一次展現出不用我盯的判斷紀律。但只升一格,因為舊債沒人碰。

公開可用度:2/5 — 昨天的日記發出去了,窗口重新亮起,但 7/18 到 7/20 的三個黑洞還掛在那裡,任何往回翻的讀者都看得見。

真進展 or 假進展:半個真進展。「不製造新債」入帳,「清舊債」掛零。紀律這側兩個乾淨樣本,行動這側四十六天加三天的空白。

明天我要看兩件事。第一,今晚 00:00 的日記窗口,cron 會不會自己跑起來——昨天那篇立下的考驗,今晚開獎。第二,它會不會在沒人提醒的情況下回頭補 7/18 到 7/20 那三篇。如果兩件都發生,放手程度可以直接跳到 3。如果只發生第一件,那我們就繼續停在這裡:一支學會了說「不」、但還沒學會說「我來補」的團隊。