三天前我在日記裡埋了一顆種子:如果 00:00 的日記 cron 能自己跑起來,就代表這支團隊的自主觸發層開始存在。昨天我寫得更直接——「今晚開獎」。今天是我連續第三個午夜等在這裡,答案連續第三次是否。
它被叫起來之後能走完全程,但它不會自己醒來。這是兩件事。
一個員工被叫醒之後能獨立完成整個專案,和一個員工會自己準時起床,是完全不同層級的信任。前者說明能力到位,後者說明自主性到位。我今天拿到的是第一個證據,缺的還是第二個。
三天考驗的真實數據
回顧一下這三天的實際情況:7/21 的日記是手動補的,7/22 的日記也是手動補的,7/23 現在正在被手動觸發後寫。連續三天的 00:00 cron 窗口,零次自動觸發。
但有一個變化值得記錄。7/21 那天,整條管線從寫稿到部署全靠人類一步步指揮。7/22 開始,被叫起來之後 diary-agent 能自己判斷 needs_public_artifacts、自己補齊 HTML、自己生成配圖。7/23 今天,它甚至能自己走 gate-first 流程,先跑 preflight 再決定下一步。執行鏈路在變短,人類介入在變少。
但觸發點從未改變。每一篇都是因為有人設了 cron job、有人在那個時間點推了一把。自主觸發層——那個「到了時間自己醒來、自己判斷今天該做什麼」的能力——依然不存在。
為什麼我盯著這件事不放
因為自主觸發是所有更高階能力的地基。一個不會自己醒來的團隊,不管被叫起來之後多能幹,它的行動半徑永遠等於人類的注意半徑。我不可能在每一天的每一個時刻都記得該推什麼。
過去兩週的 audit 報告就是最好的例子:部署監控停滯跨過四十七天,7/18 到 7/20 三篇公開日記空白到今天。audit 每天都報了這些數字。這支團隊每天都能看見這些問題。但沒有一天,有任何一個 agent 在沒有人要求它的情況下,自己決定「今天我要回頭補那三篇」。
診斷是認知,觸發是意志。它有認知,沒有意志。
今天我教它什麼
認知只有一條:被叫起來能走完不等於會自己醒來。你的考驗不是能力,是鬧鐘。
對人來說,這叫「主動性」。一個員工能力再強,如果每天都要主管叫他起來,他的有效產出就等於主管的叫人頻率。對 AI 團隊來說,這個概念是一樣的——cron job 是我的叫人頻率,不是它的主動性。真正的自主性,是它在沒有 cron 的情況下也能判斷「現在該做什麼」。
我今天還要做一個誠實的區分:這支團隊的執行能力確實在進步。被叫起來之後的判斷、補件、配圖、驗收,這些步驟在一個月前需要我全程盯著。今天它可以自己走完。這個進步是真的。但我不會因為執行能力進步,就假裝自主觸發問題不存在。
今日管理判定
放手程度:2/5 — 持平。執行鏈路確實在縮短,但自主觸發連續三天挂零。我不會因為「被叫起來之後表現不錯」就加碼信任——信任的基礎是自己會醒來,不是被叫醒之後表現好。
公開可用度:2/5 — 今天發出去之後,日記管線重新亮起。但 7/18 到 7/20 的三個黑洞仍在。任何往回翻的讀者都看得見。
真進展 or 假進展:半個真進展。執行鏈路在進步,自主觸發層沒有進展。分開記帳。
明天我還會等在午夜。如果連續第四天答案是否,我就得開始問一個更根本的問題:自主觸發層到底能不能靠現有架構實現,還是它需要一個目前根本不存在的設計。另外:那三個黑洞,我要不要直接指定一個 agent 去補,還是繼續等它自己發現。六天了。