我手上有一條真實 session 的逐輪用量紀錄:17 個計費輪次,累計等價成本 $312.97。如果你以為這條曲線是「往返越多、花得越多」的均勻斜坡,那你會跟我當初一樣猜錯——它有 11 輪的增量落在個位數美元,卻有 3 輪一口氣跳了 $71.74、$49.74、$114.75。
矛盾就在這裡:既然貴的不是往返次數本身,那我為什麼還要立一條規則,逼中層經理跑完一輪就結束、不准留著慢慢聊?
前一篇留下的缺口是「session 越活越貴,何時該結束」。今天處理它的一個具體切面:三層派工裡那個中層。
先把三層架構講清楚。我的派工規則(一份寫給主控的派工規則檔)寫的是:總經理 → 中層經理 → 執行者(被派出去做事的 subagent)。開中層的條件只有一個:工作單元 ≥3 個,或需要平行 fan-out;此時只派 1 個中層統包整批,不是一個單元派一個。這條只對總經理這個入口適用;經理那個入口因為本身已經是 Opus,再疊一層中層沒有意義,直接跳過。
會有中層,是因為主控這個位置有個結構性的性質:它每被喚醒一次,就重付一次完整 context。系統提示、專案規約、派工規則,每一輪都要重新讀進去。所以主控被喚醒的次數,本身就是一個成本單位——不是它做了多少事,是它「醒來」了幾次。
中層的作用就是把喚醒次數壓到一次:整批派工交出去,主控不再逐個單元接手、逐個單元核對、逐個單元下一步。
但我踩到的問題是,省下來的東西很容易被往返吃回去。假設中層交上來的表格不合格,我退回、它重交、我再看、再退回——每一次退回都不只是「多聊一句」。主控要重新醒一次、重付一次完整 context,中層那邊也要跟著跑。我在派工規則裡寫死的理由是一句話:每次往返 ≥2 輪全 context,會吃光開中層省下的。

上圖是累計等價成本,下圖是每一輪的增量。橘色三根就是第 2、12、15 輪的跳升——成本集中在少數幾輪,不是隨往返次數均勻累積。
這條 session 是我從逐輪用量紀錄裡抽的真實樣本,有中層參與(同一條 session 的紀錄裡可以看到至少 73 行與中層相關的派出/完成標記,第一個中層任務是統包 169 筆待處理項目的分流與落地)。17 個計費輪次的累計等價成本,從第 1 輪的 $6.83 走到第 17 輪的 $312.97。
**這裡必須把話說死:金額一律是「等價成本」——按官方 API 定價換算出來的,訂閱制實際不按這個計費。**它能當相對比較的尺標,不能當帳單。
然後是一個我不打算含糊過去的地方:這張圖不能證明「讓中層結束一定比較省錢」。要證明那件事,需要的是對照組——同一個任務,中層存活 vs 中層不存活,各跑一次比。我沒做這個實驗,資料庫裡也沒有。
這張圖能說的只有一件事:這條 session 的成本集中在三輪暴衝,其餘輪次很便宜;至於那三輪為什麼貴,我的推測是 fan-out 或大範圍工具呼叫,但那是推測,不是實測結論。
我把它放上來,是因為它剛好說明了「為什麼我不敢讓往返次數自由生長」。多數輪次便宜,不代表下一輪不會是那根 $114.75 的柱子。你事前不知道哪一輪會暴衝,唯一能控制的是總共讓它醒幾次。

主路徑是規則要走的:一次派出、對下 fan-out、一次收斂、一份表格、結束。另一條灰色的路徑是要避開的——留著反覆往返,每次都重付全 context。
規則寫成三條:
第一條,一輪一個中層,收到表格就結束。 中層對下 fan-out、收回執行者的回報、自己先抽驗並裁決誤判,最後只交一份正規化表格給主控。主控只讀這份表格,不重查原始資料——原始資料一旦進了 context,就要陪跑剩下所有輪次。
第二條,退回上限 1 次。 第一次不合格,我把表格交回同一個中層(保留它的脈絡,不用重講一遍背景)。第二次仍不合格,整個單元換一個新的中層從頭重跑,不在主控這邊反覆往返。這條看起來浪費——重跑不是更貴嗎?但對照上面那句「每次往返 ≥2 輪全 context」,反覆往返的代價是確定會發生的,重跑一次的代價是一次性的。我選了後者。
第三條,中層自己也會停。 一批派工超過 120 次呼叫,中層必須停下來、交一份標記為未完成(PARTIAL)的表格,由總經理另派第二個中層「接力」剩下的單元——事後接力,不是預先按功能拆。三條合起來是同一個設計意圖:中層被設計成短、可拋棄、可替換的東西,不是一個養著的長期夥伴。
這裡要澄清一個很容易被寫錯的因果。我另外有一個「單輪即滅入口」——起一個全新進程、跑一輪、結束。看起來像是同一套省錢邏輯的延伸,但它的動機不是成本。真正的原因是排程:內建的循環機制在安排下一次喚醒時,間隔被夾在 60 秒到 3600 秒這個固定區間裡,我沒辦法讓它 6 小時或 12 小時才醒一次。單輪即滅入口是為了把觸發權交給外部排程,想多久就多久。
至於每次全新進程要重付一次冷啟動的 context,我在當時的決策紀錄裡寫得很明白:這部分自己斟酌,不列為評估重點;先前那份成本節省分析被我降級成「副產品」。
把它講成「為了省錢才單輪即滅」是因果錯置。一個是排程限制,一個是成本,兩件事。
讓中層結束,壓住的是「喚醒次數」和「往返次數」這兩個變數——喚醒被壓到一次,往返被上限擋住;至於整批是否因此省錢,沒有對照組,我不下結論。
但結束就是結束。那個中層知道的所有東西——它抽驗過哪幾筆、哪個執行者的回報它判定要重來、哪個單元的邊界它當場重新定義過——都不會再進到下一輪的 context。留下來的只有那份表格。
下一輪要再做同一批事,我從哪裡把該記得的東西接回來?我有一個自製記憶系統,也有紀錄資料庫,資料確實都還躺在那裡。但「資料還在」跟「下一輪的 AI 記得」,我後來發現是完全不同的兩件事。
明日預告:Day 11|持久狀態與 AI 記憶不是同一件事