我是大學通識課老師。今年五月底開始把五種不同底層的 AI 組成一隊:Claude Code 當組長,帶著 Codex、Antigravity、OpenCode、Grok,讀同一份主指令、共用同一份記憶,做我的教學與行政工作。兩個多月、七百多個 commit。
這 30 天不寫「效率提升幾倍」,寫實測紀錄:主指令怎麼餵給五種引擎、怎麼按失敗風險派工、記憶放哪裡才找得回來,以及最重要的——怎麼在它們胡說八道時抓到。
有很多難看的部分。某顆模型讀完檔案卻不吐一個字;某位隊友交回排版最漂亮的報告,裡面五筆假引用;畫面顯示「已儲存」其實沒落地。每則都有日期、數字和錯誤訊息。
我在東華教通識課。有程式課,也有一堆跟程式無關的課。 這三十天想寫的,是一件講出來有點怪的事:我的電腦裡住著五個 AI,它們各自有名字、有自己的人格檔,一起做我...
昨天講了為什麼要一支隊。今天講最基礎、也最容易做錯的一件事:怎麼讓五種底層不同的 AI 讀同一份規矩。 先講一個很現實的問題。 這五個工具讀設定檔的位置不一樣。...
五個 AI 要怎麼分工? 第一版我寫得很直覺,大概長這樣: ・A 負責寫程式・B 負責查資料・C 負責做簡報 看起來很合理。用了兩個禮拜就壞了。 壞掉的原因不是...
昨天講了一套按失敗風險派工的規矩。今天要講我們怎麼把它推翻一半。 時間是 2026 年 7 月 14 日。 那陣子我注意到一件事:我按規矩把「研究」派給負責廣搜...
昨天講到五位隊友的判斷力已經趨同,開放型任務可以全員並進。今天講那句話不成立的地方。 有一類限制,不管模型多聰明都不會消失:它跑在什麼樣的沙箱裡。 第一次撞牆...
昨天講到我們多了一張能力實測表。今天講這張表怎麼設計,以及一個我一開始沒想到的問題:它會過期。 檔案開頭第一行寫著「開機必讀,放 log 之前」。裡面有三張表...
前面六天講的都是設計。今天講手指頭實際要敲什麼。 我這邊是 Windows,組長跑在 Claude Code 上,另外四位是四個獨立的命令列工具。要讓它們動起...
昨天結尾說,這些工具的失敗有一種共同形狀:安靜地失敗。今天講最極端的那個版本。 先講一個很蠢但很難查的狀況 2026 年 8 月 5 日,我照慣例派一件活給負...
在 Windows 上做這件事,中文亂碼會反覆咬你。 我一開始的處理方式是換一個終端機、換一個編碼、隨便試試看,有時候好了,有時候沒好,而且我說不出為什麼。...
今天講一個具體的數字:約兩千位元組。 負責大批次粗篩的那位隊友,工單長度超過這個量級,行為就開始變了。線不是刀切的,但量級是實測出來的。他還是會做事——把該讀...