我是大學通識課老師。今年五月底開始把五種不同底層的 AI 組成一隊:Claude Code 當組長,帶著 Codex、Antigravity、OpenCode、Grok,讀同一份主指令、共用同一份記憶,做我的教學與行政工作。兩個多月、七百多個 commit。
這 30 天不寫「效率提升幾倍」,寫實測紀錄:主指令怎麼餵給五種引擎、怎麼按失敗風險派工、記憶放哪裡才找得回來,以及最重要的——怎麼在它們胡說八道時抓到。
有很多難看的部分。某顆模型讀完檔案卻不吐一個字;某位隊友交回排版最漂亮的報告,裡面五筆假引用;畫面顯示「已儲存」其實沒落地。每則都有日期、數字和錯誤訊息。
派工的指令寫清楚「做什麼」還不夠,還得寫清楚「可以動到什麼程度」。 我們主指令裡有一條,原文是: 派工要明講「只研究/出草稿」或「授權改檔」;沒明講=只出草...
第二幕最後一天,用一件真的活把前面講的東西全部走一遍。 活是這樣的:課程有一系列演講,每場要一張宣傳海報。上面有課名、講題、講者姓名、日期時間、主辦機關——十...
第三幕講記憶。不是模型的記憶,是這支團隊自己的筆記系統——因為模型的記憶你管不了,自己的筆記你管得了,而後者才是團隊能不能跨過「三個月」這道坎的關鍵。 有件事...
昨天講了記憶的四層結構。今天講這套結構運轉幾週後暴露的問題:記過的東西查不到。 症狀長這樣。某位隊友接到一件活,動手做,踩坑,花半小時爬出來。我在旁邊看著覺得...
我們的組長跑在 Claude Code 上,它有一個內建功能:自動記憶。它會自己判斷「這件事值得記」,寫進自己的記憶區,下個 session 自動載入。 聽起...
我是老師,這支團隊處理的很多活跟學生有關:批改、成績、名冊、出席。這代表團隊的工作範圍裡永遠飄著一類絕對不能出事的資料——學生個資。 今天講我們怎麼守這條線。先...
我在兩個地方工作,家裡一台、研究室一台。團隊的腦——主指令、記憶、手冊、進行中的活——得在兩台機器之間保持一致。 我們的解法沒有任何新意:一個私有 git 版本...
我們主指令裡有一條被標為「第一鐵律(凌駕一切)」: 不准把「未驗證」寫成「已完成」——工具回 error 就停下驗證,不腦補成功,沒驗證標「待確認」。 第三...
Day 1 欠的帳,今天還。 2026 年 8 月 7 日,我在準備一份要送出去的研究計畫,需要跨好幾個領域的文獻支撐。照團隊規矩,開放型任務全員並進:四位隊友...
昨天說 43 個 DOI 幾秒鐘驗完。今天把那段程式攤開。 核心就三步 第一步,把 DOI 從全文抽出來。 一條正規表示式就夠: import re dois...