iT邦幫忙

2026 iThome 鐵人賽

DAY 10
0
Claude AI

Claude Code 實戰筆記:AI coding 沒有新問題系列 第 10 篇

# Day 10:AI 的短期記憶比你想的還短

  • 分享至 

  • xImage
  •  

神奇的數字七

1956 年,認知心理學家 George Miller 發表了一篇後來成為該領域被引用次數最高的論文之一:"The Magical Number Seven, Plus or Minus Two"。他的發現很直覺:人類的短期記憶一次只能處理大約七個東西 — 七個數字、七個詞、七個概念。超過這個容量,前面的就開始掉。

這不是因為人笨。是短期記憶有物理上限。不管多聰明的人,同時追蹤十五件事情就會開始漏。解法不是變聰明,是把東西分組、做筆記、建結構 — 用外部工具補償內部容量的不足。

七十年後,AI coding agent 碰到了同一堵牆。只是單位從「七個 chunk」換成了「一個 context window」。

Context window 是什麼

每次跟 Claude Code 開一個對話,agent 能看到的所有東西 — 系統指令、CLAUDE.md、記憶索引、你說的每一句話、agent 讀過的每一個檔案、跑過的每一個指令的輸出 — 全部塞在一個固定大小的 context window 裡。

這個 window 有上限。當對話越來越長,token 用量逐漸逼近上限。Claude Code 會自動壓縮較早的對話內容,保留摘要、丟掉細節。就像人忙了一整天,早上討論的細節到下午只記得大概結論 — agent 也是。

Day 9 講的記憶系統是長期記憶 — 跨對話持久化,下次還在。Context window 是短期的工作空間 — 只在這次對話內有效,而且容量有限。認知科學早就知道這兩種記憶的區別。AI agent 的架構不過是同一個區別的技術實現。

飽和的症狀

Context window 飽和不會報錯。它的表現是 agent 變鈍:

開始忘記對話前半段討論過的決定。二十分鐘前說好用 Strategy A,現在它又在提 Strategy B。

對話中做過的補充和修正開始失效。CLAUDE.md 本身每次壓縮後會重新載入,但你在對話過程中額外交代的脈絡 —「這個 API 要用 v2 不要用 v1」「剛剛那個方向不對,改用 X」— 這些會在壓縮中被摘要成一句話,甚至消失。Agent 手上有規則,但丟了你給的例外和補充。

開始重複問已經回答過的問題。Agent 讀過的檔案內容在壓縮後只剩一行摘要,細節不見了。

這些現象的共通點:不是 agent 變笨了,是它即時能處理的資訊裝不下了。對話越長,這個問題越明顯。事後打 /usage 可以看到有多少用量來自超過 150K context 的對話 — 如果比例很高,就是該更積極壓縮和換窗的信號。

怎麼管理工作記憶

認知心理學的解法是 chunking — 把零散資訊打包成有意義的組塊,讓七個 slot 裝更多東西。AI agent 有對應的做法。

最直接的是 /compact。這個指令主動觸發對話壓縮 — 把較早的對話摘要成更短的版本,釋放 context 空間。適合在完成一個階段性任務之後用:debug 完一個問題、實作完一個功能,在進入下一個任務之前 /compact 一次,把前一段的細節壓縮成結論。

任務之間沒有強依賴的話,開新對話比在同一個長對話裡繼續更有效。不想離開 terminal 也可以用 /clear — 效果一樣,在同一個 session 裡清掉 context 重來。新的 context window 重新從 CLAUDE.md 和記憶載入,不帶前一段任務的殘留。Day 9 的記憶系統在這裡發揮作用 — 長期記憶確保換了對話不會從零開始。

再進一步,Claude Code 可以把一件事交給 subagent 處理 — subagent 有自己獨立的 context window,跑完把結果交回來。主對話只收到結論,不收到過程中讀了哪些檔案、跑了哪些指令的完整輸出。這跟人類開會做的事一樣:不是所有人都需要知道所有細節,每個人負責一塊,匯報結論就好。

邏輯是同一個:不要讓一個 context window 裝所有東西。該壓縮就壓縮,該換窗就換窗,該拆分就拆分。

七十年同一堵牆

Miller 在 1956 年描述的不是缺陷,是特性 — 短期記憶的容量限制迫使人類發展出 chunking、外部記憶、分工協作。這些不是繞過限制的 hack,是因為限制而生的設計。

AI agent 的 context window 限制也不是等著被修好的 bug。模型越來越大、window 越開越寬,但只要是有限的,管理工作記憶就永遠是使用者的責任。

這個系列一路走來的做法 — 指令檔控制篇幅、context engineering 精準餵資訊、記憶系統分離長期與短期 — 底層原因都是同一個:工作記憶有限,所以要精簡、要結構化、要把不需要即時存取的東西移到外面。

七十年前的認知心理學實驗室,和 2026 年的 terminal 裡,撞的是同一堵牆。差別只是從七個 chunk 變成了二十萬個 token — 但「有限」這兩個字沒變。


延伸閱讀


上一篇
# Day 9:AI 每次對話都從零開始,跟新人沒有差
下一篇
# Day 11:多開幾個 AI 不會讓事情變快
系列文
Claude Code 實戰筆記:AI coding 沒有新問題 共 18 篇
圖片
  熱門推薦
圖片
{{ item.channelVendor }} | {{ item.webinarstarted }} |
{{ formatDate(item.duration) }}
直播中

尚未有邦友留言

立即登入留言