我平常會用 Skill 處理 AI 開發裡的重複工作,但不是每個裝了就有用。這 30 天,我用同一套評分尺——會不會被觸發、輸出對不對、什麼情況會失敗、多花多少成本、最後留不留——逐一實測我真的在用的 Skill。每篇是一次獨立實測,但用的是同一把尺;到第 30 天,這些結果會收成一份可查閱的選用指南,不是 30 篇各自獨立的心得。
我在 Claude Code 裡裝了不少 Skill,但老實說,裝的時候很少真的驗證過它有沒有用——大多是看到別人推薦、讀起來合理,就裝上去了。這 30 天,我...
Day 1 測的 Atomic Commit 是我自己維護的 Skill。今天想換一個從沒自己寫過的——Claude Code 內建的 code-review,...
兩天測下來,我發現一件比任何單一結果都重要的事:這個系列很容易滑向「工具箱文」——裝一個 Skill、講一下感覺、下一篇換一個。要避免這件事,光靠自己小心不夠,...
上禮拜我遇到一件小事,但後來越想越不安。 我在寫一段要打 Anthropic API 的程式碼,想省點 token 成本,就順口問了 Claude「現在要怎麼開...
寫這個系列到第五天,我第一次要測一個我自己每天都在用、離不開的工具——claude-mem。前四天測的都是「聽過、裝了、順手試試」的東西,這篇不一樣:這個外掛已...
前五天測的都是「產出品質」型的 skill——寫得好不好、抓得準不準、記得住記不住,錯了頂多重來一次。今天測的是 Trail of Bits——一間在資安圈子裡...
前六天測過的 skill,考驗的大多是「這個東西懂不懂它宣稱懂的事」——文件查得準不準、記憶記不記得住、掃描抓不抓得到漏洞,這些都是能力層面的問題。今天測的是...
前七天累積下來的清單裡,測過的都是「工具能不能把事情做對」,今天想補一個完全不同的角度:一個 skill 能不能把「事情做對」這件事,用一個特定讀者真正用得上...
寫這篇之前,我對今天的結果其實有一個很篤定的預設劇本:CodeQL 追到、人工追不到,證明進階工具有它不可取代的價值。實測完全不是這樣,這篇能寫成現在這個樣子,...
今天測的是 codex——Claude Code 官方市集裡橋接 OpenAI Codex(GPT-5.4)的套件,讓你在 Claude Code 裡直接叫一個...