我平常會用 Skill 處理 AI 開發裡的重複工作,但不是每個裝了就有用。這 30 天,我用同一套評分尺——會不會被觸發、輸出對不對、什麼情況會失敗、多花多少成本、最後留不留——逐一實測我真的在用的 Skill。每篇是一次獨立實測,但用的是同一把尺;到第 30 天,這些結果會收成一份可查閱的選用指南,不是 30 篇各自獨立的心得。
Day 8 測 i-have-adhd 的時候,提過一個常被拿來跟它相提並論的 skill 叫 caveman,當時只記了定位差異,沒有實測,說要留到以後。今天...
Day 8 排隊的兩個候選,caveman 上禮拜測完了,今天輪到另一個:ponytail——GitHub 上有 14 萬多顆星星、一個把 YAGNI 原則(你...
今天想聊 Trail of Bits 的 property-based-testing。跟 Day 6、Day 9 講過的 static-analysis、Co...
今天想介紹 superpowers,官方 marketplace 裡的一個技能包,很紅,我自己平常也開著用。它要解決的問題很具體:工程師都知道「修 bug 前要...
昨天介紹了 superpowers 這套技能包裡的 systematic-debugging,也測到一個不算好聽的結果:規則寫得再明確,這次實測下來還是被跳過了...
這系列走到今天,裝過的 plugin、skill 已經一大串了。每次都在測「這個 skill 有沒有用」,卻沒問過另一個更基本的問題:這些從 marketpla...
今天介紹的 prompt-improver,又是從工程大腦挖出來的——1,929 顆星,作者的口號是「Type vibes, ship precision」,中...
昨天測的 prompt-improver,主張是「自動攔下模糊的話,問清楚再做」,結果是規則讀了、範例也對上了,實際判斷卻沒接住。今天換一個做法完全不同的機制,...
昨天測 grill-me,今天測它的進階版 grill-with-docs——同樣來自 Matt Pocock 的技能包,疊了一層新主張:不只問清楚,還要邊問邊...
這系列測到今天,還沒碰過一個完全不同的領域:用真的瀏覽器去測 UI。今天介紹的 ui-test,來自 Browserbase——做雲端瀏覽器基礎設施的公司,旗下...