iT邦幫忙

鐵人檔案

2026 iThome 鐵人賽
回列表
AI Engineering

同一把尺,30 天橫評 AI Agent Skill:從單篇實測到一份能查的選用指南 系列

我平常會用 Skill 處理 AI 開發裡的重複工作,但不是每個裝了就有用。這 30 天,我用同一套評分尺——會不會被觸發、輸出對不對、什麼情況會失敗、多花多少成本、最後留不留——逐一實測我真的在用的 Skill。每篇是一次獨立實測,但用的是同一把尺;到第 30 天,這些結果會收成一份可查閱的選用指南,不是 30 篇各自獨立的心得。

參賽天數 23 天 | 共 23 篇文章 | 0 人訂閱 訂閱系列文 RSS系列文
DAY 11

Day 11 | 官方說省 65% token,我量出來是 39%

Day 8 測 i-have-adhd 的時候,提過一個常被拿來跟它相提並論的 skill 叫 caveman,當時只記了定位差異,沒有實測,說要留到以後。今天...

2026-09-25 ‧ 由 Ci 分享
DAY 12

Day 12 | 一個「AI 本來就該做到」的原則,裝上 skill 之後差在哪

Day 8 排隊的兩個候選,caveman 上禮拜測完了,今天輪到另一個:ponytail——GitHub 上有 14 萬多顆星星、一個把 YAGNI 原則(你...

2026-09-26 ‧ 由 Ci 分享
DAY 13

Day 13 | 性質測試最值得學的一課,不是「讓亂數幫你找 bug」

今天想聊 Trail of Bits 的 property-based-testing。跟 Day 6、Day 9 講過的 static-analysis、Co...

2026-09-27 ‧ 由 Ci 分享
DAY 14

Day 14 | superpowers:把「除錯先查根因」寫成規則的技能包

今天想介紹 superpowers,官方 marketplace 裡的一個技能包,很紅,我自己平常也開著用。它要解決的問題很具體:工程師都知道「修 bug 前要...

2026-09-28 ‧ 由 Ci 分享
DAY 15

Day 15 | test-driven-development:規定「沒有失敗的測試就不准寫程式」的技能

昨天介紹了 superpowers 這套技能包裡的 systematic-debugging,也測到一個不算好聽的結果:規則寫得再明確,這次實測下來還是被跳過了...

2026-09-29 ‧ 由 Ci 分享
DAY 16

Day 16 | skill-scanner:一個把自己「抓不到多少」講清楚的 Skill 安全掃描工具

這系列走到今天,裝過的 plugin、skill 已經一大串了。每次都在測「這個 skill 有沒有用」,卻沒問過另一個更基本的問題:這些從 marketpla...

2026-09-30 ‧ 由 Ci 分享
DAY 17

Day 17 | prompt-improver:在你的話送出去之前,先攔下來評一次的 hook

今天介紹的 prompt-improver,又是從工程大腦挖出來的——1,929 顆星,作者的口號是「Type vibes, ship precision」,中...

2026-10-01 ‧ 由 Ci 分享
DAY 18

Day 18 | grill-me:把模糊的需求,逼成一棵問到底的決策樹

昨天測的 prompt-improver,主張是「自動攔下模糊的話,問清楚再做」,結果是規則讀了、範例也對上了,實際判斷卻沒接住。今天換一個做法完全不同的機制,...

2026-10-02 ‧ 由 Ci 分享
DAY 19

Day 19 | grill-with-docs:邊問邊把詞彙表寫下來,但不是什麼決定都寫成 ADR

昨天測 grill-me,今天測它的進階版 grill-with-docs——同樣來自 Matt Pocock 的技能包,疊了一層新主張:不只問清楚,還要邊問邊...

2026-10-03 ‧ 由 Ci 分享
DAY 20

Day 20 | ui-test:真的用瀏覽器去弄壞頁面的測試技能,但要指名道姓才叫得動

這系列測到今天,還沒碰過一個完全不同的領域:用真的瀏覽器去測 UI。今天介紹的 ui-test,來自 Browserbase——做雲端瀏覽器基礎設施的公司,旗下...

2026-10-04 ‧ 由 Ci 分享