Day 17 透過 Prompt Engineering,已經可以讓 Gemini 以 SOC Analyst Assistant 的角色分析 Security...
人工審閱是評估 AI 回覆時有用的參考基準,但它的成本很快就會失控。幾位審閱者可以仔細檢查幾十、上百段對話;要他們評一萬段,就完全是另一回事了。用另一個 LLM...
第 18 天開始整理 Model Registry 之後,我又遇到一個問題。
我們不是已經有 Harbor 了嗎?
Harbor 本來就可以管理 Image、版...
前言:測試下載/合併邏輯,要真的建立檔案嗎?
這個系列的下載邏輯大量操作檔案系統:建立目錄、寫入片段、檢查檔案大小、合併檔案、刪除多餘檔案。如果測試都真的去操作...
前言:一次追問「證據在哪」,翻出了原本被忽略的殘留
回到 Day 20 那個真實案例,今天完整走一次「宣告完成 → 被要求提出證據 → 證據揭露出殘留」這個過程...
前言:進入第四部,用真實案例把前面 23 天的原則串起來
從今天開始是這個系列的第四部:實戰案例與總結。前面 23 天講了不少原則——假陽性測試、過度 mock...