從零微調一個資安語言模型,並把它接進 MSSP 的四個真實工作流程:事件報告、報告問答、監控月報、新人訓練。
三十天完整記錄從資料分流、Primus 三階段訓練、Agent 架構到治理設計的全過程,包含一次令人失望的評測結果,以及它如何逼我重新理解「微調到底該解什麼問題」。
這不是一個成功案例的整理,是一份含失敗與修正的實作地圖。結論是:模型可換,治理不變。
本文所有資料皆為合成資料。 這個任務跟前三個不一樣 前三個任務的使用者是資深專業人員,他們有能力判斷 AI 產出的對錯。 新人訓練的使用者是新人——他們沒有...
本文所有資料皆為合成資料。 從單題到全貌 昨天做完了出題與批改。但一題一題答完,如果沒有累積,這個系統就只是一個線上題庫。 真正的價值在於:把每一次答錯,累...