從零微調一個資安語言模型,並把它接進 MSSP 的四個真實工作流程:事件報告、報告問答、監控月報、新人訓練。
三十天完整記錄從資料分流、Primus 三階段訓練、Agent 架構到治理設計的全過程,包含一次令人失望的評測結果,以及它如何逼我重新理解「微調到底該解什麼問題」。
這不是一個成功案例的整理,是一份含失敗與修正的實作地圖。結論是:模型可換,治理不變。
先講結論 我花了幾個月的時間,在一台單機的 DGX Spark(GB10,128GB 統一記憶體)上,從零微調一個資安領域的語言模型,並且把它接到四個真實的 M...
不要從模型開始,要從人開始 昨天講了微調該解什麼。今天講的是更前面的一步:這個模型要給誰用、取代哪一段人力、以及那段人力現在是怎麼運作的。 我看過太多 AI 專...
我的硬體條件 先把牌攤開,因為所有的選型決策都是從這裡推出來的: NVIDIA DGX Spark(GB10)一台 128GB 統一記憶體(CPU 與...
為什麼要照著別人的配方走 我沒有從零設計訓練流程,我選擇復現 Trend Micro 提出的 Primus 資安模型訓練配方。理由很務實:我要驗證的是「這套方法...
資料才是主角 昨天講了三階段配方。今天講的是餵進這三階段的東西。 Primus 這套方法之所以能被復現,關鍵不在於它的訓練技巧有多特別——技巧其實都是標準做法—...
這一天決定了整個專案的天花板 如果這 30 天你只讀一篇,我希望是這一篇。 大部分垂直模型專案的失敗,不是敗在訓練技巧,是敗在把資料放錯地方。而且這個錯誤有個惡...
沒有基線的訓練等於盲飛 第一部的最後一天,做一件所有人都知道該做、但很多人跳過的事:在動任何訓練之前,先把未微調的原始模型跑一次完整評測。 跳過它的代價是:訓練...
從估算到實測 Day 3 我用「每參數 12 bytes」估出 4B 級模型可以在 128GB 上做全參數訓練。今天要把估算換成實測,因為估算永遠會少算一塊:激...
今天要做的事 持續預訓練是三階段裡最花時間、最吃資料、但概念最單純的一段。單純不代表容易——它的難處全部在資料工程上。 流程是:清洗 → 切塊 → 混合 → 訓...
從「懂行話」到「照規矩」 CPT 讓模型的語域偏移到資安領域,但它還不知道你要它做什麼。SFT 就是教它做事的階段。 今天的重點不在訓練技巧(SFT 的訓練參數...