威脅評分引擎:從雜訊中萃取價值的keywords.py
在我們建構的資安情資監控系統中,如果說 fetchers.py 是負責在外蒐集線索的探員,那麼 keywords.py 就是大腦中的「威脅特徵資料庫」。這份檔案的設計理念,完美呼應了我們在系統規劃階段所強調的重點:我們必須透過「關鍵字分析與風險評分」機制來產出標籤,這樣才能讓情資的分類更具實戰意義。keywords.py 的三大核心設計邏輯:
在軟體工程與自動化管線的設計中,保持程式碼的整潔與可維護性至關重要。
keywords.py 的誕生,正是將「資安領域知識(Domain Knowledge)」從「程式運算邏輯」中抽離的具體實踐。keywords.py 字典中新增關鍵字即可,這大幅降低了維護成本與出錯率。面對海量的開源情報(OSINT),如果不加以收斂,防守方很容易陷入「警報疲勞」。因此,我們在檔案中設計了特定領域的交集比對:
CRITICAL_EQUIPMENT 集合,我們圈出了組織的邊界網通設備、虛擬化基礎架構與身分驗證伺服器。這意味著系統具備了「資產盤點」的視角,能優先抓出針對這些核心重鎮的攻擊情報。FINANCE_KEYWORDS 則是為了賦予系統產業針對性。這樣的架構非常靈活,讀者未來若要將此系統導入醫療或製造業,只需抽換這個區塊的詞彙,就能瞬間打造出專屬該產業的預警雷達。抓取到原始資料後,必須加入關鍵字分析與風險評分機制,才能產出具實戰意義的威脅標籤。這些核心分類與權重皆定義在 keywords.py 檔案中: