在 Day 12 文章裡談規則式(Rule)Guardrails 時有個界線很明顯:有些事情只要條件寫得夠清楚,根本不需要 LLM As A Judge 來協助...
在 Day 10 的文章裡,筆者把合成資料的品質檢查拆成三層:先看資料結構,再用確定性規則核對已知條件,最後才把難以直接寫成規則的問題交給語意判斷。 讀者可能會...
Day 7 到 Day 10 分別談了 Seed、Stage、Dependency 與 Quality Control。四個部分各自拆清楚後,要把它們接成一條...
剛好鐵人賽挑戰進行到一半,休息一下吧! 來聊聊 LLM 在駭客間的電子競技賽事 - CTF 中到底是怎麼崛起的,會比較偏向於自己的經驗以及社群中發生的大新聞。...
Day 9 把 redacted_text 和 entity_candidates 接回同一版 source_text。這能避免三份資料各說各話,卻還不能回答一...
昨天 Day 7 的文章先把一筆 Guardrails 測試案例寫成種子資料(Seed Contract),分清楚哪些條件要固定、哪些內容可以變化,以及哪些資訊...
上一篇先把 Guardrails 的六個驗收情境改寫成合成資料需求,並且分清楚三類條件:哪些一定要固定、哪些可以變化、哪些不能交給模型自行發明。 接下來很容易直...
在 Day 5 的文章中我們把「不要洩漏個資」拆成六個可以重跑的驗收情境,而文章最後留了一個很實際的問題:在測試 Guardrails 時三個案例可以手搓一搓生...
筆者在 Day 4的文章裡談到,企業為什麼不能只要求 Guardrail「接得上」或「能跑得動就好」。 當企業今天用了 A Guardrail,半年後可能換成...
筆者在 Day 3 的文章中把「不要洩漏個資」這句要求,拆成三件事: 系統要檢查什麼 照什麼規則判斷 發現問題後要怎麼處理 如果今天只有一個客服系統、一個模...
今天的文章來自 HTTP/2 Bomb - Calif [1] 這是一篇由資安公司 Calif 提出的研究,跟先前介紹過的 XBOW 一樣都是 LLM Driv...
生成式 AI 雖然能快速整理資訊,但如果缺少可靠的資料來源,仍可能產生內容錯誤或回答過時等問題。為改善這種情況,可以導入 RAG(Retrieval-Augme...
Day 2 把 Guardrails 可以介入的位置展開了:從使用者輸入、檢索資料,到工具執行前後,都可能需要控制。但架構圖、流程圖畫完,工程師還有一個問題沒得...
回到了 Agent Finding 的一天,今天要講的是 Anthropic Mythos 發現的 twigphp/twig - code injection...
上一篇,筆者把問題放在企業的 GRC 需求:政策要求系統控制什麼,又要留下什麼證據,才能說明控制確實發生? 回顧:《Day1:AI Guardrails 不應...
現在很多 AI 旅遊工具,本質上是「很會講話的建議產生器」:它給你一段漂亮的行程文字,然後你要自己把每個景點、每個時間搬進行程表,一起出發的朋友再各抄一份。 我...
昨天聊完 ImageMagick 曾經出現過的兩個漏洞,今天終於要來淺析 XBOW 團隊的 A Shell Is Worth a Thousand Images...
大家好,我是鯨魚 (whale120)! 這是我第一年參加 iThome 鐵人賽,關於我的簡介可以看 iThome 的 profile(link) 以及部落格(...
前言 近幾年,生成式 AI 發展快速,從 ChatGPT, Gemini, On Premises Model (Gemma, Llama, Qwen),我們只...
查核資訊: 本文於 2026-08-25 重新確認各項資源的官方頁面。OWASP 清單、靶場內容、模型版本與工具介面都可能變動;開始練習前,仍應回到官方文件確...
考量到知識庫的建設與維護不是一朝一夕,有兩件事建議大家可以先做:Git 和「建設歷程」。 我說:「要有 Git」就有了 Git 一個 prompt 完成 「幫...
查核資訊: 本文於 2026-08-25 查核 NIST AI Risk Management Framework、NIST AI 600-1、NIST SP...
查核資訊: 本文於 2026-08-25 查核 NIST 的 AI Red Teaming 定義、NVIDIA garak 與 Microsoft PyRIT...
查核資訊: 本文於 2026-08-25 查核 OWASP LLM10:2025 Unbounded Consumption、MITRE CWE-770 與...
上下文限制、無狀態、脈絡腐化:讓你用 AI 用得不夠暢快 首先:AI 一次能看的東西是有限的。 以 Claude 為例,依模型不同,一次可以處理約數十萬甚至上百...
Day 21 · W3 · AI 線 + 無障礙線 · 難度 ★★★☆☆ 本系列由 AI 協作撰寫。 內容、技術判斷、程式碼由 light-design 數位...
查核資訊: 本文於 2026-08-25 查核 OpenTelemetry 官方規格與敏感資料指引、OWASP Logging Cheat Sheet、RFC...
豪,開工。 今年真的很多知識庫相關的內容,直接搜 Second Brain、NotebookLM、OpenWiki 想必可以搜到很多內容,其實多多少少有點焦慮自...
查核資訊: 本文於 2026-08-25 查核 NIST PII 定義、OWASP LLM02:2026 與 Presidio 官方文件,並引用同日完成的離線...
查核資訊: 本文於 2026-08-25 查核 OWASP LLM03:2026、OWASP Top 10 for Agentic Applications...