📝 本系列為 iThome 鐵人賽學習筆記,屬個人教學與非商業用途;文中法規與標準內容均以自身理解後的話轉述並註明出處,非逐字引用。
階段三|台灣有哪些機構與資源

昨天(Day 16)介紹 AI 產品與系統評測中心(Artificial Intelligence Evaluation Center,以下簡稱 AIEC)時,提到它是「一個中心、三種角色」的體系:中心負責制定制度,另外兩個角色負責實際執行——AI 測試實驗室與AI 驗證機構。今天就把這兩個執行機構拆開來,看清楚它們各自是誰、做什麼,以及一個產品從送測到拿到證明,中間要走過哪些關卡。
先用一張組織關係圖把層級定位清楚:AIEC 是「中心」,由數位發展部數位產業署主辦、負責制定制度;它底下有兩個執行機構,分別由兩個不同的法人承接——AI 測試實驗室由財團法人工業技術研究院(以下簡稱工研院)承接、AI 驗證機構由國家資通安全研究院(以下簡稱資安院)承接。這個「測試歸工研院、驗證歸資安院」的對應,是今天最該先記住的一件事。

這一天要先破除一個很常見的混淆:日常語言裡,「測試」和「驗證」幾乎是同義詞,很多人交替使用。但在評測制度裡,它們是兩件不同的事、由兩個不同的機構、依兩套不同的國際標準來做。分不清楚這個差別,就會看不懂「測試報告」和「評價報告」為什麼是兩份東西,也會誤解一張成績單的公信力到底從哪裡來。
在認識兩個機構之前,先用一個生活化的場景把「測試」與「驗證」的差別講清楚——健康檢查,其對照如下圖所示。

你去醫院做健檢時,會經歷兩個階段:
關鍵在於:量數據的人和下判斷的人,是被刻意分開的兩種角色。 因為如果檢驗師既抽血又自己宣布「你很健康」,這個結論就少了一層獨立把關。把「測量」與「判定」分開,正是讓結果可信的制度設計。
AI 評測體系,用的是一模一樣的邏輯:AI 測試實驗室是「檢驗師」,AI 驗證機構是「醫師」。 認識這個對應,下面兩個機構就都好懂了。

如上圖所示,台灣的 AI 測試實驗室由工研院承接,於 2024 年 10 月 29 日成立,是台灣第一座 AI 測試實驗室。它扮演的就是「檢驗師」——依照 AIEC 制定的方法,對送測的 AI 產品實際跑測試、產出客觀數據。
它的幾個重點:
用一句話定位:測試實驗室是那個「拿著標準化考卷、公正閱卷、給出分數」的單位。它只管分數,不管這個分數夠不夠格。

如上圖所示,台灣的 AI 驗證機構由資安院承接,於 2024 年 11 月 15 日成立。它扮演的是「醫師」——不重新測試,而是查核測試實驗室產出的測試報告,確認這個產品確實受到了合理、充分的測試,再進一步出具判斷。
它的幾個重點:
用一句話定位:驗證機構是那個「拿著閱卷結果、對照及格標準、簽名認定通過與否」的單位。它不重算分數,但它的簽名,才讓分數變成一張有分量的證明。
測試與判定若由同一個單位一手包辦,效率看似較高,卻會犧牲最關鍵的一件事——獨立性,也就是公信力的來源。 兩者分立的道理如下圖所示。

如果「測試的人」同時也是「認定合格的人」,那就等於自己考試、自己改考卷、自己發及格證書——不論結果多客觀,都很難讓外界完全信服,因為缺了一層獨立監督。把兩者拆開,讓測試機構專心把數據測準、驗證機構獨立地判斷結果夠不夠格,這張成績單才站得住腳。
這不是台灣獨創的設計,而是國際**符合性評鑑(conformity assessment)**體系的通則:全世界的產品檢驗(從電器安全到食品衛生)幾乎都採「測試」與「驗證」分立的架構。台灣的 AI 評測,一開始就照這個國際通則來設計,正是為了讓未來發出的結果能與國際接軌。
這裡也回答了前面埋的伏筆——為什麼兩個機構都要「通過 TAF 認證」。TAF 是台灣的國家認證機構,由它來確認「這兩個機構本身有沒有資格做測試與驗證」。這就形成一條完整的信任鏈:TAF 認證機構、機構檢驗產品、產品因此可信。TAF 這一層的角色與本土驗證案例,是 Day 19 的專題,今天先記住它是「認證這兩個機構的上層」。
把測試與驗證串起來,一個 AI 產品從送測到取得證明,會走過這樣一條路,如下圖所示:

把兩份報告的差別記牢,這條流程就通了:測試報告回答「這個 AI 考幾分」,評價報告回答「這個分數,夠不夠格、可不可信」。 前者是數據,後者是判斷。
最後收斂成一句:AI 測試實驗室依 ISO/IEC 17025 執行測試並產出測試報告;AI 驗證機構依 ISO/IEC 17065 查核結果並產出評價報告。
(ISO/IEC 17025 與 ISO/IEC 17065 為國際標準的編號與名稱,屬事實引用;本文僅說明其角色定位,不涉及標準條款內容。)
把今天的內容接回本系列的檢索增強生成(Retrieval-Augmented Generation,以下簡稱 RAG)客服範例,可以想像它未來真的要送測時的樣子:
換句話說,本系列後半寫的每一段防禦程式,都是在為這場未來的「送測」預先準備好可以被測、被驗的證據。今天先把「送去哪裡測、由誰判定」這條路徑弄清楚,第四階段的技術實作才知道自己最終要對接的是什麼。
今天把 AIEC 三角色中的兩個執行機構拆開細看:
明天(Day 18)進入這一階段最實用的一天——AIEC 的十大評測項目。 前兩天反覆點名卻始終沒展開的那十項(安全性、可解釋性、彈性……),明天要逐項拆解。它們幾乎可以直接當作本系列最終那份《AI 專案資安合規檢核表》的欄位骨架。