大家好,今天我們不廢話,直接進入最近新聞熱度極高、每個人聽了都怕的題目:Deepfake(深偽)攻擊與語音克隆(Voice Cloning)。
前兩年新聞上報導過這個案例:
2024 年,香港一家公司的財務人員,參加了一場跟英國總部高層的視訊會議。
視訊畫面裡,有他熟悉的財務長(CFO),還有好幾位同單位的同事。
會議中,財務長要求他把一筆錢匯出去。因為「親眼看到、親耳聽到」主管的交代,這位員工不疑有他,乖乖轉出了 2,560 萬美元(大約新台幣 8 億元)。
直到事後確認,他才驚覺:那場視訊會議裡除了他自己,財務長跟其他同事,通通都是 AI 畫出來的假人!
這是已經發生在現實生活中的真實案件,而且現在這項技術變得更便宜、更好上手了。
今天我們就來拆解 Deepfake 到底是怎麼運作的,還有身為資安新手,我們在考試和實務上該怎麼防禦它。
我們在 Day 04 提過,Deepfake 的背後大功臣就是 GAN(生成對抗網路)。
駭客利用這個技術,在實務和考點中,主要透過以下這三大支柱來組成以假亂真的 AI 影片與假聲音:
AI 會去抓取目標人物講話的特徵,像是音調、說話節奏、口音等,然後生成一個「聲紋模型」。
現在的 AI 技術非常誇張,只需要 3 秒鐘的聲音樣本,就可以複製出一個相似度高達 85% 的假聲音。
駭客只要去 YouTube 剪輯高階主管演講的影片,就能輕鬆拿到這 3 秒鐘。
這就是最經典的 AI 影片 技術。
AI 讀取目標人物(比如 CEO)成百上千張不同角度的照片和影片,學習他的面部表情和五官特徵。
然後,AI 會把現成影片裡的「演員的臉」,百分之百替換成「CEO 的臉」,並自動調整光影和肌肉抽動,生成一段看起來完全是 CEO 本人在講話的仿冒 AI 影片。
這種影片常被駭客用來做政治抹黑、假新聞、或是假冒主管發布重大商業命令。
這就是上述香港詐騙案用的終極技術。
它不只是生成一段錄好的 AI 影片,而是在視訊通話的當下,即時(Real-time)進行動態變臉與語音變聲!
駭客在鏡頭前講話,系統會在毫秒之間,把他的臉置換成財務長或同事的臉,連眨眼、嘴型、表情都能百分之百同步,延遲低到在視訊畫面上根本看不出來。
以前遇到可疑的要求,我們會說:「打電話確認一下啊!」或是「傳個 Email 雙重確認吧!」
但現在,這些方法在 AI 面前通通被封殺了:
company-inc.com 冒充 company.inc.com)來發信,肉眼根本很難分得出來。既然技術上防不勝防,那我們該怎麼辦?
SecAI+ 考試跟資安實務給出了一個最有效、也最常考的答案,叫做帶外確認(Out-of-Band Verification)。
簡單說,就是「不要用同一個管道確認」,而且要建立組織內部的流程規範:
只要遇到超過特定金額的匯款指示,必須透過事先約定的「第二管道」進行二次確認。
具體做法可以這樣做:
我們來看看模擬題:
「公司財務主管接到一個聽起來完全像總經理的電話,要求緊急匯款。財務主管隨後發出確認電子郵件,總經理的電子郵件帳號也回覆了確認。事後發現這是 AI 語音克隆詐騙。請問下列哪項安全防禦措施,本可以有效阻止這次的匯款詐騙?」
A. 升級伺服器上的防毒軟體
B. 實施帶外確認程序(Out-of-Band Verification)
C. 要求在信件中附上 PDF 轉帳授權表
D. 查詢總經理的行事曆看他是不是在開會
答案是 B。
遇到 Deepfake 或社交工程詐騙,最有效的不是靠科技,而是靠「流程控制」。帶外確認(用跟原本收到通知完全不同的管道去確認)是考試的絕對標準答案!
今天的重點總結:
明天我們要講 AI 魚叉式釣魚與 AI 變種惡意軟體,看看駭客是怎麼用大模型自動寫出點擊率高達 30% 以上的精準釣魚信。
我們明天見啦!