原文:AI-Generated Images Can Perform as Well as Stock Photography
現在很多設計工作開始會用 AI 生圖,尤其是網站 Banner、Hero Image、活動視覺,AI 的優點很明顯:快、便宜,而且要改場景、人物、構圖都比重新找圖方便很多。但實際放到網站上時,團隊常常還是會有一個疑問:「如果使用者知道或看出這是 AI 圖,會不會覺得品牌很假、不專業,甚至降低信任感?」
NN/g 這篇 AI-Generated Images Can Perform as Well as Stock Photography,就是在測這件事。研究找了 77 位美國成年人,讓他們看 6 個虛構顧問公司網站版本,網站內容幾乎一樣,唯一不同的是 Hero Image,有 3 張 AI 生成圖、3 張真實圖庫照片,而且受試者事前不知道裡面有 AI 圖。每個頁面看 10 秒後,再去評分這家公司看起來有多可信、專業、真實。
我原本其實也會直覺覺得,AI 圖可能多少會扣分,尤其人物如果看起來太完美、太假,很容易有一種「這公司是不是隨便生張圖放上去」的感覺。但這次研究的結果反而滿有趣:在使用者不知道圖片來源的情況下,AI 圖並沒有比真實 Stock Photo 更不可信。
AI 圖沒有輸,但也不能解讀成「AI 圖比較好」
這次研究裡,AI 圖在 Trustworthiness、Professionalism、Authenticity 三個指標的平均分數其實都稍微高一點,不過大部分差異都沒有達到統計顯著。只有 Authenticity 有顯著差異,但也只高了 0.4 分,而且量表是 1~7 分。
所以這裡不能直接下結論說「AI 圖比真人照片好」。研究自己也有特別提醒,他們只測了 6 張圖片,而且情境是虛構的顧問公司網站,圖片也都是 Workplace Collaboration 類型,不能直接推到所有品牌、產業和圖片類型。
我覺得比較合理的解讀是:AI-generated 這件事本身,不一定會讓圖片自動扣分。
真正影響感受的,反而是圖片裡呈現了什麼。
像是不管 AI 圖還是真實照片,只要畫面裡的人看起來真的在合作、有互動,就比較容易讓人覺得這家公司重視 Teamwork,也比較值得信任。反過來,有一張真人照片反而因為人物站位、肢體語言和多元性呈現不佳,被受試者認為不夠有合作感,甚至降低信任。
所以從 UX 角度來看,問題可能不應該只是:「這張是不是 AI 生的?」而是「這張圖有沒有真的傳達這個頁面希望使用者感受到的東西?」
Diversity 不只是「畫面裡有不同人種」就好
這篇另外一個我覺得滿值得注意的地方,是受試者其實很在意圖片裡的 Cultural and Gender Representation。
有些 AI 圖因為呈現出比較多元的團隊,反而收到正面評價;真人照片裡,只要畫面呈現不同族群、女性擔任比較核心的位置,也會讓人對公司產生比較好的印象。
但這裡不是說:「那以後生圖記得塞不同性別、不同膚色就好了。」文章反而提醒,AI 不會自動做出 Inclusive Design。真正要看的還包括:誰被放在領導位置?誰總是在旁邊支援?人物彼此怎麼互動?有沒有一直複製性別、年齡、職業或族群刻板印象?
我覺得這一點其實滿重要。因為 AI 生圖很容易讓人覺得「我 Prompt 裡有寫 diverse team,所以就沒問題」,但多元不只是人數配額,而是整個畫面怎麼描述不同角色。
如果每次都是男性站在中間講話、女性坐旁邊聽,就算畫面看起來很多元,本質上還是在複製某種刻板印象。
真正容易扣分的,可能是「使用者覺得這張圖很 AI」
雖然整體而言 AI 圖沒有比較不可信,但研究裡還有一個很有趣的現象:少數受試者會主動猜某張圖是不是 AI 生成的,而且只要他們覺得那張圖是 AI,通常就會給網站比較低的評價。
更有趣的是,有時候他們猜錯了。某張其實是真人拍攝的 Stock Photo,也有人覺得它「看起來像 AI」。
這代表一件事:使用者可能不是在懲罰「AI 圖」本身,而是在懲罰某種 Fake、Unnatural、Too Perfect 的感覺。
這也是我覺得很值得設計團隊注意的地方。你今天就算真的花錢買了一張真人 Stock Photo,如果人物姿勢太刻意、表情太制式、燈光和構圖太像 AI,使用者一樣可能覺得假。反過來,AI 圖如果人物互動自然、細節合理、整體符合情境,未必會被負面看待。
所以最後要 Review 的不只是「這是不是 AI 圖」,而是「這張圖看起來像不像真的會發生」。
「沒有告知是 AI」和「知道是 AI」是兩個不同問題
這篇有一個很重要的限制:受試者一開始並不知道哪些圖是 AI。
所以研究能回答的是:當圖片來源不知道時,AI 圖會不會天然比較不可信?目前這個研究看起來沒有。
但它不能回答另一個問題:「如果我明確告訴使用者這張是 AI 生成的,結果會不會一樣?」
文章也特別提到,這件事之後會越來越重要,因為 AI 內容揭露相關法規正在發展,而其他研究也曾發現,當人們知道某個人或組織使用 AI 時,信任有可能下降。
我覺得這裡很值得分清楚。圖片品質是一個 UX 問題,AI Disclosure 又是另一個信任問題。
所以不能因為這份研究說「AI 圖表現不差」,就延伸成「那就不用管使用者知不知道是 AI」。這兩件事並沒有在同一個實驗裡被證明。
AI 圖還是要像一般設計素材一樣 Review,而且要多看一層
文章最後整理了一個我覺得很實用的判斷方式。AI 圖真正要看的,其實和一般圖片很像:它有沒有支持頁面的 Message?人物代表性是否合理?場景和互動看起來真不真?最後放進 Interface 裡,Crop、Size、Placement 合不合理?另外 AI 圖還要多檢查一些常見錯誤,例如文字、手、螢幕、玻璃反射和背景細節。
除此之外,AI 圖還多了一層一般 Stock Photo 不一定會遇到的問題,就是它怎麼被產生的。像是 Training Data、Copyright、Consent、人物相似度,以及工具本身是否允許 Commercial Use,這些都不能只從「畫面看起來很好看」來判斷。
所以我覺得 AI Image 比較適合被當成另一種 Design Asset,而不是一個「因為是 AI,所以特別好」或「因為是 AI,所以不能用」的東西。
我的延伸思考
我覺得不能這樣推。
這個研究只能證明,在這次特定情境裡,AI 圖沒有天然劣勢,不代表每一種場景都適合 AI。
例如如果今天是公司 About Us 頁面,要呈現「這就是我們真的團隊」,那用 AI 生一群不存在的員工,我覺得就會碰到完全不同的 Authenticity 問題。因為這時圖片不只是裝飾,而是在傳達一個事實。
但如果今天是活動 Landing Page,需要一張「一群人在開會」的情境視覺,那 AI 圖就可能是一個很實際的素材選擇。
所以 PM 或 Designer 要問的不是「AI 能不能用」,而是:這張圖片在這個頁面裡扮演的是裝飾、情境示意,還是真實證據?
用途不同,能接受的 AI 程度也不一樣。
我看完這篇會比較偏向後者。
因為研究裡真正影響評價的,很多都是人物互動、合作感、Representation 和 Authenticity。甚至真人 Stock Photo 也可能因為太像 AI,而被使用者降低評價。
所以對 UX 來說,可能比「AI vs Real」更值得問的是:這張圖片有沒有讓人相信這個情境?
如果畫面人物全部笑得一模一樣、姿勢太完美、每個人都像在演「我們正在開會」,就算是真人拍的,還是會很假。
我覺得滿有可能。
以前找 Stock Photo 還要搜尋、下載、試版,成本比較高;AI 現在可能幾分鐘就能生十幾張,很容易變成「差不多就這張」。
但這篇其實提醒了一件相反的事:生成變容易,不代表 Review 可以變少。
因為除了傳統的構圖、訊息、Brand Fit,現在還要多檢查 AI Error、Representation、Copyright、Consent、Disclosure 等問題。某種程度上,製作圖片的時間可能下降了,但選圖和判斷的責任反而沒有減少。
最後
看完這篇之後,我覺得它最大的價值,是把「AI 圖會不會讓品牌看起來很假」這個很容易靠感覺吵的問題,真的拿去做了一次 User Research。
結果不是「AI 圖超越真人照片」,也不是「使用者根本不在乎 AI」。
比較精準的結論是:至少在這次測試的情境裡,當使用者不知道圖片來源時,AI-generated Images 並沒有天然的 Trust Penalty。真正更重要的,是圖片本身有沒有自然、可信、符合情境,而且有沒有合理呈現人物與互動。
我覺得這對現在做產品的人滿有參考價值。與其一直爭論「AI 圖可不可以用」,不如把它拉回到比較基本的 UX 問題:這張圖有沒有幫助使用者理解頁面?有沒有符合品牌?看起來可信嗎?放在這個情境合理嗎?
AI 只是產生圖片的方法,最後放到產品裡,它還是要接受和其他 Design Asset 一樣的檢驗。