在我目前使用的平台中-ChatGPT, Codex, Claude, NotebookLM,生成的簡報都有些優缺點。這些平台設計上易於使用,但相對的可操作性會比較少。下面我們來看看能改進的功能:

直接生成PPT的方案,最大的缺點是畫面單調、圖片排版不足,我覺得能做的是提供更多圖片、文件讓AI有更多資料能呈現。另外生成的品質跟模型和平台harness優化有很大關係,目前看Claude生成的簡報相較之前已經進步許多,已經初步能直接使用。

Codex使用GPT-Image2模型生成簡報,畫面排版、細節都相當不錯。但有一些固定的設計語言,例如色卡區塊、扁平風格的插圖、圖片最下方通常有「3大問題、重點整理」的卡片,這些常見的設計風格讓圖片有"AI感",需要通過風格規範或提示詞工程來解決。

NBLM使用NanoBanana模型生成簡報,美術風格強烈(巨大的插圖、虛幻風格?),讓NBLM產生的簡報相當容易辨識。但NBLM生成的圖片常常資訊量比較少,即使大綱內容明確,可能也需要多次生成才能滿意。
並且NanoBanana系列有個重大問題,生成的中文字容易糊在一起,或是生成無意義的中文字。這是偶發性問題,但多次編輯圖片有高機率觸發,算是有點煩人的問題。
總結來說,目前在圖片生成賽道上,GPT-Image2是中文簡報最強的模型,NanoBanana有些文字上的小問題,不過各家的模型也在快速疊代。這正是模型庫最好的價值,將模型與平台解綁,使用者可以選擇自己最喜歡的模型來用。