摘要
本文從兩個常見情境出發,重新理解 ChatGPT 語音模式可以放在工作流程的哪個位置。當腦中的想法還很零散、甚至連提示詞都不知道怎麼寫時,可以先直接開口,把尚未整理的內容說出來,再讓 ChatGPT 協助組織成可以繼續工作的初稿;而在讀完文章、課程或其他資料後,也可以把順序反過來,先說出自己的理解,再讓 AI 根據原始內容校正、追問與補充。透過這兩個案例,你會看到語音模式的用途不只在省下打字時間,而是讓對話可以從「還沒想清楚」開始,也能在需要自己思考的時候,刻意讓 AI 晚一點出手。
打開 ChatGPT,最簡單的情況是:你已經知道自己要什麼。
真正麻煩的,是你連問題都還沒整理好的時候。早上剛坐到電腦前,文章、待辦、昨天沒做完的工作全部擠在腦中。這時候要我寫提示詞,我反而先卡住了。因為要問 AI 以前,我得先把自己整理好。
後來我換了一個方法:
先不要整理。直接講。
也是從這裡開始,我才發現 ChatGPT 語音模式的價值,不只是少打幾個字。
以前要先想清楚,才能開始問;現在可以先開口,再慢慢把問題想清楚。
但還有另一種時候,我反而希望 AI 晚一點出手。所以這篇我想試兩個場景:

如果是在 ChatGPT Work 裡使用語音,可以從桌面版 ChatGPT 進入 Work,再點選語音控制開始對話。
第一次使用時,系統會要求開啟麥克風權限;如果後續工作需要使用電腦上的內容,也可能需要其他系統權限。

〔截圖 1:在 ChatGPT Work 中開啟 Voice,標示語音控制按鈕〕
開啟之後,不需要先錄完一整段再送出。你可以直接跟 ChatGPT 來回說話,也可以在它回答到一半時插話、補充條件或改變方向。這點非常重要。因為接下來的兩個例子,都不是靠一段寫得很完整的提示詞完成。
反而是邊講、邊想、邊修正。
準備開始寫 Day11 時,我其實已經想到不少內容。要介紹語音模式怎麼使用、第一段該放什麼、後面要安排哪些案例,甚至連大概想傳達的觀點都有了。問題是,這些東西全部散在腦袋裡。
如果現在要我直接開始寫文章,我反而會先卡在:
到底要從哪一段開始?
我直接打開 ChatGPT Work 的語音模式,告訴它:
我剛開始來寫 Day11 文章的草稿內容,目前腦中有不少敘事內容還沒被整理好。
我先把想到的事情全部講給你,在我說完以前先不要急著幫我安排文章結構。
接下來就直接講。不用照文章順序。不用先判斷哪一段比較重要。
想到 語音模式要怎麼介紹,就先講;想到後面的案例,再繼續補。

〔截圖 2:使用語音模式先口述 Day11 的零散想法,ChatGPT 即時顯示對話內容〕
等我覺得想法差不多都講完之後,才進到下一步。
這次我才真正給它一個明確任務:
這是我的起頭跟第一個 Case 案例,請幫我把它整理成比較屬於我自己的文章風格,先起草,並且放到目前的資料夾底下。
這時候,剛才散落的內容才開始被整理成文章。
前面我負責把腦中的東西倒出來,後面才交給 ChatGPT 把它變成一份可以繼續修改的初稿。
而且整個過程中,我最一開始甚至沒有一個整理好的提示詞。這也是我覺得語音模式很有意思的地方。
它的價值不只是「講話比打字快」,更可以在當想法還亂到不知道第一句該怎麼打時,工作就已經可以開始了。
這是我使用語音模式後最明顯的感受。
以前打字時,我總會想先把問題整理好,再交給 ChatGPT;但用語音模式之後,我可以先把腦中的東西說出來,邊講、邊整理。有時候你不需要先知道問題長什麼樣子,對話就可以開始。原本我以為這最適合拿來腦力激盪、整理想法。
但後來我發現,還有另一個我更想直接開口的時刻:剛看完一個東西的時候。
看完一篇文章後,我們很容易直接問 ChatGPT:「幫我整理這篇文章的重點。」
這確實很快。但如果今天的目的不是快速取得摘要,而是想確認自己到底有沒有看懂,我想把順序反過來。
先由我說出理解,再讓 AI 幫我校正。
這次我拿商業周刊的〈孩子越依賴 AI,越可能不會思考?未來拉開差距的是這 3 種能力〉來測試。
開始以前,我先確認一件事情:ChatGPT 到底有沒有拿到原文。
我直接用語音模式問:
我現在想要跟你一起探討這篇文章的內容,
你現在看得到文章嗎?
ChatGPT 告訴我,目前只能看到語音對話,還沒有文章內容,所以我先把網址貼進去。
等它確認可以讀取之後,我們才真正開始討論。這一步看起來很小,卻很重要。
接下來要讓 ChatGPT 與我討埨「AI 與教育」,讓它根據同一篇文章,檢查我的理解有沒有偏掉。
所以我先把這場對話的角色定清楚:
按照這篇文章的標準來看,
我現在先自己講完我的理解,再讓你幫我校正,
算不算作者所說的把 AI 當成陪練隊友?
如果我要避免最後又把思考外包給你,
我應該把哪些步驟留給自己做?
ChatGPT 給我的方向是:觀點、判斷、理由,以及最後要不要接受答案,仍然應該由自己完成;AI 更適合負責指出遺漏、提出反例、檢查事實,再繼續追問。
有了這個界線之後,我才開始講自己的理解。
我覺得作者真正擔心的,不是學生使用 AI 這件事情,
而是學生開始把原本應該自己完成的理解、判斷跟表達,
一次全部外包給 AI。
所以真正的問題應該是:
我們要怎麼確保自己知道,為什麼要相信這個答案?
這時候 ChatGPT 沒有重新幫我摘要文章。
它先確認我的理解有沒有抓到作者的核心,再把問題繼續往下推:

〔截圖3:使用 ChatGPT Work 語音模式下跟 AI 討論文章範例〕
如果「知道自己為什麼相信」很重要,那哪些學習環節最需要保留給自己?
於是這場對話慢慢從「這篇文章寫了什麼」,走到「我是怎麼理解它的」,最後再往下走到「這個觀點對我代表什麼」。讓 AI 晚一點出手,反而更容易看見自己懂了多少
跑完這個案例後,我最有感的其實不是 ChatGPT 幫我抓出了多少重點,而是整個順序變了。
平常看到一篇長文章,我很容易直接請 AI 摘要;這次我刻意先讀、先想,再把自己的理解說出來。等到觀點已經形成,才讓 ChatGPT 根據原文校正、反問,找出我漏掉或還沒想清楚的地方。
這時 AI 比較像陪練:答案沒有先出現,我反而更容易看見自己的理解停在哪裡。
如果目標是學會一件事,可以先讓自己完成一次理解,再讓 AI 介入校正。
而且這個方法不只適合文章。看完課程、聽完 Podcast,甚至剛結束一場會議,都可以先用自己的話講一次,再讓 AI 根據原始資料、筆記或逐字稿幫忙核對。
📌 補充:Voice 跟聽寫,到底差在哪裡?
做到這裡之後,我覺得 Voice 跟聽寫的差異其實很好判斷。
- 聽寫解決的是「輸入」。
你已經知道自己要說什麼,只是不想打字,希望把一段口述轉成文字。- 語音模式處理的是「對話」。
你說一句,ChatGPT 回應;回答途中想到新的條件,可以直接補充;方向理解錯了,也能馬上修正,再繼續往下談。
寫完這篇之後,我對 ChatGPT 語音模式最大的改觀,是開始把它放進那些還不適合打字的時刻。
腦中的想法還很亂時,我可以先講,讓問題在對話裡慢慢成形;剛吸收完一段資訊時,我也可以先講,把自己的理解攤出來,再讓 ChatGPT 幫忙找出遺漏、提出反例或繼續追問。同樣都是開口跟 AI 對話,前者是在幫助想法成形,後者則是在保留自己的思考過程。
所以之後遇到輸入框卻不知道第一句該寫什麼時,也許不需要再逼自己先整理出一個漂亮的提示詞。先想想現在缺的是整理,還是陪練;然後直接開口。 有些工作,可以從還沒想清楚的地方開始;有些答案,則值得讓自己先想過一次,再交給 AI。