試著丟一段訪談逐字稿給 AI,只下這句:
幫我整理重點,寫專業一點。
結果可能很順,問題卻藏在細節裡。原文只說「目前還要再觀察」,AI 卻整理成「受訪者認為成效有限」。語意看似接近,但後一句已經替受訪者多下了一個結論。
這代表 Prompt 還少了驗收條件。第一條可以先寫:
原文沒有的資訊不要推測;無法確認就標示「資料不足」。
接著再補上其他要求,例如「300 字內、分成三點、每點附原文依據」。這樣下一次結果不好時,才能知道究竟是資訊亂補、格式跑掉,還是漏了重點。
這些條件很像考卷的評分標準。只說「寫好一點」,每次都只能憑感覺改;把標準寫下來,才有辦法一項一項檢查。
所以寫 Prompt 前,我現在會先問:這次的產出,我要拿什麼判斷它算不算過?
延伸閱讀
Schulhoff et al., The Prompt Report: A Systematic Survey of Prompting Techniques, arXiv:2406.06608, 2024.