上次找同學陪我練口試,她人很好,聽我講完就說「很清楚啊,應該沒問題」。練完我心裡更慌——因為我知道那不是真的口試會發生的事。委員不會因為我講得流暢就放過我,他們會追問我為什麼選這個統計方法、抽樣有沒有代表性、量表的信效度報告了沒有。同學不是不想挑戰我,是她不知道要問什麼。
今天做的工具,解決的正是這件事:一個真的讀過我論文、知道要問什麼的對手。但這個工具的風險比前面任何一個都高,因為它模擬的不是一個可以重跑的流程,是一場真實會發生、只有一次機會的對話。
這個工具危險在哪
前面二十一天的工具,錯了大多可以重來——摘要卡抄錯頁碼,回去核對;清理規則訂錯,改規則重跑。口試模擬器不一樣,它的產出不是拿去用的東西,是拿去練心態的過程。如果它把我教壞了——問的問題太簡單,讓我誤以為自己準備好了;或者它順手把答案也寫好,讓我背台詞而不是真的想清楚——壞的不是一份文件,是我在真正口試那天的表現。
所以今天要先想清楚兩條線,比工具本身更重要。
第一條線:它只能問,不能替我答。 我要練的是「被問到答不出來的瞬間,我怎麼反應」,不是「有一份寫好的答案可以背」。如果它把答案也生出來,我背的是它的邏輯,不是我對自己研究的理解,真委員一路追問下去,背的答案撐不了三句。
第二條線:它的提問必須紮根在我論文的實際內容,不能是網路上隨便找得到的萬用口試問題。 「你的研究限制是什麼」這種問題誰都會問,沒有意義。真正有用的問題是「你在方法學裡寫橫斷式設計,第四章卻用『導致』這個字,這兩者矛盾嗎」——這種問題只有讀過我論文的人才問得出來。
先寫模擬規格
analysis/defense-sim-spec.md:
draft/(論文各章草稿)、literature/cite-check.md、analysis/table1.md、
output/(圖表)、analysis/cleaning-rules.md
analysis/mock-defense-log.md:完整對話紀錄,供我事後回顧
規則四是這份規格檔裡最重要的一條。口試模擬的目的不是拿到一個分數,是暴露我還沒想清楚的地方。如果它先幫我打了分數,我會很想相信那個分數,然後停止準備——這跟 Day 10 「不讓它自動改引用」是同一種風險,它會把一個需要我自己判斷的東西,變成一個看起來已經有答案的東西。
SKILL.md 全文
存在 .claude/skills/mock-defense/SKILL.md:
使用者指定要練哪一章,或整份論文
analysis/mock-defense-log.md
一輪實際的對話
用 Day 8 到 Day 17 累積下來的材料(虛構的睡眠品質與職業倦怠研究)跑一次,委員甲的問題長這樣:
委員甲:你的研究設計是橫斷式相關性研究,樣本用便利取樣,
在北部某醫學中心收案。你在討論那一節寫「夜班可能導致倦怠升高」,
但橫斷式設計本身無法確立因果順序,這個「導致」的用字是否超出
你的研究設計能支持的結論?
我:(回答)
委員甲:你剛才提到「理論上夜班在前」,但你的問卷是同時測量
工時與倦怠,兩者是同一時間點的自陳資料,你怎麼知道不是倦怠
影響了受試者填答工時的方式?
第二個問題是追問,緊咬著我第一次回答裡「理論上」這三個字。這種追問,同學陪練問不出來,因為她沒有能力當場抓住我用詞裡的漏洞,一路往下逼。
哪裡會出錯
它會用網路上常見的口試問題庫,而不是真的讀我的論文。 第一次沒有明確要求「先完整讀過草稿」,它問的是「你的研究限制是什麼」「未來可以怎麼延伸」這種放諸四海皆準的問題,我答得很順,但那種順暢是假的,因為根本沒有人真的在檢查我的論文有沒有破綻。規則一寫清楚「先讀過再問」之後,問題才開始咬到我論文裡具體的句子。
它會忍不住「幫忙」,在問完之後給提示。 有一次它問完問題,又加了一句「你可以從研究設計的限制切入回答」。這句話看起來貼心,其實是把答題方向送到我面前,我下意識就會順著那個方向想,練習的效果打了折扣。規則三寫死「不給答題方向」,是為了逼我自己在空白裡想。
語氣沒調好,會太溫和或太尖銳,兩種都不真實。 第一版它問完我隨便答一答,它會說「這是一個合理的觀點」,然後換下一題——太溫和,真委員不會這樣輕易放過模糊的回答。調整之後太用力矯正,又變得像是在人身攻擊我的研究設計。規則裡「專業、嚴謹、會追問到底,但不刻薄」這句話,是調了三次語氣之後才寫定的,而且我覺得這條線還要繼續調。
它不知道我真正的委員會問什麼。 這是這個工具最根本的邊界。它只能從我論文的內容反推「合理會被問到的問題」,但真正的委員有各自的學術偏好、有些委員特別在意某個理論框架、有些委員固定會問一個跟自己研究專長相關的問題——這些只有我自己知道,工具不知道。規格檔裡那句「需在正式使用前依真實委員背景調整」提醒我這件事,但具體怎麼調,要我自己去想每位委員過去在口試裡常問的方向,工具沒有這個資訊來源。
這不能取代真人練習
模擬跑完,我發現一件事:文字對話練得再兇,跟真人面對面口試還是不一樣。真人口試有壓力感、有停頓的尷尬、有委員皺眉的表情,這些都會影響我臨場的反應,文字模擬完全沒有這些。
所以我現在的用法是分兩階段:先跟 AI 練,把明顯答不出來、邏輯有破綻的地方抓出來,這一輪成本很低,可以一直重來;抓完之後,再找老師或學長姐做一次真人模擬,這時候我已經知道自己哪裡弱,真人練習可以把力氣放在「怎麼在有壓力的情況下還能講清楚」,而不是浪費在第一次就被問倒的驚慌上。兩階段合起來,比只做任何一種都紮實。
我還不確定的地方
追問的深度要到哪裡停,我還沒有標準。目前是我自己喊停,但如果它追問到我完全招架不住,繼續下去是磨練還是打擊信心,這條線因人而異,我還在觀察自己適合哪一種強度。另外,對話紀錄要不要給指導老師看,這件事我還沒決定——給的話老師可以看到我哪裡真的弱,不給的話我保留自己準備的節奏,這兩者我還在權衡。
明天
Day 23:口試後那份「委員意見對照表」——修訂追蹤工具,把每一條委員意見對應到論文裡實際改了哪裡、改成什麼樣子。