前三天做的事都在數票:這條主張握著幾條證據、是不是同一張嘴、開口的人有沒有互相聽過。今天換一個方向數——不數誰支持你,數哪條證據能刷掉誰。
Heuer 在 CIA 做了一輩子分析方法,1999 年把幾十年的觀察寫成一本書,裡面有一張表後來變成情報圈的標準工具。他看到的通病很簡單:分析師會愛上第一個結論,然後全世界的證據都開始支持它。不是造假,是每一條證據本來就跟好幾個假設相容——「他這幾天都沒回訊息」跟「他在生氣」相容,也跟「他很忙」「他手機壞了」相容。支持票很便宜,你要多少有多少。
貴的是另一種票:一條證據跟某個假設不相容。「他今天早上在群組裡回了別人」刷得掉「手機壞了」,刷不掉另外兩個。Heuer 的方法叫競爭假設分析:把所有假設攤開,每條證據只問一件事——這條刷得掉哪幾個。支持不算分。最後活下來的不是支持票最多的,是吃否決票最少的。
這一集是這條線倫理最重的一集。同一套方法,反過來防止讀者亂貼標籤:「他在情勒我」只是四個假設裡的一個,「他焦慮發作」「我過度解讀」「我們互相情勒」跟它同桌,證據一條一條過,誰活下來誰算。這裡不評人——今天拿來過這張表的,是這條線自己靠得最重的那條主張。
出處:Heuer, R. J., Jr. (1999). Psychology of Intelligence Analysis. Washington, DC: Center for the Study of Intelligence, Central Intelligence Agency.(第 8 章 Analysis of Competing Hypotheses)
從 D12 到 D14 留下的主張裡挑一條:被後面靠得最重、證據卻最薄。把能解釋同一批證據的假設全列出來,至少四個,一定要有一個是「這是我們自己選材、翻譯、拆法或檢索語言造成的」。證據逐條列成行,再加一類:該出現卻沒出現的證據——某個假設成立就該出現的東西,出現了沒有?沒出現也是一格。表裡每一格只標說不通、說得通、或判不出,不標支持。數票,吃否決票最少的活下來。最後拿掉最重要的那條證據,看排名變不變。
這個 skill 的 prompt 這樣下:
幫我建 D15 的 skill。
它相信:人會愛上第一個結論,然後全世界的證據都開始支持它。
支持票很便宜,幾乎每條證據都能跟好幾個假設說得通。
貴的是否決票:一條證據放在某個假設底下說不通。
所以別數誰支持你,數哪條證據能刷掉誰。我說「幫我數否決票」的時候,它從前幾天留下的主張裡挑一條最值得爭的——後面靠它最重、證據卻最薄的那種。
把所有能解釋同一批證據的假設全部列出來,至少四個。
一定要包括「這是我們自己選材或解讀造成的」這一種。
然後每一條證據對每一個假設只標一件事:說不通,還是說得通。
說得通不加分。
證據不在也算證據:某個假設成立就該出現的東西沒出現,也是一票。
活下來的是否決票最少的,不是支持票最多的。
最後把最重的那條證據拿掉,再數一次,看活下來的換不換人。這張表不拿來評任何一個人,假設講的是機制、場合、文獻,不是人。
存到
作業區/D15/。
把這句話直接丟進 Claude Code:
幫我數否決票
它挑的是 D07 那個支點——「情緒勒索」這套說法有定義、分型、時間軸與話術對照表,就是沒有一個可以複核的第三方位置。理由:後面靠它最重(D08、D09、D11 三天接手,一次判定被引用四次)、證據最薄(外部材料 0 筆,撐它的是 D06 那一欄裡這條線自己下的七次判定),而且 D14 十位評審一致給 12 到 25。
五個假設:
| # | 假設 | 類型 |
|---|---|---|
| H1 | 這套說法的內容裡沒有留一個可以被駁回的位置 | 本主張 |
| H2 | 空缺來自私人關係——任何描述私人關係的語彙都會這樣 | 替代機制 |
| H3 | 是這條線自己造出來的:對照組全是有主管機關的制度領域、十二組關鍵字全英文且預先放進制度名詞、反面那組從沒查過 | 我們自己造成的 |
| H4 | 辨識語言天生不承載程序,程序在機構那一層 | 層次不同 |
| H5 | 位置存在但換了形狀,由諮商衛教端承接,只是不做駁回 | 替代機制 |
證據列了二十幾行,含該出現卻沒出現的。表 110 格裡打叉的只有 13 格——這條線自己的七次判定、自己交代方法的那段、模擬評審的低分那五行,對五個假設全部說得通,一張否決票都打不出來。
否決票:H1 吃 0 票、H2 吃 4、H3 吃 2、H4 吃 3、H5 吃 4。
但 H1 那個 0 不是活下來,是沒被測——能刷掉它的只有一種東西:一套實際提供申訴或複核程序的情勒論述,而題目自己就寫著這條線從沒拿那組關鍵字去查過。一個假設如果從來沒有面對過能刷掉它的證據,票數再少也不算贏。
在被測過的四個裡,否決票最少的是 H3:這是我們自己造成的。刷掉它的只有兩票:因應方向在機構端、源頭書、素人端三處一致收在自己身上,還有量表量的兩樣東西是研究者自己設計的——這兩件事不是我們的拆法造出來的。其餘每條證據它都說得通。
拿掉一條再數一次,指到一個地方:拿掉 1947 年 Redl 那一段,H2 掉到 3 票、H4 掉到 2,H3 就不再單獨最少——這個排名靠那一條撐著。而 D13 自己註明那段是抓取工具的擷取結果,沒逐字核對原頁。
它上網只核對了一條已列的證據——職場情緒勒索量表量的兩樣東西確實是威脅型跟懇求型,全文仍未取得——沒有新增證據。
這一輪的結論寫成一句:兩篇專欄份量最重的那句話,目前最便宜的解釋不是它錯,是我們沒有去查能讓它錯的東西。
下一篇:先別分類,讓分類自己長出來。