今天這篇是檢討。
比賽中期(那時我們已經站在重現來的古典底座上),我帶著隊友埋頭調參。一週下來,從 0.8 出頭一路掃到 0.843,每一步都有實驗數據支撐。
然後停滯了。試了幾個方向都沒進展。
於是我下了一個結論,還寫進了紀錄:這條路到頂了。
公開的解法早就在 0.857。更高的那批在 0.885。
不是差一點點,是差了一整個層級。而那些方法都是公開的,我隨時可以去讀。
我花一週爬到的高度,別人早就在上面,而且把梯子留在那裡。
不是技術判斷錯,是順序錯。
我的流程是「自己想 → 撞牆 → 宣布到頂」。正確的流程是「先看別人到哪 → 命中就借 → 沒命中才自己想」。
為什麼會顛倒?我後來想了想,大概是兩個原因。
一是「自己調」比較有成就感。一路掃到 0.843 的過程很充實,每一天都有進展。回頭再翻別人更新的做法,則像是承認自己想不到。
二是我把「有進展」誤當成「在正確的軌道上」。分數確實一直在漲,這個訊號讓我一直不覺得需要抬頭看。
第一條:比賽動手改自己的碼之前,先查排行榜、先掃最新公開解法。命中就借,沒命中才自己想。
「先」這個字很重要。不是「卡住之後去看」,是「動手之前就看」。卡住之後才看,前面那一週已經花掉了。
第二條:別太快宣布「沒變化/到頂/收斂」。
這條是另外幾次事故一起促成的。有一天我下了三次「這裡沒有變化」的結論,三次都被證據打臉。現在的規矩是:零變化的意思是「這個角度看不到」,該換角度,不是該結束。要下「無 X」的結論之前,先用對的工具去實查一遍。
因為宣布到頂在當下感覺很專業。
你試了五個方向都沒用,你有實驗數據,你做出了一個「基於證據的判斷」——這一切都符合好方法論的外觀。缺的只是一件事:你沒有去看外面的世界長什麼樣子。
而 AI 隊友不會攔你。你說「我們試試看這個方向」,它們就一起想;你說「看來到頂了」,它們也會附和你的判斷,甚至幫你補上幾個理由。它們沒有主動去看排行榜的動機,除非你把那件事寫進規矩。
這是整個系統設計的核心體會:AI 不會替你彌補流程的缺口,它會在你既有的流程裡把事情做快。流程漏掉的那一步,加速之後只是更快地漏掉。
回頭去讀公開解法,把那套公開的 0.913 底座修到能完整跑起來;我們自己加的改動,經過一次一變數的實驗,多半反而被否掉。分數停在 0.913——歸屬講清楚:底座是別人的。
那一週不算白費——重現別人的做法時,前面累積的理解讓我看得懂為什麼那些設計是對的。但如果順序反過來,同樣的地方我大概三天就到了。
明天講另一種「以為自己在前進」:多開幾個 AI 一起跑,為什麼常常不會更快。