我做 TACT,是被一個很直覺的想法坑到的:模型越有把握,那一票就應該越重。 聽起來很合理,實驗一跑卻翻車了。只要模型的信心方向反過來,高信心加權就會把錯誤放大...
上一篇把問題攤開後,這回來寫最小版 Self-Consistency。多數決那一行很短,旁邊那些看似無聊的小事才會咬人。 我以前真的寫過這種一行版本: Coun...
上一篇的投票器只看答案,不看模型講得多有把握。今天替每條推理軌跡加上一個信心分數,再看看這個看似合理的改動會出什麼事。 先說結論:正向信心加權確實可能大幅贏過多...