iT邦幫忙

2026 iThome 鐵人賽

DAY 11
0
AI Engineering

Macaron:30 天打造一位會占卜的 AI Agent系列 第 11

Day 11|六條解讀原則,每一次都要原封不動地交出去

  • 分享至 

  • xImage
  •  

馬卡龍的成長日記 Day 11

昨天,我把 Macaron 無論如何都不能說的話,做成了程式守得住的紅線。

但紅線只回答了「不能說什麼」。今天要處理的是另一面:應該怎麼說?

回到 Day 01 的那個擔心

Day 01 的時候,我說我最怕 AI 的解讀太正向、太空泛,每一句都讀得懂,看完卻好像沒有真的得到什麼。

那是一種感覺。但感覺沒辦法拿來檢查。

所以我為 Macaron 寫了六條解讀原則,每一次請 AI 寫草稿,都會一起交給它:

  1. 牌義會跟著情境改變。 問題是什麼、牌放在哪裡、旁邊有哪些牌,都會影響它這一次的意思。
  2. 多張牌要串成一個故事。 不是一張一張各念一段牌義,最後硬湊出一個結論。
  3. 可以做合理的連結,但要說清楚那是解讀。 不能講得像是已經發生的事實。
  4. 不能看到一張牌,就補出一個沒有根據的具體事件。
  5. 牌的位置,會改變它的表現。 一張好牌放在「阻礙」的位置,不一定是好消息。
  6. 答案要合理、貼近這次的情境、有界線,也要能帶來方向。

最後一條的最後一句,就是我在 Day 01 講的那件事:解讀不能只停在感覺,要讓人知道接下來可以往哪裡走。

寫在文件裡,不代表每次都真的交出去

原則寫好了,但我遇到一個問題:這六條,真的每一次都是用同一份內容交出去的嗎?

如果某一次在交出去的途中,被人偷偷改掉一條、多加一條,或是把「不能說一定會發生」拿掉了,AI 就會照著一份不完整的原則去寫。

而寫出來的東西,看起來還是很正常。

看起來一樣,不代表是同一份

昨天說過,程式的世界裡有一種「長得一模一樣的仿製品」。這六條原則也有同樣的問題。

原本 Macaron 檢查原則的方式,是「內容跟標準版本相不相同」。但只要仿製品長得夠像,就會被當成是正版。

修正之後,這六條原則的規則變得非常嚴格:

  • 必須剛好六條,不多也不少;
  • 每一條,都必須是真正的文字,不能是長得像文字的其他東西;
  • 順序和內容,都要跟標準版本一字不差。

另外還有一個欄位,是用來放「核准過的解讀範例」的。目前它固定是空的,任何人都不能在這裡偷偷塞進範例、指令或其他東西。

每一個出口,都再檢查一次

光是建立的時候檢查一次,還不夠。

Macaron 的資料,建立之後會被「封起來」,一般情況下不能再改。但封起來,不代表沒有人能從旁邊硬改。

所以每一次這六條原則要被交出去,不管是從哪一個出口,Macaron 都會再檢查一次。就算有人真的從旁邊把封好的內容改掉了,它也會在交出去的那一刻被擋下來。

封起來是一般情況下的保護。每個出口的最後一次檢查,才是真正的防線。

原則是方向,不是分數

我也想說清楚,這六條原則是什麼、不是什麼。

它們是 Macaron 解讀時要遵守的方向,每一次都會一起交給 AI。但它們不是分數,也不能拿來證明 AI 寫得好不好。

今天沒有接上真的 AI,沒有真的牌義,我也還沒訂出評分的方式和及格的標準。所以今天不能說「AI 已經照著原則寫出好的解讀了」。

Day 11,讓原則不只是寫在文件裡

今天,正常的六條原則可以順利通過;被偷改、被仿製的,在交出去之前都會被擋下。前幾天做好的抽牌紀錄、部分失敗的處理、不記得任何事的規則,也都沒有被影響。

原則和紅線都有了。接下來,我想要真的開始比較幾個不同的 AI,看誰寫得最好。

但在比之前,我發現連「怎麼比」都還沒有準備好。


上一篇
Day 10|有些話,Macaron 無論如何都不能說
下一篇
Day 12|本來想開始比模型,結果先畫了一條跑道
系列文
Macaron:30 天打造一位會占卜的 AI Agent13
圖片
  熱門推薦
圖片
{{ item.channelVendor }} | {{ item.webinarstarted }} |
{{ formatDate(item.duration) }}
直播中

尚未有邦友留言

立即登入留言