昨天(Day 8)我們透過調整分段識別符號(\n\n)與最大長度,成功克服了簡報轉 PDF 時「單詞成段、頁碼被截斷」的破碎化痛點,將講義整理成結構完整的大文字塊。
不過,資料切好、存進外接大腦後,系統真的能在我們提問時「翻出正確那一頁」嗎? 許多初學者常犯的錯誤是:一上傳完檔案就急著把知識庫綁進聊天機器人裡,結果問不出答案時,完全分不清到底是「AI 提示詞寫不好」還是「根本沒搜尋到講義片段」。
今天我們就要善用 Dify 內建的獨立檢驗工具——「召回測試(Recall Test)」,在不呼叫聊天模型消耗額度的情況下,先單獨驗證知識庫的檢索能力與相似度評估!
是一種用於評估系統在使用者提問時,能否從知識庫中正確找出相關文件的測試方法。
步驟 1:進入知識庫的「檢索測試」分頁
步驟 2:輸入測試提問進行檢索
在右側的測試輸入框中,輸入你想測驗的專有名詞或課堂考點:
步驟 3:觀察檢索結果與「相似度分數(Score)」
核對內容是否命中:檢查排在第一位(Rank 1)的文字區塊,是不是正好包含你想查的那一頁講義重點。
看懂相似度分數(Score):