跳至主要内容

工程紀要 — 2026 年 7 月

以下彙整 2026 年 7 月問答系統的主要進展。本文為對外摘要,內部基礎設施與組態細節不在此列。

從原型到可服務的產品

問答代理的執行核心已抽離為獨立套件,並以正式的服務圖(graph)對外提供,全部透過環境設定 組態,具備請求預算控管與端對端追蹤。在與現行正式版助理的正面比較中(由獨立評審評分), 它在品質上達到同等水準,回應速度約快一倍,且少一次來回互動。

更龐大且可信的來源艦隊

回答現在可援引多個經標註的語料,並依信任層級組織:

層級角色
可接地(Grounds) — 《法鼓全集》、CBETA、星雲大師著作、影音可作為回答的引用出處
導引(Guide)引導檢索,但不作為接地依據
第三方標示為未經校驗

問答模式的操作手冊由 7 種增至 12 種(義理問答、活動、書籍與內容探索、深度研究、測驗、 生活應用作業、危機關懷等)。每一個可接地來源都會回傳可直接使用的引用資訊,因此連結是可追溯 的,而非憑記憶拼湊。

以程式碼落實忠實性

過去仰賴提示詞的行為,現在改由機制強制執行:

  • 連結完整性 — 回答中的每個連結,都必須對應到該次對話實際檢索到的來源;不符者一律移除, 而正確卻未加連結的引用則會自動補上真實網址。
  • 收斂預算 — 檢索次數、回合數與脈絡量的上限,讓大型研究能以完整答案收場,而非中途失敗。
  • 危機安全 — 偵測到自我傷害或家暴訊息時,以簡短關懷加官方專線回應,並就此打住。
  • 當前日期感知 — 每次請求都知道今天的日期,以處理活動與時間相關的問題。

模型比較的一個實務心得:不同模型自行選對操作手冊的傾向差異很大,因此我們將此視為一項 第一級的品質指標,而非理所當然。

真正的安全網(端對端測試)

三層自動化測試套件現正把關產品:上線閘門(服務介面與操作契約)、每夜測試(各模式行為, 含危機處理、引用、面板內閱讀器),以及每週測試(較重的路徑與評審品質)。本月每一項面向 使用者的修正都附帶對應測試,確保不會悄悄退化。

觸及使用者的產品改善

  • 對話進行中可隨時叫回起始建議的建議選項面板。
  • 品牌標誌兼作對話紀錄的開關,移除了重複的控制項。
  • 面板內 EPUB 閱讀器,可直接閱讀引用書籍而不必下載。
  • 章節有聲書播放:引用的章節若有對應音檔,會從該章節的位置開始播放。
  • 回答語言跟隨提問語言。

專題探討:完整的語音涵蓋

我們正朝「每一個章節與電子書都能聆聽」的目標推進 — 有製作 Podcast 者沿用之,無者則以 語音合成產生。設計採離線優先:語音以批次方式產出並存為檔案,請求路徑中不做即時合成。

一項模型評估比較了兩套開放、寬鬆授權的語音合成系統。結論是:以特定嗓音朗讀、且來源為 早期典藏音檔時,零樣本(zero-shot)語音複製的品質可媲美甚至勝過微調模型。決策: 採用 零樣本複製作為合成方式,微調工作停止。正式上線仍以取得相關授權為前提。

後續規劃

  • 章節與電子書的正式語音產製(待授權)。
  • 持續強化「資料不足」時的節制回應,並以更可靠的評估佐證。
  • 涵蓋主代理與其子代理的全域檢索預算。