工程紀要 — 2026 年 7 月
以下彙整 2026 年 7 月問答系統的主要進展。本文為對外摘要,內部基礎設施與組態細節不在此列。
從原型到可服務的產品
問答代理的執行核心已抽離為獨立套件,並以正式的服務圖(graph)對外提供,全部透過環境設定 組態,具備請求預算控管與端對端追蹤。在與現行正式版助理的正面比較中(由獨立評審評分), 它在品質上達到同等水準,回應速度約快一倍,且少一次來回互動。
更龐大且可信的來源艦隊
回答現在可援引多個經標註的語料,並依信任層級組織:
| 層級 | 角色 |
|---|---|
| 可接地(Grounds) — 《法鼓全集》、CBETA、星雲大師著作、影音 | 可作為回答的引用出處 |
| 導引(Guide) | 可引導檢索,但不作為接地依據 |
| 第三方 | 標示為未經校驗 |
問答模式的操作手冊由 7 種增至 12 種(義理問答、活動、書籍與內容探索、深度研究、測驗、 生活應用作業、危機關懷等)。每一個可接地來源都會回傳可直接使用的引用資訊,因此連結是可追溯 的,而非憑記憶拼湊。
以程式碼落實忠實性
過去仰賴提示詞的行為,現在改由機制強制執行:
- 連結完整性 — 回答中的每個連結,都必須對應到該次對話實際檢索到的來源;不符者一律移除, 而正確卻未加連結的引用則會自動補上真實網址。
- 收斂預算 — 檢索次數、回合數與脈絡量的上限,讓大型研究能以完整答案收場,而非中途失敗。
- 危機安全 — 偵測到自我傷害或家暴訊息時,以簡短關懷加官方專線回應,並就此打住。
- 當前日期感知 — 每次請求都知道今天的日期,以處理活動與時間相關的問題。
模型比較的一個實務心得:不同模型自行選對操作手冊的傾向差異很大,因此我們將此視為一項 第一級的品質指標,而非理所當然。
真正的安全網(端對端測試)
三層自動化測試套件現正把關產品:上線閘門(服務介面與操作契約)、每夜測試(各模式行為, 含危機處理、引用、面板內閱讀器),以及每週測試(較重的路徑與評審品質)。本月每一項面向 使用者的修正都附帶對應測試,確保不會悄悄退化。
觸及使用者的產品改善
- 對話進行中可隨時叫回起始建議的建議選項面板。
- 品牌標誌兼作對話紀錄的開關,移除了重複的控制項。
- 面板內 EPUB 閱讀器,可直接閱讀引用書籍而不必下載。
- 章節有聲書播放:引用的章節若有對應音檔,會從該章節的位置開始播放。
- 回答語言跟隨提問語言。
專題探討:完整的語音涵蓋
我們正朝「每一個章節與電子書都能聆聽」的目標推進 — 有製作 Podcast 者沿用之,無者則以 語音合成產生。設計採離線優先:語音以批次方式產出並存為檔案,請求路徑中不做即時合成。
一項模型評估比較了兩套開放、寬鬆授權的語音合成系統。結論是:以特定嗓音朗讀、且來源為 早期典藏音檔時,零樣本(zero-shot)語音複製的品質可媲美甚至勝過微調模型。決策: 採用 零樣本複製作為合成方式,微調工作停止。正式上線仍以取得相關授權為前提。
後續規劃
- 章節與電子書的正式語音產製(待授權)。
- 持續強化「資料不足」時的節制回應,並以更可靠的評估佐證。
- 涵蓋主代理與其子代理的全域檢索預算。