為編程代理設計「無模型介入」的 MCP 檢索層:減少 28% 工具呼叫的架構與實踐

開發者深度分享設計「無模型迴圈」MCP 檢索層的架構取捨與踩坑心得(減少27%工具調用)。

在為大型語言模型編程代理設計工具時,常見的陷阱是讓工具承擔過多如摘要或預先過濾等內部循環工作。 • 開源檢索引擎 Silica 採用了 「主控端掌控循環」 的設計原則,工具本身絕不回答、總結或替模型做決定,僅返回定位證據與數學訊號。 • 實踐證明,在程式碼與文檔搜尋中,詞彙檢索(BM25) 的表現超越了向量嵌入,能有效避開延遲高、記憶體佔用大及字面盲點等問題。 • 透過向代理提供 拒絕訊號(如覆蓋率與缺失詞彙),讓模型能立即判斷概念是否存在,避免盲目瞎猜。 • 採用 原子化讀取工具 提供精準的行切片與區段大綱,搭配輕量化輸出。

這種設計在 144 次基準測試中,成功減少了 22% 的代理輪次與 28% 的工具呼叫次數。 • 整個伺服器可透過 uv 在本地運行,無需 API 金鑰、雲端遙測或背景嵌入工作程序。


來源:r/LLMDevs

閱讀原文 ↗

標籤:#model-context-protocol#lessons-learned

← 回首頁