本地大型語言模型已今非昔比:開發者實測驚豔成果
Vicki Boykis 分享了在 Mac 上運行本地模型的實際經驗,並列舉了 Mistral 7B、Gemma 3 等模型,強調了本地模型現在的可用性。文章提供了真實的使用心得和模型評估,非常符合使用者對實作技巧的需求。
Vicki Boykis 分享了在 Mac 上運行本地模型的實際經驗,並列舉了 Mistral 7B、Gemma 3 等模型,強調了本地模型現在的可用性。文章提供了真實的使用心得和模型評估,非常符合使用者對實作技巧的需求。
Tony Bai 報導了 Google DeepMind 在自動化 Agent Harness 方面的研究,指出 AI 已能自己編寫 Harness。這項研究顛覆了以往手動構建 Harness 的模式,對未來的 Agent 開發方法論有重大影響,是高價值的實踐指導。
作者介紹了 Graperoot 工具,利用依賴圖來提取程式碼庫中最相關的部分,以減少 coding tool 的 token 消耗,從而節省成本。這直接解決了開發者在使用 Claude Code 等工具時面臨的實際問題。
這篇文章總結了 MCP 協定在生產環境中的失敗模式,並提供了應對方案。對於使用 MCP 協定的開發者,這是一份寶貴的實戰經驗總結。
作者構建了一個 agent 就緒檢查器,並分享了在構建過程中學到的關於正確處理 llms.txt、OpenAPI spec 和 MCP endpoint 的經驗。這對構建可被 agent 調用的服務有實質性指導。
Anthropic 進行了大規模的 Claude Code 使用者行為分析,這項研究揭示了人類與 AI 在程式碼編寫協作中的模式,並探討了成功率,對於理解 agentic coding 的實際應用有參考價值。
Georgi Gerganov 分享了他在日常開發中,使用 Qwen3.6-27B 處理程式碼任務的經驗,雖然是小任務,但體現了本地模型在實務中的應用價值和對開發者的幫助。
Jason Liu 探討了 Codex 如何使用電腦、Chrome 或內建瀏覽器,明確指出了不同工具的使用場景與時機。這提供了具體的工具使用指導。
Google 發布了 Open Knowledge Format,一種用於 AI agent 的知識庫格式,基於類似 Wiki 的組織方式。這對於構建和管理 AI agent 的知識體系提供了新的方法和工具。
文章強調,即使是 LLM 驅動的工具,仍然需要領域知識來捕捉和呈現。這對開發者來說是重要的實戰提醒,即技術之外的知識積累同樣關鍵。