AI 程式碼助手框架對決:Claude Code、OpenCode 與 Pi 效能深度評測
開發者親自跑 benchmark 對比 Claude Code、OpenCode 與 Pi 在不同 harness 下的表現與耗時,極具實戰參考價值
開發者親自跑 benchmark 對比 Claude Code、OpenCode 與 Pi 在不同 harness 下的表現與耗時,極具實戰參考價值
深入淺出探討 Agent 的 Context 管理與記憶體持久化(Context Engineering/Lazy Loading),附帶實作程式碼架構思維,極具高價值
Tony Bai 基於產業大會整理的深度文章,剖析「黑灯軟體工廠」與編碼大模型在訓練中缺乏可維護性獎勵信號的根本問題,並給出實戰解法,水準極高
獨立開發者分享如何用 Ollama 與 9B 模型打造代理式 DJ 廣播電臺,包含工具呼叫與架構設計,是非常優秀的實戰專案分享
llama.cpp 分支實作 KV cache 量化新功能(如 KVarN)的深度技術分享,附帶 VRAM 優化數據,對本地跑模型者極有實戰幫助
探討模型微調路由(預訓練 vs SFT vs RL)並引用最新論文分析災難性遺忘的深度技術探討,對模型微調實作者很有幫助
針對多個 Gemma 模型進行 abliterations 基準測試與比較,揭露模型真實表現與差異,具備良好開發者參考價值
工程師分享組裝四張 P100 舊伺服器 GPU 跑本地模型的硬體搭建實作紀錄
美團技術團隊發表多模態長程任務評測基准 MineExplorer,剖析大模型在開放世界的能力斷層
探討 LLM 如何讓大眾成為通用型人才並獎勵專業的思辨文,屬於高水準的 AI 使用心態反思