qm:專為新創團隊打造的多人協作 AI 代理執行環境
Hacker News 熱議:qm – 針對工作情境的多人代理引導與協作框架開源專案
Category · 分類
Hacker News 熱議:qm – 針對工作情境的多人代理引導與協作框架開源專案
llm-mcp-client 0.1a0 工具發布與搭配無狀態 MCP 的實作介紹
Android Remote Control MCP v1.10.0 正式版發布,讓 AI 代理透過手機端 MCP 伺服器直接自動化操作手機 App 的實戰工具分享
介紹如何使用 Cursor Automations 根據事件排程建立常駐型代理
GitHub Copilot 官方公告程式碼審查支援 Agent 技能與 MCP 伺服器正式一般可用,對開發者實戰具參考價值。
開發者結合遊戲開發背景與 Electron,為 Claude Code 打造 3D 遊戲化桌面模擬介面的實戰分享,充滿創意與實作工程心得。
工程師分享組裝四張 P100 舊伺服器 GPU 跑本地模型的硬體搭建實作紀錄
llama.cpp 分支實作 KV cache 量化新功能(如 KVarN)的深度技術分享,附帶 VRAM 優化數據,對本地跑模型者極有實戰幫助
開發者親自跑 benchmark 對比 Claude Code、OpenCode 與 Pi 在不同 harness 下的表現與耗時,極具實戰參考價值
獨立開發者分享如何用 Ollama 與 9B 模型打造代理式 DJ 廣播電臺,包含工具呼叫與架構設計,是非常優秀的實戰專案分享
介紹 Go 語言機器學習框架 GoMLX 的架構與純 Go 訓練神經網路實作。
分享在 CLI 與手機端不同 effort level 設定導致的 footgun 經驗,具備高實戰參考價值。
ML 工程師資深用戶分享 Claude Code 子代理發出異常 injection 風格系統指令的真實資安觀察與踩坑。
開發者發現 Claude Code 預設 30 天會默默刪除舊 session 的關鍵踩坑與除錯發現。
揭露 Anthropic 縮減 Claude Code 系統提示詞的技術決策與背後工程原理,對 prompt 工程有重大啟發。
詳細分享 Opus 5 在實際開發任務中的 token 消耗觀察與效率心得。
真實開發者使用 Claude 優化賽車遊戲模擬器重播系統,成功達到 3000 併發 60fps 的具體實戰案例。
陳廣亮分享了從 OpenClaw 到 Claude Code 的配置演化過程,包括 memory、skills、i18n 等方面的改進,詳細記錄了個人化的 agent 工作流程實戰經驗。
r/LLMDevs 上分享了 SymbolPeek,一個 MCP server,讓 AI Coding Agent 可以按符號而非整個檔案來存取程式碼,大幅提升了程式碼搜尋效率,對開發者有極大幫助。
r/LLMDevs 上分享了如何訓練 harness 以提高 LLM 在 Terminal-Bench 上的得分,這種方法論和實作經驗對 Prompt Engineering 和 Agent 開發者非常寶貴。
Show HN: Bento 是一個單一 HTML 檔案的簡報工具,支援協作,作者提到使用 Claude Code 等 coding harness 輔助製作,這是一個結合 AI 工具和實際產品開發的實作案例。
Eric 部落格的 Orca 教學手冊,企業級實戰版,詳細介紹 Orca 在不同 coding agent CLI、SSH 等場景下的應用,適用對象為資深工程師,提供系統性的實戰指南。
報導 Jack Dorsey 的 Block 開源 Buzz 平台,強調人與 AI Agent 的協同工作,並解決了 Agent 帳號追溯問題,支援多種 Agent 框架,對協調 AI Agent 系統有實戰價值。
Reddit 貼文分享如何利用 Claude 分析 RISC-V 規格並構建 CPU 設計環境,這是一個利用 LLM 進行硬體設計和開發的具體實戰案例。
與 Claude Code 團隊的 Fireside Chat,深入探討 Claude Code、編碼代理安全、工具設計等,是來自開發團隊的第一手實戰經驗分享。
Nativ:在 Mac 上本機運行 AI 模型,提供聊天介面和 localhost API 服務,類似 LM Studio,對希望在本機開發測試的用戶很有實用價值。
開源自託管 LLM Gateway,提供統一 API 端點,支援多供應商切換和成本限制,解決了多 LLM 供應商管理的痛點,對需要整合多個 LLM 的開發者是極其實用的工具。
bitgpu:在瀏覽器中運行 1-bit LLM,無需安裝,完全在本機執行,對希望快速測試或低資源環境下的開發者非常有用。
作者對 rtk 這一款聲稱能顯著減少 Claude Code token 使用的插件進行了實際測試,結果發現與其宣傳效果大相徑庭,甚至有所增加。這種獨立、實測、誠實的踩坑分享,高度符合使用者對實戰技巧分享的偏好。
GitHub Copilot 更新了其計費 UI,允許直接在 UI 中管理成本中心的 AI 信用額度。這是對現有開發者工具(Copilot)功能的更新說明,雖然不是突破性,但對使用者有直接影響。
使用者在比較 Cursor Pro 和 Claude Code Pro 的訂閱方案,詢問 Cursor 是否是更好的替代品。這直接關乎開發者在選擇 AI Coding 工具時的實戰考量。
Hacker News 討論 OpenAI Codex 模型上下文大小縮減,這類關於工具核心功能的變動,對使用者有直接影響,雖然來源是 GitHub PR,但具有實戰意義。
Simon Willison 實際探查 Claude Code 使用 Bun 的 Rust 版本,提供具體指令和觀察,是工具使用的實戰分享。
The Verge 報導 Claude 與 1Password 的整合,允許 Claude 使用使用者憑證完成任務,是開發者關心的實用功能。
Together AI Blog 介紹其 GPU 集群的可靠性與控制功能,偏向平台功能介紹。
r/LLMDevs 分享一個開源的 3D 視覺化工具,用於 Transformer 架構和 LLM 推理,並尋求貢獻者,具有開發者工具的實作價值。
r/LLMDevs 分享一個名為 recap 的工具,用於遷移 Claude Code 會話,解決多節點開發的痛點,包含開發者實際工作流分享與踩坑經驗。
r/LLMDevs 分享 LIA,一個開源、可自行架設的個人助理,具有 Claude Code 的風格,並包含多種工具整合,是個人助理的實作範例。
Mistral News 介紹 Studio 的版本控制功能,用於管理 prompt 和 skills,解決企業 AI 應用中的痛點,對開發者有實用價值。
Baseten 介紹其在 Wan 2.2 影片生成上的推理效能提升,包含具體優化技術,有工具實戰價值。
Kilo Code 介紹其能為每個模型建立代理,並可快速切換模型、提示詞和技能策略,是關於 agentic workflow 的新工具。
Simon Willison 分享由 Fable 5 製作的 LLM 慣用語高亮工具,能識別 AI 生成寫作的常見模式,實用且具啟發性。
Simon Willison 分享其 Fable 5 根據 Julia Evans 的文章,為 SQLite Query Explainer 製作的互動式解釋工具,展示了 AI 輔助開發的實例。
r/LocalLLaMA 分享一個用於捕捉 LLM 調用中快取失效問題的工具,對開發 Harness 的人很有幫助。
r/LocalLLaMA 分享 MiniBot v2,一個用於本地模型、電腦修復診斷等任務的 AI 助手,展示了個人化的 AI 工具開發。
Fireworks AI 介紹 Claude Code 的定價、API 費用和如何降低支出,提供實際使用資訊。
Copilot 程式碼審查進行了自訂和可設定性改進,包括防火牆、自訂步驟等,對開發者工具的實戰應用有直接幫助。
Simon Willison 分享了他使用 Claude Fable 5 將 AlexanderGrooff/mermaid-ascii 編譯成 WebAssembly 的工具,以便與另一個工具比較,這展示了工具的實戰應用和比較。
作者利用 AI 開發了 TabQueue 瀏覽器擴展,用於管理大量標籤頁,解決記憶體和精神焦慮問題,並強調其極簡工作流和隱私保護,這是關於利用 AI 輔助開發實用工具的優秀案例。
Mistral AI 擴展了其 Connector 的管理控制,提供更精細的存取權限、除錯工具和與企業工具的整合,這對構建可靠的 AI 工作流很有幫助。
作者分享了一個開源 CLI 工具,讓 Claude 能夠真正「觀看」影片(提取場景關鍵幀和時間戳的字幕),解決了直接處理影片檔案的問題。這是關於拓展 LLM 媒體能力的實用方案。
Reddit 詢問 Claude Co-work 和 Claude Code 的區別,以及何時該使用哪一個,特別提到 Claude Code 加載倉庫的上下文能力。這是一個關於工具選擇和功能比較的實用討論。
作者分享了一個將 LLM 聊天記錄轉換為 3D 語境圖的開源工具,可以本地運行,整合不同供應商的聊天記錄。這是非常有價值的實踐分享和工具介紹。
Reddit 警告 claude-seo 技能會偷偷附加推廣頁腳,並提供了如何掃描技能源碼的建議。這是關於工具使用中潛在問題的警示和實用建議。
作者製作了 iOS 小工具來方便監控 Claude Code 的速率限制,並支援 Fable 模型,提供了實用的工具改進方案。
探討 Cursor 編輯器的一個 0day 漏洞,並提出全披露是唯一的保護方式,這屬於對開發者工具的深入技術探討和安全警示,非常有價值。
介紹使用 GPT-5.6 Sol 構建的 SQL 遊戲 DOOMQL,這是一個非常有趣的實作案例,展示了 AI 在遊戲開發中的潛力,分數很高。
作者分享了在 Codex Desktop 中使用 'pet' 的個人經驗,包含如何創建和使用,這是一個非常具體的個人使用心得,分數很高。
Qodo 介紹 GPT-5.6 在程式碼審查方面的應用,強調其精確度和效率的提升,直接關乎開發者的日常工作。
開發者分享 Claude Code 在 Windows XP 上本機運行的進度,雖然是 WIP,但展示了跨平台和舊系統的應用可能性,對特定開發者有參考價值。
開源了一個 Claude Code 插件,能將 token 輸出減少 99.9%(回應「Done.」),這是一個極具創意和實用性的技巧,直接解決了 token 浪費問題。
用戶發現 Claude Code 的子代理程式返回了包含 prompt injection 負載和隱藏指令的內容,這是關於 AI 工具安全性的重要發現,對使用者有警示作用。
直接比較了 Claude Code 和 OpenCode 在 token 使用上的差異,並提供了實驗數據,對開發者選擇和使用 coding agent 有極大的實戰參考價值。
分享了一個 MCP 伺服器設計,讓多個 agent 可以共享介面合約並協商 API 變更,解決了協同開發中的問題,對構建複雜 Agent 系統有參考價值。
分享了一個跨語言的工具調用庫 (toolnexus),支援多種工具來源和複雜的調用邏輯,並提供人機協同的原語,對構建複雜 AI Agent 有實戰價值。
開源了一個『AWS for AI』的專案,提供一個 docker compose 來實現企業級、合規、可審計的 AI 系統,包含網關、守衛、策略等,對企業導入 AI 有直接的實作框架。
Fireworks AI 介紹 LangChain Deep Agents 如何針對 NVIDIA Nemotron 3 Ultra 進行優化,並在 Fireworks 上運行,強調了開源模型的成本效益和性能,對開發者有實戰價值。
JetBrains 推出 Kotlin Benchmark,用於評估 AI coding agent 在真實 Kotlin 開發任務中的表現,對開發者工具實戰有直接幫助。
介紹 ChatGPT Work 作為一個能跨應用程式和檔案執行的代理(agent),具體說明了其功能,對於實戰有潛在幫助。
Simon Willison 介紹 Meta 的 Muse Spark 1.1,特別強調其 API 和 agentic tool calling 能力的提升,對開發者有參考價值。
r/ClaudeAI 社群貼文,提到 DeepSWE 在其基準測試中加入了 gpt-5.6 模型,並暗示 Claude Code 並非唯一的 coding agent,是關於 coding agent 的實戰比較。
r/ClaudeAI 社群貼文,介紹 Claude Code Desktop 應用程式的新功能:內建瀏覽器,可以直接讀取、點擊和互動網頁,對開發者實戰有直接幫助。
vLLM 推出高效能的 transformers modeling backend,對開發者提升模型推理速度有直接幫助。
Simon Willison 開發了一個使用 GPT-5.5 的 Web Component,用於嵌入 GitHub 代碼,展示了 AI 在網頁開發中的具體應用。
Codex 成為新的代理提供者,並在 JetBrains IDEs 中引入代理增強功能,對開發者實戰有直接幫助。
OpenAI 推出 GPT-Live,用於 ChatGPT 語音模式,並能將複雜任務委派給 GPT-5.5,對使用者體驗有顯著提升。
Simon Willison 發布 sqlite-utils 4.0,引入資料庫遷移和巢狀事務,這是對開發者極有用的工具更新,提供了更強大的資料庫管理功能。
揭示了 Claude Code 的誕生歷史,從最初的簡單工具到如今廣泛使用的命令行程式設計智能體,展現了 AI 工具在實際開發中如何演進並改變工作流程。
提供了解決 Claude Code 中 /model claude-opus-4-6[1M] 無法使用的 workaround,這對使用該工具的開發者來說是解決實際操作問題的寶貴資訊。
用戶比較了 Claude Cowork 和 Claude Code,探討了 Cowork 在非程式碼任務上的能力,並指出了 Claude Code 在靈活性和模型切換上的優勢,提供了工具選擇的實戰視角。
對 Claude Cowork 的底層架構進行了深入的逆向工程分析,揭示了其 VM 的運行方式,對於理解和使用該工具的開發者有很高的實戰價值。
這篇文章評論了智譜 GLM-5.2 的 ZCode 工具登上 Hacker News 的事件,重點分析了其作為国产開發者工具的定位、Hacker News 的真實反饋以及作者自己使用 GLM Coding API 的實作經驗,是深度結合 AI 工具的開發者視角。
Simon Willison 分享 sqlite-utils 4.0rc2 的發佈,其中大部分由 Claude Fable 撰寫,並估計了成本,這是一個獨立作者使用 AI 輔助開發的深度實作案例。
Reddit 用戶討論 Cursor 在大型專案中探索倉庫所花費的時間,並詢問減少此階段的方法,這直接關乎 AI 工具在實際開發流程中的效率,是重要的實戰考量。
Reddit 用戶詢問 Cursor 如何決定收費模型,特別是免費使用 claude-fable-5-thinking-high 模型,這直接關係到開發者對工具成本和功能的理解,屬於實戰應用中的重要資訊。
Reddit 用戶報告 Cursor Pro 使用量條的 UI 錯誤,涉及計算或同步問題,這類 bug 報告對其他使用者和工具開發者都有實用價值。
Reddit 用戶比較 Cursor Ultra 20x 與 Codex 5x 的費用和效能,特別是在前端工作中,並分享了個人經驗,這是針對開發者工具的實戰比較和經驗分享。
Reddit 上的 Cursor 用戶分享不同 AI 模型(Auto vs Composer)的 token 使用量比較,提供了真實的使用者數據和成本考量,對實戰使用者有直接參考價值。
Reddit 用戶分享適用於 Next.js App Router 的 Cursor rules,提供了具體的開發模式和最佳實踐,直接幫助開發者在 Cursor 中更有效地使用 AI 進行網頁開發。
Reddit 用戶分享使用 Cursor Pro 的最佳實踐、工作流程和遇到的問題,尋求經驗分享,這屬於典型的獨立開發者踩坑與經驗總結。
作者開發了 Nymor,一個可以跨多個 AI coding agent(Claude, Cursor, Copilot 等)同步規則的工具。這直接解決了開發者在使用多個 AI 工具時規則管理分散的問題,是實用的開發者工具。
介紹 vLLM Semantic Router 如何將其轉變為 Micro-Agent Runtime,用於協作,對開發 Agent 的開發者有實戰價值。
分享 vLLM-Omni 如何服務與優化 Qwen3-Omni 的實戰經驗,包含具體的效能優化技巧,對部署大型模型者有直接幫助。
Toolport 允許使用者在不消耗額外 token 的情況下運行多個 MCP 伺服器,並提供安全功能,是針對 LLM 工具整合的實用工具。
Simon Willison 分享了使用其 llm 函式庫建構了一個簡單的 coding agent,並發布了 0.1a0 版本,這是對其 agent framework 的實戰應用與初步成果分享。
Ben Guez 使用 OpenClaw、Claude code 和 Instagram trials 建立自動化腳本,在 DMs 中與潛在對象互動,是一個較為新穎的 OpenClaw 應用展示。
Memora 提出一個解決 agent 記憶問題的可擴展記憶系統,能分離儲存與檢索,對提升 agent 的長期任務處理能力有實質幫助。
agentsense 是個開源的本地端 observability 工具,用於 trace、replay 和 diff agent 的決策過程,對於調試複雜 agent 的行為非常實用。
介紹了一個開源的 CLI 工具 Krystal Quorum,能在程式碼寫入前,先由多個 AI 審查其 implementation plan,以確保 plans 的品質和準確性,解決了 agentic coding 執行前的重要痛點。
分享了一個本地優先的記憶系統 Slowave,支援多個 AI coding client,解決了 LLM 記憶問題,不依賴 LLM summarization 或 RAG,具體實用。
開發了一個開源的、自託管的 A/B 測試實驗室,用於評估 LLM agent 的行為變化,提供可控、可重複的實驗環境,有助於實戰優化 agent。
Kilo Code 提供高效能的 AI 編碼功能,同時控制成本。文章提供了在不花費過多資金的情況下,使用 AI 編碼工具完成實際工作的實用指南。
Copilot CLI 增加 C++ 語言伺服器配置技能,可自動化專案設定。這對於使用 Copilot CLI 的開發者是實用工具更新。
Tony Bai 介紹 cc-switch-cli,一個用於終端開發者的 Claude Code 多模型切換工具。文章詳細說明了其安裝、命令和高階功能,對於在純終端環境下需要靈活調度模型的開發者非常實用。
Cursor 的 Pauline Brunet 解釋了團隊如何幫助組織實施代理,建立軟體工廠。這篇文章提供了關於如何在企業環境中部署和管理 AI 代理的實戰經驗。
開發者討論在 Cursor 中使用月訂閱是否值得,考慮到模型限制問題,並詢問其他模型供應商的選項。這是關於工具使用和成本效益的考量。
skillhub:一個用於 AI 代理技能(Claude Code, Cursor, Codex)的套件管理器。它提高了技能使用的便利性和一致性。這是一個實用的開發者工具,解決了重複配置的問題。
使用者開發了一個名為 `/steal` 的 Cursor slash command,可以將 Cursor 的聊天記錄匯入 Kilo Code,反之亦然。這是一個解決跨工具上下文傳遞問題的實用工具。
JetBrains AI Assistant 整合 GitHub Copilot Agent,提供更深入的整合,是開發者工具的實戰更新。
Sourcegraph 推出 Agentic Batch Changes 公開測試版,能跨越數百個儲存庫執行大規模程式碼遷移,是具備實戰價值的高級開發者工具。
r/LLMDevs 社群提供了一個解析 DeepSeek 網站並暴露與 Anthropic 和 OpenAI 相容的 API 的工具,支援 MCP,對開發者使用開源模型提供了便利。
CacheLane:修復 Claude Code prompt caching 的盲點,解決了上下文累積導致的 cache miss 和成本問題,是針對特定工具的深度實戰優化方案。
開源了一個 loop guard + per-action cost ledger,用於識別並終止重複的 agent 行為,解決了 agent 浪費預算的問題,提供了具體的本地執行工具和實戰經驗。
Sebastian Raschka 分享了在本地運行開放權重模型作為 Claude Code 和 Codex 訂閱替代方案的實戰經驗。這是典型的獨立作者分享,聚焦於本地開發者工具的使用與替代方案,價值很高。
Ben's Bites 提到 Claude Code 在 Slack 中的使用,並提供一個讓 Codex UI 更好的技巧。這是一個簡短的工具使用提示,屬於常規更新範疇。
Mistral OCR 4 發布,提供 SOTA OCR 能力,支持多語言,並可自託管,適合文檔智能、RAG 等應用。這是關於 OCR 工具的新發布,對於需要處理文檔數據的開發者來說是重要資訊。
Simon Willison 分享他將 mdn/browser-compat-data 轉換為 SQLite 資料庫的專案,並提到使用了 Claude Code 處理網頁,這是一個結合工具和實作的範例。
r/LocalLLaMA 社群成員尋求關於如何部署多模型後端及配置切換的方案,以支援不同任務(如 Coding、Hermes),這是關於實際部署複雜 AI 環境的實戰需求。
r/LocalLLaMA 社群成員正在開發一個本地優先的 AI Harness,並徵求用戶意見以改進,這是一個正在開發的工具,並尋求實戰回饋。
Show HN: OpenKnowledge,一個開源的 AI-first Markdown 編輯器,整合 Claude 和 Codex,提供 MacOS App 和 Web UI+CLI,完全免費且開源,對開發者而言是實用的工具。
Codebase Memory Mcp 教學手冊,介紹 AI Coding Agent 知識圖譜引擎,對理解大型專案程式碼有實作參考價值。
Copilot 程式碼審查更新,提升效率,屬於對開發者工具的實用更新,有助於提升日常開發流程。
Phil Schmid 介紹如何使用 Gemini 3.5 Flash 的電腦使用功能控制 Android 模擬器,是關於開發者工具的實戰教學。
Hugging Face 團隊使用本地模型免費對 OpenClaw 儲存庫進行了分類(triage)。
Figma 更新了程式碼圖層、動畫支援和 AI 功能,包括創建自訂插件。
作者開發了一個免費的 AI Prompt Manager,用於組織、搜尋和重用 ChatGPT、Copilot 和 Gemini 的提示,解決了提示管理痛點。
開發了一個名為 Mova Context 的語言無關的上下文約定,用於將規則和提示與程式碼一起版本化,解決了跨工具提示管理的問題。
介紹 Anthropic 的 Claude Tag 功能,讓 Claude 能作為 Slack 團隊成員,整合工具、資料與程式碼,實現協作任務。
Simon Willison 分享使用 Claude Code 建立 OPFS + Pyodide 測試環境的過程,有具體工具整合與問題解決經驗。
討論在 Google Glass 上使用 Claude Code,展示了其跨平台的應用潛力,特別是在 AR 設備上的使用。
分享一個將 Claude Code 等 AI 串接轉換為視覺化遊戲畫面的應用 Age of Agents,提供創意性的工作流呈現方式。
Eric 部落格提供開源 AI Agent Skill Ponytail 的教學手冊,說明其架構、設定,以及與 Claude Code, GitHub Copilot 等主流 AI Coding Agent 的整合方式,並延伸至企業級開發流程,對開發者實戰整合 AI Agent 有極大幫助。
veil 是一個 MCP shell,能將終端機命令的效果轉為結構化資料,而非原始文字,提高了 Agent 與命令互動的穩定性與安全性,並具有檔名追蹤、可恢復性等特性,是 Agent 工具開發的實戰進展。
Simon Willison 分享 Cloudflare Temporary Accounts 的功能,特別提到對 AI agents 的適用性,介紹了如何快速部署和測試,對開發者有實用價值。
r/cursor 用戶詢問 Cursor Pro/Pro+ 的 limit 工作原理,並討論 credit 消耗速度,這是有關工具定價和使用策略的實戰問題,對潛在使用者很重要。
r/cursor 用戶分享了 Cursor Pro 的真實使用經驗,詳細分析了費用、credit 消耗和與 VS Code + Cline 的對比,坦誠了優缺點和踩坑經驗,非常有價值的實戰評測。
r/cursor 用戶詢問是否應從 Cursor 轉向 Claude Code,並比較兩者的使用體驗和成本,屬於開發者在工具選擇上的實戰比較。
r/cursor 用戶分享了為 Cursor 開發的開源社交化編碼擴展,允許開發者之間互動,展示了如何增強工具的使用體驗,具有創新性和實作價值。
r/cursor 用戶深入討論 Cursor Pro 的必要性、額外限制以及與 Ultra 計劃的權衡,分享了真實的開發者使用體驗和痛點,具有很高的參考價值。
GitHub Copilot 自動生成的發行說明現在會包含 Copilot 處理的 PR,簡化了版本發布流程,對軟體發布工作流有直接幫助。
Simon Willison 介紹了 Datasette 的新插件 datasette-apps,允許在 Datasette 中託管自定義 HTML+JavaScript 應用,這是一個針對開發者構建內部工具的實用方法。
GitHub Copilot 將 MAI-Code-1-Flash 模型擴展到更多服務,包括 Copilot CLI、GitHub App 等,對使用 Copilot 的開發者來說是重要更新。
r/LocalLLaMA 介紹 GLM-5.2 可在 llama.cpp 和 Unsloth Studio 本地運行,並提供不同量化版本,對於想在本地部署強大模型的用戶非常實用。
Eric 部落格的 Claude Code CLI 教學手冊,聚焦於 CLI 安裝、設定、Agent 架構和企業導入,內容具體實用。
Claude Code 新增 Artifacts 功能,允許建立可共享的互動式頁面,對於團隊協作和展示成果非常有幫助,是重要的實戰功能。
提供 Claude Code 的實戰教學課程,由在 Meta 訓練工程師的講師教授,直接針對實戰工作流進行深入指導,價值極高。
Sourcegraph MCP server 結合 Claude Sonnet 4.6 在 CodeScaleBench 任務上表現優於單獨的 Mythos 模型,且成本更低,提供了具體的工具與模型組合實戰評估。
Jason Liu 探討了 Codex 如何使用電腦、Chrome 或內建瀏覽器,明確指出了不同工具的使用場景與時機。這提供了具體的工具使用指導。
Google 發布了 Open Knowledge Format,一種用於 AI agent 的知識庫格式,基於類似 Wiki 的組織方式。這對於構建和管理 AI agent 的知識體系提供了新的方法和工具。
這篇文章總結了 MCP 協定在生產環境中的失敗模式,並提供了應對方案。對於使用 MCP 協定的開發者,這是一份寶貴的實戰經驗總結。
作者構建了一個 agent 就緒檢查器,並分享了在構建過程中學到的關於正確處理 llms.txt、OpenAPI spec 和 MCP endpoint 的經驗。這對構建可被 agent 調用的服務有實質性指導。
作者介紹了 Graperoot 工具,利用依賴圖來提取程式碼庫中最相關的部分,以減少 coding tool 的 token 消耗,從而節省成本。這直接解決了開發者在使用 Claude Code 等工具時面臨的實際問題。
imil.net 分享 RTX 5080 和 RTX 3090 的硬體設置,以實現 Qwen 3.6 27B Q8 的高效能(80 Tok/s),提供了非常具體的硬體配置與效能數據,對想在家中部署大型模型的開發者極具參考價值。
Simon Willison 更新其 OpenAI WebRTC Audio Session 工具,加入文件上下文功能,直接提升與 OpenAI API 互動的實戰能力。
Simon Willison 分享 Pyodide 314.0 支援將 WASM wheels 發布到 PyPI,對開發者而言是重要的實作更新。
社群用戶分享自製工具 `@uge/payo`,用於自動生成 `.cursorrules` 以解決 Cursor 在專案結構和約定上的問題,並可轉換為 Claude、Copilot、Codex 等工具的規則,這是一個非常具體的實作解決方案,直接幫助解決了 Cursor 的「踩坑」問題。
r/cursor 用戶分享在使用 Cursor 中遇到的模型選擇與計費問題,並希望能限制帳戶使用的模型,這直接反映了 Cursor 實戰使用中的痛點和需求,提供了寶貴的用戶反饋。
r/cursor 用戶分享他們同時使用 Cursor、Windsurf 和 Codex 進行協同開發的經驗,以及 AI 在開發流程中的角色,這提供了多種工具整合使用的實戰案例。
GitHub Copilot Code Review 新增了組織控制器、內容排除支持等功能,並移除了儲存庫自訂指令的字符限制。這直接關係到開發者使用 Copilot 的效率和配置。
警示 Claude Code 中存在惡意軟體攻擊 npm 套件,提醒開發者安全風險,與實作安全息息相關。
Fireworks AI 介紹 Cursor 如何利用 Speculative Decoding API 達成高吞吐量,並宣布新 API,對開發者實作有直接幫助。
Simon Willison 宣布 datasette-agent 0.2a0 版本,允許工具在中途向使用者提問,這是 agent 互動性的重要進展,直接影響 agent 開發者。
r/LLMDevs 更新 LeanContext,將其從 VS Code 擴充功能擴展為 MCP Server,旨在減少 API 成本和提高代理效率。
r/cursor 分享 Cursor compression 在長期的重構過程中,會遺忘最近的編輯,導致 agent 重新引入已移除的變更,是關於 Cursor 上應用的真實踩坑與根本原因分析。
r/ClaudeAI 使用者製作了實體 Claude Code 使用監控器,展示了對 API 使用率進行本地監控的創意實作。
r/cursor 分享 Cursor agent 在 tagging 87 個任務時因進入無限循環,導致一小時內產生 1300 多美元的費用,是關於 Cursor agent 成本和 bug 的真實踩坑經驗。
r/cursor 使用者認為 Cursor 的速度過快,導致產生了不夠理想的程式碼,打斷了思考流程,並陷入了不良的 'vibe coding' 循環,提供了對工具速度與品質的深度反思。
r/PromptEngineering 分享 Cursor 的 50% 折扣推薦連結,並強調其對開發流程的改變,屬於工具推廣與使用心得。
GitHub Copilot 推出第三方 coding agent 的安全驗證功能,這對於使用這些工具的開發者來說,增強了安全性,有助於實戰應用。
Simon Willison 發布了 datasette-agent-edit 0.1a0,並提到 agentic editing 的設計,特別是 Claude 的 text-editor-tool,這對於開發可編輯文本的 agent 很有啟發。
Simon Willison 發布了 llm 0.32a3,並指出它幾乎完全由 Claude Fable 5 寫成,並連結到他關於使用 Claude Code 添加 Datasette Agent 功能的文章,這展示了新模型在開發工具上的實際應用。
分享如何將產品型錄連接到 Claude 並透過 MCP Server 實現,強調了 AI 在 B2B 業務中的實用性,並展示了具體的技術實現。
警告 Claude Code 的安全漏洞,涉及 npm 套件和 VS Code 設定,對使用 Claude Code 的開發者是重要的實戰提醒。
提及 Claude Code 的 Endgame,暗示其未來發展和實作潛力,值得關注。
分享一個高度隔離 Claude Code 的設定,利用 BitLocker 加密的 SSD 和虛擬機,對關注安全性的開發者是重要的實作建議。
介紹 6 個開源 repo 如何大幅降低 Claude Code 的 token 成本,並提及 ccusage 和 RTK 等工具,提供了實際的成本優化方案。
美團 LongCat 團隊為 OpenClaw 提供官方免費 API,旨在規避第三方訂閱風險,並保證賬號安全,對 OpenClaw 用戶來說是實用的整合資訊。
Qodo Blog 深入比較 Claude Code 和 Cursor,分析兩者在 Agentic Execution、Local Dev、Review Layer 的差異與優缺點,對開發者選擇工具非常有幫助。
Reddit 用戶製作了一個 Windows App 來追蹤 Claude Code 使用量,並用 Claude Code 開發,展示了 AI 工具的應用。
Reddit 分享 Graperoot,一個 MCP 工具,透過建立程式碼依賴圖來避免重複讀取程式碼庫,並聲稱已節省大量成本,提供了 AI Agent 在軟體開發中的實作價值。
Reddit 用戶開發了一個名為 Context-Simplo 的 MCP 伺服器,用於節省 Cursor/Claude 中的 Token 浪費,提供了一個解決實際痛點的工具。
Reddit 比較 Cursor Pro、Claude Code 和 Codex 的每月 $20 使用量,試圖釐清哪種工具能提供更多的程式碼相關使用量,直接幫助用戶評估工具的性價比。
介紹如何使用 Weaviate MCP 伺服器,為 Claude Code、Cursor 和 VS Code 提供程式碼與文件上的混合搜尋,這直接涉及開發者工具的整合與實戰應用。
介紹了一個開源的本地多 Agent Harness,整合了 Claude Code 和頂級記憶層,並可作為一個完整的辦公室運行,高度符合使用者對實作技巧、工作流和工具的偏好。
用戶詢問 MacBook Pro M5 Max 是否能用本地模型取代 Cloud AI Coding 工具(如 Claude Code, Codex),關注本地模型取代雲端 AI Agent 的可能性,這對關注本地化 AI 部署的用戶有實戰價值。
分享了如何用 Python 建立類似 Claude Code 的終端 UI 函式庫,解決了終端 UX 的重複開發問題,這對開發者建構 AI 互動介面有實際指導意義。
用戶分享了使用 Cursor Ultra Plan 的 Composer 2.5 (Fast) 的體驗,表示其配額充足,並計畫嘗試多 Agent 協調,這符合使用者對開發者工具實戰使用和工作流的關注。
Cursor 介紹其 AI-first 的編輯器演進,特別是邁向 Agentic 編輯和預期未來 Agent Fleet 的發展,這對關注 AI 驅動軟體開發的用戶有前瞻性與實用價值。
Le Chat 推出企業級連接器目錄(beta)及自定義擴展能力,讓用戶能將工作流整合到 AI 助理中,這增強了 AI 助理的實用性和客製化程度。
介紹 OpenLumara,一個 token-efficient、模組化的 AI agent 框架,強調其為本地模型設計,並已用於個人助理,對建構本地 AI Agent 有實戰參考價值。
分享自製 VS Code 擴充功能,簡化 Cursor MCP server 的安裝配置,解決了手動編輯 JSON 的痛點,對 Cursor 用戶有實用價值。
Bugbot 的自我改進功能,展示 AI code review 工具的實戰進展,具體且有數據支持。
使用者比較 Cursor 和 Claude Code,認為 Cursor 在理解意圖方面不如 Claude Code,並分享了具體例子,這是對開發者工具的深度實戰比較。
Cursor 推出 Composer 2.5,並詳細描述了其在持久性工作、指令遵循和協作方面的改進,這是具體的開發者工具更新與實戰內容。
Cursor 分享其 agent harness 的開發經驗,強調願景驅動、假設測試和迭代,這是對構建 AI 工具的實際方法論。
Cursor 推出 SDK,讓開發者能用相同的 runtime、harness 和模型建構 agent,這是對開發者工具生態的重大更新,並提供實戰可能性。
Copilot Code Review 的客製化與擴展性,提及 Agent skills 和 MCP 協議,顯示出更深入的工具整合與實戰應用方向。
Claude Code Prompt Improver 插件,旨在改善 Claude Code 的初始輸出,透過研究程式碼庫並提出問題來優化 prompt,直接解決了 prompt engineering 的實戰痛點。
用戶開發了一個名為 Composer 的實時 Markdown 編輯器,讓 Claude Code Agent 能與使用者協同編輯,解決了 Agent 在團隊協作中被隔離的問題,是開發者工具的實戰創新。