Anthropic 推出 Claude Sonnet 4.5:程式碼與智能代理新標竿,全面提升電腦使用及推理能力
Claude Sonnet 4.5 被宣稱為最佳編碼模型,對建構複雜代理和電腦使用有優勢,是值得關注的模型發布。
• Claude Sonnet 4.5 已正式推出,被譽為全球最頂尖的程式碼模型,並在建構複雜智能代理和電腦使用能力上表現卓越。 • 它在 SWE-bench Verified 評估中展現最先進的軟體程式設計能力,能專注執行複雜的多步驟任務超過 30 小時。 • 該模型在 OSWorld 基準測試中,電腦使用能力從 Sonnet 4 的 42.2% 提升至 61.4%,並在推理、數學及多領域專業知識方面有顯著進步。 • Anthropic 同步推出多項產品升級,包括 Claude Code 的檢查點、VS Code 擴充功能,以及提升代理長期運作能力的 API 新功能。 • 此外,Anthropic 也發布了 Claude Agent SDK,將其開發底層基礎設施開放給開發者使用。 • Sonnet 4.5 是 Anthropic 迄今為止最一致且安全的模型,大幅提升了對齊性,並引入 AI 安全等級 3 (ASL-3) 保護,有效防範提示注入攻擊。 • 該模型現已全面上市,透過 Claude API 即可使用,定價與 Sonnet 4 相同,每百萬 tokens 費用為 $3/$15。
來源:Anthropic News
閱讀原文 ↗