Anthropic 旗艦模型 Claude Opus 5 正式登場:具備強大長週期任務處理能力與極低提示詞注入風險

Simon Willison 引用 Boris Cherny 對 Opus 5 抗提示詞注入(prompt injection)的系統卡片觀察,具備高信號實作參考價值

• Anthropic 正式推出全新旗艦模型 Claude Opus 5,定價與前代相同但效能全面超越,樹立業界新標竿。 • 根據 Boris Cherny 的觀察與官方系統卡揭露,Opus 5 是目前 防禦提示詞注入(Prompt Injection) 能力最強的模型,在紅隊測試中極難被成功攻擊。 • 該模型在 長週期任務(Long-horizon tasks) 的表現上表現亮眼,低功耗模式下的性價比與表現甚至超越高功耗的 Sonnet 5。 • 在基準測試中表現優異,不僅在 Frontier-Bench 與 GDPval-AA 拿下 SOTA(State-of-the-Art),更在 OSWorld 2.0 以三分之一的成本擊敗競品。 • 測試顯示其展現出驚人的自主解決問題能力,甚至能在無法直接檢視圖像的情況下,自行編寫電腦視覺管道來提取幾何圖形。

「Opus 5 是我們迄今為止最不容易遭受提示詞注入攻擊的模型。」—— Boris Cherny


來源:Simon Willison

閱讀原文 ↗

另見:r/ClaudeAI、r/ClaudeAI、r/ClaudeAI

← 回首頁