打破 Claude Code Opus 5 自動模式:安全機制反成資安破口

Simon Willison 轉載資深安全研究員破解 Claude Code 自動模式的深度分析與提示詞注入研究。

• Anthropic 近期將 Claude Code 的自動模式設為預設,並寄望其能防禦 提示詞注入攻擊。 • 安全研究員 Johann Rehberger 發現了一種針對自動模式的攻擊,成功率高達 80%。 • 攻擊手法透過誘導 AI 下載並解壓縮 zip 檔,執行會匯入並執行本地 struct.py 檔案的程式碼。 • 諷刺的是,在某些情況下,自動模式甚至會封鎖 Claude 想要終止惡意軟體行程的清除指令。 • > 作者 Simon Willison 認同研究員結論:若存在遭遇惡意攻擊的風險,執行 AI 代理的唯一安全方法就是使用 沙盒環境。 • 用戶應在容器、虛擬機或作業系統沙盒中運行無人看管的編碼代理,並嚴格限制網路連線。 • 切勿將家目錄、SSH 金鑰或雲端憑證等敏感資料暴露給代理執行環境。


來源:Simon Willison

閱讀原文 ↗

標籤:#claude-code

← 回首頁