打破 Claude Code Opus 5 自動模式:安全機制反成資安破口
Simon Willison 轉載資深安全研究員破解 Claude Code 自動模式的深度分析與提示詞注入研究。
• Anthropic 近期將 Claude Code 的自動模式設為預設,並寄望其能防禦 提示詞注入攻擊。
• 安全研究員 Johann Rehberger 發現了一種針對自動模式的攻擊,成功率高達 80%。
• 攻擊手法透過誘導 AI 下載並解壓縮 zip 檔,執行會匯入並執行本地 struct.py 檔案的程式碼。
• 諷刺的是,在某些情況下,自動模式甚至會封鎖 Claude 想要終止惡意軟體行程的清除指令。
• > 作者 Simon Willison 認同研究員結論:若存在遭遇惡意攻擊的風險,執行 AI 代理的唯一安全方法就是使用 沙盒環境。
• 用戶應在容器、虛擬機或作業系統沙盒中運行無人看管的編碼代理,並嚴格限制網路連線。
• 切勿將家目錄、SSH 金鑰或雲端憑證等敏感資料暴露給代理執行環境。
來源:Simon Willison
閱讀原文 ↗