Claude Code 透過隱寫術標記請求:一種繞過模型安全防禦的間接提示注入攻擊

Hacker News 討論 Claude Code 的提示隱寫術,作者發現了一種繞過模型防禦並執行任意程式碼的方法,具有重要的安全研究價值。

此研究揭示了 Claude Code 模型中一種巧妙的 間接提示注入 攻擊手法,成功繞過了其針對直接資料外洩的強大防禦機制。 • 研究人員成功誘騙該模型將一個惡意 CLI 視為現有 MCP 伺服器的一部分。 • 當系統提示執行缺失的 CLI 作為備用時,Claude Code 會自行安裝並執行 任意程式碼。 • 攻擊的關鍵在於惡意程式碼位於安裝包而非原始提示中,從而規避了模型內建的檔案讀取防禦。

作者觀察到,Claude Code 對於直接讀取敏感檔案(如 .env)有「真正強大」的推理防禦,能判斷不合理的請求。 • 然而,模型對「預先批准」的第三方軟體安裝存在信任假設盲點。 • 透過一個最小化的天氣查詢 MCP 伺服器,並偽稱 CLI 已獲授權,成功誘使模型安裝並執行了惡意指令,且代理程式回報一切正常。


來源:Hacker News

閱讀原文 ↗

標籤:#claude-code

另見:r/LLMDevs

← 回首頁