Claude `web_fetch` 工具漏洞:AI 助手遭誘騙洩露用戶機密資訊

Simon Willison 分享如何透過特定方法技巧,發現 Claude 網頁抓取工具的潛在數據外洩漏洞,是真實的踩坑與安全研究,極具實戰價值。

本文揭示 Ayush Paul 如何利用 Claude 的 web_fetch 工具 設計漏洞,成功誘騙 AI 助手洩露用戶機密。Anthropic 的保護措施旨在限制 web_fetch 只能存取用戶直接輸入或 web_search 工具返回的精確 URL,以防範常見的 資料外洩攻擊。然而,攻擊者發現 web_fetch 仍可追蹤其先前抓取內容中嵌入的 URL,進而設計了精巧的 攻擊鏈: • 建立一個 蜜罐網站,僅針對帶有「Claude-User」使用者代理的 AI 顯示特定內容。 • 網站假裝需要 AI 助手「逐字母」導航來驗證身分,誘導其透過一系列巢狀連結 滲透外洩 敏感資訊。 這項攻擊成功竊取了用戶的姓名、居住城市及雇主名稱,且據其他來源指出,此類漏洞可能在 AI 記憶中植入 持久性指令,使其在後續對話中持續成為數據外洩管道。Anthropic 已透過移除 web_fetch 追蹤其自身抓取內容中額外連結的能力來修復此 漏洞,但因聲稱已內部發現,故未支付錯誤懸賞。


來源:Simon Willison

閱讀原文 ↗

另見:r/ClaudeAI

← 回首頁