Anthropic 研究員利用 Claude Mythos 發現密碼學演算法數學漏洞

Simon Willison 整理 Anthropic 研究員利用 Claude 尋找密碼學漏洞並附上原始 prompt 的實用分享。

• Anthropic 研究團隊透過 Claude Mythos 成功在 HAWK 數位簽章與簡化版 AES 中發現全新的數學漏洞與攻擊路徑。 • 這次研究成果凸顯了大型語言模型在密碼分析領域的潛力,並非僅能處理簡單任務,更能執行具備發表水準的深度研究。 • 整個實驗過程耗時約 60 小時,預估 API 成本高達 10 萬美元,其中人類研究員的主要介入在於持續鼓勵模型「找出值得發表的成果」並克服放棄傾向。 • 雖然這些漏洞目前對現今的電腦系統尚無實質的實際影響,但已為 AI 協助高難度科學研究樹立了重要里程碑。 • > 「模型往往認為這不可能解決而放棄嘗試,因此需要適當的提示詞來引導。」 • 此項研究是與蘇黎世聯邦理工學院、特拉維夫大學及海法大學合作建立 CryptanalysisBench 評測的一環,展示了 AI 在前沿紅隊測試與安全研究中的強大能力。


來源:Simon Willison

閱讀原文 ↗

另見:Anthropic Eng+Research

← 回首頁