摘要
- Anthropic 表示,其未發布的 Claude Mythos Preview 模型發現了對 HAWK 的一種先前未知的攻擊,將竊取其最小金鑰的成本從 2^64 次操作降低到 2^38 次。
- 該模型還將對 7 輪 AES 的攻擊速度提高了 200 到 800 倍,打破了密碼學家於 2013 年創下的紀錄。
- 每次結果花費約 10 萬美元的 API 使用費,Anthropic 員工花費數百小時驗證 AES 工作的真實性。
Anthropic 今天表示,其最強大 AI 模型的一個未發布版本發現了兩種先前未知的密碼學算法攻擊,其中一種針對目前正在競爭成為美國聯邦標準的方案。
該方案是 HAWK,一種數位簽章系統——一種數學方法,用於證明交易來自您本人,同時從不暴露您的私鑰——旨在抵禦未來的量子電腦。非監管聯邦機構和實驗室 NIST 已於 5 月將其納入後量子簽章競賽的第三輪,它是目前唯一仍在競爭的基於格(lattice)的候選方案。
Claude 發現了 HAWK 數學中隱藏的一種對稱性,而此前沒有人想到利用它。對於最小配置,恢復秘密金鑰的成本從 2^64 次操作降至 2^38 次,工作量減少了約 6700 萬倍。
修復它意味著將 HAWK 的金鑰大小大約加倍。「不幸的是,將 HAWK 的金鑰大小加倍消除了該方案(目前)作為有吸引力的 PQC 簽章候選者的許多原因,」Anthropic 寫道。
Anthropic 新研究:利用 Claude 發現密碼學弱點。
Claude Mythos Preview 幫助我們的研究人員發現了密碼學算法中的弱點——這些數學方法用於保護數據隱私。
— Anthropic (@AnthropicAI) 2026 年 7 月 28 日
這種取捨對區塊鏈的影響比聽起來更大。簽章大小就是區塊空間,而區塊空間就是費用,因此任何尋找抗量子替代方案的鏈在某種程度上都是在按字節選擇簽章。緊湊的金鑰和快速的簽章是 HAWK 的全部賣點,而修復方案使其失去了大部分優勢。
持有者們不用擔心:你們的幣目前是安全的。HAWK 從未在任何地方部署過,而比特幣仍然運行在 ECDSA 上,這是一種前量子簽章方案,像 HAWK 這樣的候選方案最終旨在取代它。
Anthropic 向演算法作者以及美國政府和產業合作夥伴披露了這兩項結果,並在發表前與 NIST 協調了 HAWK 的發現。
AES 的結果需要一番鼓勵
第二個攻擊目標是 AES,這個加密演算法保護著你的 HTTPS 流量、加密硬碟和交易所的後端。完整的 AES-128 會將資料經過 10 輪加密,而 Claude 攻擊的是一個 7 輪的研究版本,自 2013 年以來無人能改進。
實驗設定刻意嚴苛。研究人員禁止模型使用所有五個已知的 AES 密碼分析家族,並要求它發明第六種,在簡報結尾寫道,首次差分攻擊並未擊敗任何東西——它開創了這個遊戲。Claude 還繼承了先前代理運行的工作筆記,這些筆記已經耗費了大約 200 個失敗的攻擊變體。
但它還是拒絕了。「在 AES-128 r5/r6/r7 上,它什麼也沒找到,因為沒有容易找到的東西;這是現存研究最透徹的分組密碼,」模型根據 Anthropic 發表的對話記錄告訴研究人員。
在接下來三天裡,Anthropic 只發送了三個實質性的訊息,其中包括:「不,再說一次,目標是我們擁有像頂尖研究員一樣高度智能的模型,我們想要找到新的攻擊。」另一個訊息拒絕讓 Claude 將 AES 換成更簡單的密碼。
然後它產生了論文稱之為莫比烏斯橋的技巧,消滅了攻擊者先前必須猜測的九個金鑰字節中的一個。將其完善成發表版本又花了幾天時間和十億個輸出 token。
最接近實際應用的發現反而受到的關注最少。Claude 還破解了 LEA 的 13 輪,這是一種韓國國家標準和 ISO 輕量級加密標準,專為手機和物聯網設備設計,在桌面上不到一小時就完成了,而先前的最佳結果需要 2^98 個明文對。實際部署的 LEA 運行 24 輪,因此目前沒有實際系統被攻破。
驗證比發現花費更長時間
HAWK 論文對分工的描述異常直白。「本文中的大部分數學發現是 AI 輔助的。人類作者的貢獻主要包括指導、組織和驗證 AI 的工作,」作者寫道。
Claude 在幾天內找到了 AES 的思路。Anthropic 的研究人員隨後花了數百小時學習足夠的密碼學知識來確認其有效性——同一個模型在內部測試中發現了 Firefox 的 271 個漏洞。
「網路安全社群現在正在努力應對一個事實:語言模型能夠發現如此多的漏洞,以至於標準的人類流程(如漏洞分類、驗證和修復)難以跟上,」Anthropic 寫道,並警告人類研究人員可能成為瓶頸。
Anthropic 還建立了 CryptanalysisBench——191 個密碼破解任務,主要來自 NIST 競賽。模型提交一個有效的攻擊腳本,要麼贏得正式的安全遊戲,要麼失敗,沒有部分分數,也沒有人工評分。
Mythos 5 破解了 85.7% 的已知解決方案任務,而測試中最弱的模型為 65.3%。對於沒有公開破解方法的全強度密碼,每個模型的得分都低於 9%。











