新聞宏觀經濟Anthropic 表示 Claude Mythos 發現了 HAWK 與 AES 的新攻擊

Anthropic 表示 Claude Mythos 發現了 HAWK 與 AES 的新攻擊

作者: Decrypt·

重點速覽

  • Anthropic 表示 Claude Mythos Preview 找到了 HAWK 的新弱點,HAWK 是一個仍在接受 NIST 審查的後量子簽章候選方案。
  • HAWK 攻擊將恢復最小秘密金鑰的估計工作量從 2^64 次運算降至 2^38 次。
  • Anthropic 表示,修補 HAWK 問題很可能需要將該方案的金鑰大小大致加倍,這會削弱其主要優勢。
  • 該模型也對 7 輪 AES 研究版本提出了新的攻擊,優於 2013 年的先前最佳結果。
  • Anthropic 表示,Claude 在數天內找出 AES 發現後,研究人員又花了數百小時進行驗證。
Anthropic 表示 Claude Mythos 發現了 HAWK 與 AES 的新攻擊

Anthropic 表示,其尚未發布的 Claude Mythos Preview 模型發現了一種此前未知的 HAWK 攻擊,將恢復其最小金鑰的成本從 2^64 次運算降至 2^38 次。

該模型也將對 7 輪版本 AES 的攻擊速度提升了 200 到 800 倍,超過了密碼學家在 2013 年創下的紀錄。

每項結果大約耗費 100,000 美元的 API 使用成本,而 Anthropic 員工則花了數百小時驗證 AES 的發現確實成立。

Anthropic 週二表示,其最強 AI 模型的一個尚未發布版本,找到了兩種此前未知的密碼演算法攻擊,其中之一針對的是目前正在競爭成為美國聯邦標準的一種方案。

該方案是 HAWK,一種數位簽章系統——也就是能證明某筆交易來自你本人、卻不會暴露私人金鑰的數學機制——其設計目標是抵禦未來的量子電腦。5 月,國家標準與技術研究院(NIST)將 HAWK 推進到其後量子簽章競賽的第三輪,並使其成為目前最後一個仍留在競爭中的格狀基底候選方案。

Claude 在 HAWK 的數學中辨識出人類研究者此前未曾使用的對稱性。在最小配置下,恢復秘密金鑰的成本從 2^64 次運算降至 2^38 次,約少了 6,700 萬倍的工作量。

Anthropic 表示,修補這個問題大致需要將 HAWK 的金鑰大小加倍。"Unfortunately, doubling HAWK's key size eliminates many of the reasons making the scheme (as it currently stands) an attractive PQC signature candidate," 該公司寫道。

New Anthropic research: Discovering cryptographic weaknesses with Claude. Claude Mythos Preview has helped our researchers find weaknesses in cryptographic algorithms—the mathematical methods that are used to keep data private. Read more: — Anthropic (@AnthropicAI) July 28, 2026

這種取捨對區塊鏈的影響比表面上看起來更大。簽章大小就是區塊空間,而區塊空間就是費用,因此任何尋找抗量子替代方案的鏈,都必須部分考量每個簽章占用多少位元組。精簡金鑰與快速簽署原本是 HAWK 的主要賣點,而這個修補方式會讓它失去不少這類優勢。

別擔心,hodlers:你的幣目前還是安全的。HAWK 從未在任何地方部署,而 Bitcoin 仍在使用 ECDSA,也就是像 HAWK 這類候選方案最終要取代的前量子簽章方案。

Anthropic 表示,在發布前已將這兩項結果告知演算法作者,以及美國政府與產業合作夥伴,並且就 HAWK 的發現與 NIST 協調。

AES 結果需要更多鼓勵

第二項攻擊目標是 AES,也就是保護你的 HTTPS 流量、加密磁碟與交易所後端的密碼。完整的 AES-128 會經過 10 輪混淆,而 Claude 攻擊的是一個 7 輪研究版本,這個版本自 2013 年以來就沒有更好的突破。

研究人員刻意把任務設得很難。他們禁止模型使用 AES 密碼分析的五個既有家族,並要求它發明第六種。提示中甚至寫道,第一次差分攻擊並沒有打破任何東西——它是在發明這個遊戲。Claude 也繼承了先前 agent 執行留下的工作筆記,而那些嘗試已經燒掉了大約 200 個失敗的攻擊變體。

即便如此,模型仍拒絕走較簡單的路徑。根據 Anthropic 公布的逐字稿,Claude 對研究人員表示:"On AES-128 r5/r6/r7 it found nothing because there's nothing easy to find; this is the most-studied block cipher in existence,"。

接下來的三天裡,Anthropic 只發了三則實質訊息,其中包括:"no again the goal is that we have highly inteligent [sic] model as good top researcher, we want to find new attacks." 另一則訊息則拒絕讓 Claude 改用更容易破解的密碼。

之後,它提出了論文稱為 Möbius Bridge 的技巧,消除了攻擊者先前必須猜測的 9 個金鑰位元中的其中一個。將這個成果整理成最終發表版本,又花了幾天時間與十億個輸出 token。

最接近實際應用的發現,反而得到最少關注。Claude 也在桌上型電腦上、不到一小時內破解了 13 輪 LEA。LEA 是韓國國家標準,也是 ISO 的輕量級加密標準,供手機與物聯網裝置使用;先前最佳攻擊需要 2^98 個明文對。實際部署的 LEA 版本使用 24 輪,因此目前沒有任何已上線系統被破壞。

驗證比發現更花時間

HAWK 論文對分工的描述相當直白。其作者寫道:"The majority of mathematical discoveries in this paper were AI-assisted. Human author contribution mainly consisted of directing, organizing and verifying AI work,"。

Claude 在數天內找到了 AES 的想法。接著,Anthropic 研究人員花了數百小時學習足夠的密碼學知識來確認它是否有效——而同一個模型先前曾在內部測試中找出 Firefox 的 271 個漏洞。

"The cybersecurity community is now grappling with the fact that language models are able to discover so many bugs that the standard human processes (like vulnerability triage, verification, and remediation) struggle to keep up," Anthropic 寫道,並警告人類研究者可能會成為瓶頸。

Anthropic 也建立了 CryptanalysisBench——一個包含 191 項破密任務的基準測試,題目多數來自 NIST 競賽。模型必須提交可運作的攻擊腳本,該腳本要麼贏得正式安全遊戲,要麼失敗,沒有部分得分,也沒有人工評分。

Mythos 5 在已知解答的任務上破解了 85.7%,而測試中最弱的模型為 65.3%。面對沒有公開破解結果的完整強度密碼,所有模型的得分都低於 9%。

Daily Debrief Newsletter