Anthropicが、Claude Mythos PreviewによるHAWK・AES暗号解読の発見それぞれに、開発コストとして約10万ドルのAPI利用料がかかったと公開した。同時に、実装を突破し形式的検証に通る攻撃スクリプトの提出を要求する評価基盤「CryptanalysisBench」(191タスク・6暗号ファミリー)をETH Zurich・Tel Aviv University・University of Haifa・TU Berlinと共同で用意し、Anthropicとは無関係の暗号研究者Matthew Green氏による独立した評価も受けた。ベンチマーク設計者やセキュリティ評価者にとっての意味は具体的だ——「AIが脆弱性を発見した」という主張を、事後の説明文だけでなく、実際に動かして壊せる成果物と第三者のレビューという二重の裏付きで判定する型が、ここに一つ具体化している。AIの自律的な研究能力に関する発表が相次ぐ中で、本件はその評価軸を「発表された物語」から「再現・検証可能な成果物」へ押し上げる一例になる。本当の問いは、この水準の裏付け(コスト開示・実行可能な証拠・独立レビュー)が今後の同種発表でも標準になっていくのか、それとも例外にとどまるのかだ。
何が起きたか
Anthropicは研究プレビュー版モデル「Claude Mythos Preview」による2件の暗号解読の発見——簡略版AESへの攻撃改良とポスト量子署名方式HAWKへの攻撃——について、開発コスト・協調開示の経緯・評価基盤の詳細を明らかにした。HAWKの脆弱性は2026年6月にHAWKの提案者(著者)と共有され、NISTの公開メーリングリストへ協調開示された。AESへの攻撃は、Claude Mythos Previewが3日間ほぼ自律的に文献調査と数学実験を行い、合計で約10億出力トークンを生成して発見したものである(HAWK側の「約60時間」とは別の集計であり、両者を合算しないよう注意が必要)。
仕組み・詳細
評価基盤「CryptanalysisBench」は、AES・SHA-3・軽量暗号(LWC)・ポスト量子暗号(PQC)という4つのNIST標準化コンペ由来のタスクを、191個・6つの暗号方式ファミリーにまとめてパッケージ化したベンチマークである。設計上の特徴は、単に脆弱性を言葉で説明するだけでは不十分で、実装を実際に突破し形式的検証に通る攻撃スクリプトの提出を要求する点にある。共同研究機関はETH Zurich・Tel Aviv University・University of Haifa・TU Berlin。
数字で見る
- 各発見の開発コスト: 約10万ドルのAPI利用料(HAWK・AESそれぞれに個別。合計ではない)
- AES攻撃の自律作業量: 3日間で合計約10億出力トークン
- HAWK攻撃: 発見・開発・検証を含め約60時間(Anthropic研究者1名がMythosと1週間共同作業)。AESとは別集計
- CryptanalysisBench: 191タスク・6暗号ファミリー・4つのNIST標準化コンペ(AES/SHA-3/LWC/PQC)由来
背景
HAWKはNISTによる2年間・2回の専門家レビューを経てもなお見逃されていた欠陥だった。Anthropicは2026年6月にHAWKの著者へ攻撃手法を共有し、NISTの公開メーリングリストへ協調開示している。Anthropicとは独立の暗号研究者Matthew Green氏は自身のブログで、この結果を「まだ超知能的な暗号解読ではないが、非常に印象的」と評価した。同氏はHAWK攻撃について使われた材料自体は珍しくない点が分野にとって示唆的である一方、AES攻撃は実用性のない小さな技術的改善にとどまると位置づけている。いずれの攻撃も、AESは実運用の10ラウンド実装ではなく7ラウンドの簡略版が対象、HAWKも未配備の候補方式であるため、現行の実運用システムには影響しない。
なぜ重要か
暗号解読に限らず、AIが「専門家の見落としを発見した」「人間の手法よりN倍速い」といった研究成果の主張は今後も増えていくとみられる。今回のケースが他と一線を画すのは、主張が(1)開発コストの開示、(2)実行して壊せるかどうかを問う実行可能な証拠(CryptanalysisBenchの形式的検証)、(3)Anthropicの利害から独立した第三者(Matthew Green氏)によるレビュー、という3つの裏付けを伴っている点だ。この3点セットが揃って初めて、「AIが本当に新しい発見をした」という主張は物語ではなく検証可能な成果になる。本当の問いは、AI研究能力に関する発表がこれから増える中で、この水準の裏付けが業界の標準になっていくのか、それとも本件が稀な例外にとどまるのかである。