OpenAIが、社内で未公開の次期主力モデル「Astra」に、球充填・群論・作用素環論など8分野にまたがる数学の長年未解決問題10問を解かせ、各証明をLeanで形式検証した上で公開した。10問すべての解答生成にかかった計算コストは、GPT-5.6 Sol API料金換算でわずか約2000ドル——数理研究への投資判断を下す側から見れば、数学的発想・証明の生成そのものはもはや稀少な人的リソースを要さず、律速段階は人間による原稿準備と形式検証の作業へ移ったことを意味する。OpenAI自身が「AIが完全に生成した証明を人間の著作だと主張すれば、システムの貢献と人間の知的労働の双方を偽ることになる」と著者性への立場を明言したのも、この転換を踏まえた動きだ。AIの自律的な研究能力がベンチマークの数値としてではなく査読可能な数学的成果として積み上がりつつあるという潮流を一歩進める事例であり、次に問われるのは「発見の速さ」ではなく「人間による検証・原稿化のキャパシティ」がボトルネックになる時代への備えだ。

何が起きたか

OpenAIは公式ページ「Ten advances in mathematics」で、社内の未公開モデル「Astra」(次期主力モデルの内部バージョン)が、球充填(sphere packing)・符号理論・算術回路計算量・群論・作用素環論・量子計算量・格子暗号・極値組合せ論という8分野にまたがる10の長年未解決問題の解答を生成したと発表した。数学的論証そのものはAstraが生成し、人間側は原稿の準備とLeanでの証明の形式化を担当した。検証済みの証明書(certificate)はGitHub上で公開されている。

主な成果として、特定の性質(T)を持つ群がフォン・ノイマン代数によって一意に決定されるとする「Connesの剛性予想」の反証、高次元球充填密度に関するCohn–Elkies閾値までの新しい上界、群論の中心的な未解決問題である「non-sofic群」の存在を示す構成などが挙げられている。

なお、発表の正確な公開日は一次ソース本文にバイライン日付の記載がなく確認できていない(未検証)。二次報道の間でも日付表記に揺れがあり、本稿では「2026年8月上旬」という幅のある時期以上には特定していない。

仕組み・詳細

OpenAIは、数学的論証の生成自体はAstraによるものであり、人間は原稿準備とLeanでの形式検証を担当したと明記している。証明がLeanで形式検証されているという点は、自然言語で「証明らしく書かれた文章」ではなく、定理証明支援系による機械的な正しさの検証を経ていることを意味する。

著者性については、OpenAIは「AIシステムが完全に生成した証明を人間の著作であるかのように主張することは、システムの貢献と人間の真の知的労働の両方を誤って伝えることになる」と述べ、AI生成であることを隠さずに明示する立場を取った。

10問すべての解答生成にかかった計算コストは、GPT-5.6 Sol API料金換算で約2000ドルだった。OpenAI本文は「Sol」とのみ表記しているが、developers.openai.comのモデルドキュメントで「Sol」がGPT-5.6ファミリーの旗艦モデル「GPT-5.6 Sol」であることを別途確認できる。

数字で見る

  • 解決した長年未解決問題の数: 10問
  • 対象分野: 8分野(球充填・符号理論・算術回路計算量・群論・作用素環論・量子計算量・格子暗号・極値組合せ論)
  • 10問すべての解答生成にかかった計算コスト: GPT-5.6 Sol API料金換算で約2000ドル

背景

OpenAIは同時期に、Astraの10大成果とは別に「Erdős単位距離予想の反証」という発表も出しているが、この発表にはAstraへの言及がなく、汎用推論モデルによる別成果とされている。両者は別モデル・別発表であり、混同しないよう注意が必要だ。

なぜ重要か

証明の生成そのものにかかる計算コストが約2000ドルまで下がったという事実は、数学研究における律速段階の所在を変える。これまで稀少だったのは「証明のアイデアを思いつく人材」だったが、今後は「AIが生成した論証を検証し、査読可能な原稿に落とし込む人間の労力」がボトルネックになりうる。

OpenAIが著者性について踏み込んだ立場表明を行ったのも、この転換を見据えたものだ。数学的発想の生成が機械側に移る一方で、原稿化・形式検証という人間側の寄与をどう正当に評価し記録するかは、AI研究協業のあり方そのものに関わる論点として今後も問われ続けることになる。