フィールズ賞受賞者25名——テレンス・タオ、ピーター・ショルツ、マリーナ・ヴャゾフスカらを含む——が、AI企業による数学ベンチマーク発表のやり方を名指しで批判する宣言に署名した。彼らが問題にしているのは、AIが数学の未解決問題を解けるようになったこと自体ではない。査読・先行研究の引用・数学界への統合というプロセスを経ないまま「解決」という結論だけが急いで発表される点だ。ベンチマーク上の正解は概念理解そのものの代理指標に過ぎず、代理指標が目的にすり替われば、真偽判定の大量生産が数学の知識継承——メンター制度や議論を通じた伝達——を損ないかねない、と25名は警告する。

AI企業の研究発表を追う開発者・投資家にとっての効き目は具体的だ。ベンチマークやプレスリリースで「未解決問題を解いた」と謳われる成果は、それ自体では検証済みの数学的知識ではない——数学コミュニティの査読・統合を経るまでは「未確定の主張」として扱うべきだ、という評価基準を当事者の専門家集団が公式に突きつけたことになる。これは、フロンティアAIモデルが自律的に研究上のブレークスルーを達成したと語られがちな一連の発表の受け止め方全般に対する、内側からの異議申し立てでもある。本当に問われているのは、AI企業の発表サイクルが人間の検証・継承プロセスを置き去りにしたまま「解いた」を積み上げ続けるとき、その言葉はいつまで数学的知識と呼べるのか、という点だ。

何が起きたか

フィールズ賞受賞者25名が連名で、AI企業による数学ベンチマークの扱いを批判する宣言に署名し、mathandai.org上で公開した。宣言の発案者・筆頭署名者はテレンス・タオで、自身のブログ(terrytao.wordpress.com、2026年9月11日付)でも宣言文の該当箇所を転載し、mathandai.orgへのリンクを明示している。署名者にはテレンス・タオのほか、ピーター・ショルツ、マリーナ・ヴャゾフスカら、数学の各分野を代表するフィールズ賞受賞者が名を連ねる。

宣言の主張

宣言が問題視するのは主に3点だ。

第一に、AI企業が未解決の数学問題への解答を急いで発表する際の手続きの欠落。"often these solutions are announced in a rush, leaving no time for a proper writeup, the isolation of new methods and ideas, and citing relevant previous work"(多くの場合、これらの解答は拙速に発表され、適切な論文執筆や新手法・新概念の切り分け、関連する先行研究の引用に十分な時間が割かれていない)と述べる。

第二に、数学者による統合作業の不可欠性。"without the willing mathematicians who must take care of their development and integration into the mathematical canon, AI-conceived ideas would never become fully alive and the crucial human transmission chain between mathematicians would be lost"(その発展と数学の正典への統合を担う意志ある数学者がいなければ、AIが着想したアイデアは完全に息づくことはなく、数学者間の重要な人的伝達の連鎖が失われてしまう)と警告する。

第三に、ベンチマーク至上主義への懸念。"solving problems is only a tool and proxy for achieving the primary goal of conceptual understanding and insight. Forgetting this in the world of AI may turn the tool against the primary goal."(問題を解くことは、概念理解と洞察という本来の目標を達成するための道具であり代理指標に過ぎない。AIの世界でこれを忘れれば、道具が本来の目標に反する方向に働きかねない)と述べる。

宣言はさらに、"the mass production at faster and faster pace of 'true/false' statements could destroy fertile ground instead of breathing life into new ideas"(「真/偽」の判定をますます速いペースで大量生産することは、新しいアイデアに息を吹き込むどころか、それが育つ土壌を破壊しかねない)と指摘し、数学者が講演・私的な議論・入念な論文執筆——"These processes invariably take time and are based on human interaction."(これらのプロセスは必然的に時間がかかり、人間同士の交流に基づいている)——を通じてアイデアを伝達してきた仕組みが損なわれる懸念を示している。

数字で見る

  • 署名者数: 25名(いずれもフィールズ賞受賞者。宣言公開時点の当初署名者数)
  • 宣言のモデル: 2018年発の「Leiden宣言」(研究評価指標の濫用を問題視した宣言)を明示的に踏襲し、追加署名を受け付けている
  • 前提認識: "Over the last few months, the mathematical capabilities of LLMs have improved dramatically, to the point that they can solve major outstanding problems in many fields of mathematics."(ここ数ヶ月でLLMの数学的能力は劇的に向上し、多くの数学分野で主要な未解決問題を解けるまでになった)という現状認識から出発している

mathandai.org本体への直接アクセスは確認時点でブロックされており、最新の署名者総数(当初25名から増えている可能性)は未検証。ただし宣言発案者であるタオ自身のブログに該当箇所が転載されており、内容そのものは一次ソースとして確認できている。

背景

宣言は、AI企業による数学ベンチマーク上の成果発表を、AIと科学・創造的専門職、ひいては社会全体との「より広い不整合(misalignment)」の一症状として位置づけている。"We see these as part of broader alignment issues impacting other scientific and creative professions, as well as the whole of society."(我々はこれを、他の科学・創造的専門職、そして社会全体に影響を及ぼす、より広い不整合問題の一部だと見ている)と述べる。フィールズ賞受賞者という、数学分野で最も権威ある評価を受けた集団自身が、AIの能力向上そのものを否定するのではなく、その発表・評価のされ方に異を唱えている点が、この宣言の性格を特徴づけている。

なぜ重要か

AI企業の研究発表を評価する実務者にとって、この宣言が突きつけるのは単純な物差しだ——「解決した」という見出しの裏に、査読・引用・数学界への統合という手続きがあるかどうかを確認する必要がある、という基準である。それが揃わない発表は、概念理解という本来の目標の代理指標にすぎないベンチマーク成果を、目標そのものであるかのように扱っている可能性がある。

この宣言は、AIが自律的に研究上のブレークスルーを達成したとされる一連の発表に対し、その受け手であるはずの専門家コミュニティ自身から異議が出た点で異例だ。AI企業の発表サイクルは、人間による検証・継承のプロセスよりも速く回り続ける。本当に問われているのは、その速度差が埋まらないまま「解いた」という宣言だけが積み重なっていくとき、それはいつまで数学的知識と呼べるのか——という一点だ。