Anthropic CEOのDario Amodeiが、2026年9月12日公開のエッセイ「We Must Pace the Frontier」で、常駐する第三者評価者(embedded evaluators)に「入館証・社給PC・執務用の机」という社員に準じた物理アクセスを与え、社内のリスク評価チームとほぼ同等のワークスペース・ツール・権限を認めると単独で約束した。評価者はリスク水準やインシデントに関する重要な知見を、編集上の干渉を受けずに公表することも認められる。AI開発企業が外部の監視者を自社の中枢にまで招き入れると具体的に約束した、検証可能な一手だ。安全性を語る企業が実際に何を差し出したかを見極めたい実務者にとって、これは数少ない「言葉ではなく権限そのものの開示」の事例になる。
ただしこの動きは、「AEF-1という第三者評価基準が新たに登場し、xAI・OpenAI・Anthropicの3社が揃って署名した」という一部の見出しが伝える枠組みとは別物だ。AEF-1(Minimum Operating Conditions for Independent Third Party AI Evaluations)は、METR・Transluce・RAND・HAL Evals・SecureBioなどが参加するコンソーシアム「AI Evaluator Forum」が2025年12月4日に公開済みの標準であり、2026年9月に新規に生まれたものではない。しかもAmodei氏のエッセイ本文には「AEF-1」「AI Evaluator Forum」という語が一度も登場せず、AEF-1の公式ページにもxAI・OpenAI・Anthropicが標準に共同署名したという記述はない。3社がこの標準にcosignしたという事実は、一次資料のどこにも見つからない。
「3社共同署名」の実態は一社の単独コミットメント
エッセイ自身が、今回の措置を「Anthropicの一方的(unilateral)なコミットメントであり、他社にfollow suit(追随)を呼びかけるもの」と明記している。つまり実態は、既存の業界標準に3社が足並みを揃えて署名したという協調行為ではなく、Anthropic一社が自らの評価アクセスを開示し、競合に同じ行動を暗に迫るという片務的な動きに過ぎない。OpenAIのSam AltmanやxAIのElon Muskが賛意を示したとされる発言も、SNS上の投稿本文に直接アクセスできず本人発言として確認できていない。
AEF-1公式ページが実際に記載しているのは、Anthropic・Google・Meta・OpenAIが標準の適用対象(評価される側の組織)として、EU AI Officeが支持機関として列挙されているという事実だけであり、これは「標準への署名」とは全く別の話だ。既存標準の発表時期と、Anthropicの新しい単独コミットメントの発表時期がずれていることに加え、他社首脳の未確認の反応がここに上乗せされたことで、実態より足並みが揃って見える見出しが生まれたとみられる。
なぜ重要か
フロンティアラボの安全性コミットメントを評価する際の教訓は明快だ。「複数社が歩調を合わせた」という見出しほど、拘束力のある共同の仕組みを伴わない一社の単独行動である場合が多い。今回Anthropicが実際に差し出したのは、評価者への物理アクセスと編集干渉なしの公表権という具体的な権限であり、これ自体は検証可能な進展だ。しかし他社を法的・契約的に縛る仕組みは存在せず、エッセイ自身が「一方的」「追随を呼びかける」と述べている以上、現時点でこの発表が生んでいる効果は、業界横断の監視体制の実質的な強化ではなく、公表を通じた同業他社への同調圧力にとどまる。競合が実際に追随するかどうかは、今後の各社の発表を個別に一次資料で確認する必要がある。