Anthropicが投げたのは「より賢い最上位モデル」ではなく、「Fable 5.1並みの仕事を、Opus 5より安く回せる」という値札だ。公式はOpus 5.5が「ほとんどの作業でFable 5.1並み」で、Opus 5より実行コストが40%低いとする。エージェントを大量に回す開発者・実務者にとっては、上位モデル級の品質をより低い単価で使える選択肢が増え、モデル選定が「最強を1つ選ぶ」から「仕事ごとに費用対効果で振り分ける」判断へ寄る。競争の軸が性能の一点突破から、タスクあたりのコスト構造へ動いている流れを強める出来事だ。ただし本当の問いは、「40%減」が自分のワークロードでも出るのか——という点にある。この数字は単価の下落(20%)とは別物だからだ。

何が起きたか

  • Anthropicは2026年9月22日にClaude Opus 5.5を公開した(公式発表ページの記載)。
  • 公式は、Opus 5.5が「ほとんどの作業でClaude Fable 5.1の水準で動作する」と述べ、Opus 5より実行コストが40%低いとしている。性能の同等性はベンダー自身の主張で、独立した検証は確認できていない。
  • Amazon Web Services・Google Cloud・Microsoft Azureを含む全プラットフォームで提供され、API IDは claude-opus-5-5。

数字で見る

100万トークンあたりの価格(公式発表ページ):

項目 Opus 5.5 Opus 5
入力 $4 $5
出力 $20 $25
キャッシュ読み出し $0.20 $0.50

入力・出力の単価はどちらも20%の下落、キャッシュ読み出しは60%の下落になる。一方、公式が掲げる「実行コスト40%減」は、この単価の下落率とは一致しない。「40%安い」を単価の話として読むと誤りになる。実行コストはキャッシュの使われ方などワークロードに依存するため、効果は利用パターンごとに変わる。

安全性評価

公式発表は、外部評価者としてFrontier DesignとMETRを挙げ、Opus 5.5は自動行動監査で「これまでテストした中で最も高い成績のモデル」だったとしている。ただし評価の詳細な数値は今回の確認範囲に含まれない。

未検証の点

Anthropicは別のブログ記事で、タスク当たりの費用がターン数・キャッシュ活用度・モデル選択で変わると解説しているとされる。この記事の本文は今回取得できておらず、内容は未検証だ。そのため本稿は、タスク単価についての具体的な数値を扱わない。

なぜ重要か

  • 読み方の注意: 「単価20%減」と「実行コスト40%減」は別の数字で、前者は価格表で確認でき、後者は公式の主張として確認できる。両者を混同せず、自社のターン数・キャッシュ比率で実測するのが確実だ。
  • 公開日のずれ: 公式の公開日は2026年9月22日で、国内のニュースレター等での紹介時期とは約2週間のずれがある。本稿は公式の日付を採用した。
  • 独立検証の不在: 「Fable 5.1並み」は自己申告であり、第三者の比較評価を待つ必要がある。