Anthropicが投げたのは「より賢い最上位モデル」ではなく、「Fable 5.1並みの仕事を、Opus 5より安く回せる」という値札だ。公式はOpus 5.5が「ほとんどの作業でFable 5.1並み」で、Opus 5より実行コストが40%低いとする。エージェントを大量に回す開発者・実務者にとっては、上位モデル級の品質をより低い単価で使える選択肢が増え、モデル選定が「最強を1つ選ぶ」から「仕事ごとに費用対効果で振り分ける」判断へ寄る。競争の軸が性能の一点突破から、タスクあたりのコスト構造へ動いている流れを強める出来事だ。ただし本当の問いは、「40%減」が自分のワークロードでも出るのか——という点にある。この数字は単価の下落(20%)とは別物だからだ。
何が起きたか
- Anthropicは2026年9月22日にClaude Opus 5.5を公開した(公式発表ページの記載)。
- 公式は、Opus 5.5が「ほとんどの作業でClaude Fable 5.1の水準で動作する」と述べ、Opus 5より実行コストが40%低いとしている。性能の同等性はベンダー自身の主張で、独立した検証は確認できていない。
- Amazon Web Services・Google Cloud・Microsoft Azureを含む全プラットフォームで提供され、API IDは
claude-opus-5-5。
数字で見る
100万トークンあたりの価格(公式発表ページ):
| 項目 | Opus 5.5 | Opus 5 |
|---|---|---|
| 入力 | $4 | $5 |
| 出力 | $20 | $25 |
| キャッシュ読み出し | $0.20 | $0.50 |
入力・出力の単価はどちらも20%の下落、キャッシュ読み出しは60%の下落になる。一方、公式が掲げる「実行コスト40%減」は、この単価の下落率とは一致しない。「40%安い」を単価の話として読むと誤りになる。実行コストはキャッシュの使われ方などワークロードに依存するため、効果は利用パターンごとに変わる。
安全性評価
公式発表は、外部評価者としてFrontier DesignとMETRを挙げ、Opus 5.5は自動行動監査で「これまでテストした中で最も高い成績のモデル」だったとしている。ただし評価の詳細な数値は今回の確認範囲に含まれない。
未検証の点
Anthropicは別のブログ記事で、タスク当たりの費用がターン数・キャッシュ活用度・モデル選択で変わると解説しているとされる。この記事の本文は今回取得できておらず、内容は未検証だ。そのため本稿は、タスク単価についての具体的な数値を扱わない。
なぜ重要か
- 読み方の注意: 「単価20%減」と「実行コスト40%減」は別の数字で、前者は価格表で確認でき、後者は公式の主張として確認できる。両者を混同せず、自社のターン数・キャッシュ比率で実測するのが確実だ。
- 公開日のずれ: 公式の公開日は2026年9月22日で、国内のニュースレター等での紹介時期とは約2週間のずれがある。本稿は公式の日付を採用した。
- 独立検証の不在: 「Fable 5.1並み」は自己申告であり、第三者の比較評価を待つ必要がある。