Anthropicが軽量モデル「Claude Haiku 5.5」で打ち出したのは、単価の安さだけでなく、プロンプト長で価格が切り替わる階段価格だ。100万トークンあたり、プロンプトが10万トークン以下なら入力$0.10・出力$0.50、超えると入力$0.50・出力$2.50と5倍になる。大量処理を回す開発者は、短いプロンプトで済む分類・抽出・要約のような仕事なら大幅に安く回せる。一方で、長い文脈を毎回渡す設計は5倍の側に落ちるため、プロンプトを10万トークン以内に収める工夫がそのままコスト設計になる。モデルの選定軸が「単価の安さ」から「価格が跳ねる位置」へ移りつつある——本当の問いは、自分のワークロードがその境界のどちら側にあるか、だ。
何が起きたか
- Anthropicは2026年10月7日にClaude Haiku 5.5を公開した。モデルIDは
claude-haiku-5-5で、Amazon Web Services、Google Cloud、Microsoft Azureで提供される。 - 公式は大量処理・低コスト用途向けの軽量モデルと位置づけている。
数字で見る
100万トークンあたりの価格は次のとおり(Anthropic公式、確認済み)。
| 10万トークン以下 | 10万トークン超 | |
|---|---|---|
| 入力 | $0.10 | $0.50 |
| 出力 | $0.50 | $2.50 |
- 10万トークンを超えると、入力・出力とも5倍になる。
- 解説ブログ(Simon Willison氏)によれば、GPT-6 Lunaも10万トークン以下では同じ$0.10/$0.50で、Lunaは272,000トークンで$0.20/$0.75に上がるだけだという。この比較に基づくと、長いプロンプトではLunaのほうが割安になる。ただしLuna側の価格はOpenAIの一次情報では確認できておらず、比較の結論は同ブログ著者の評価である。
訂正: 「Haiku 4.5より75%安い(10万トークンまで)」は不正確
一部の報道は「10万トークンまでの入力でHaiku 4.5より75%安い」と伝えた。公式ページはこれと異なり、「実行コストが約75%減」と「10万トークン未満のリクエストは価格90%減」を別々に述べている。10万トークンまでが75%安いという書き方は公式の記述と合わない。75%は、実効コストに関する別の数字とみられるが、その算出根拠は確認できていない。
未検証の点
- ベンチマーク: 公式ページにはGPT-6 Lunaとのベンチマーク比較の表があるが、数値は取得できておらず、Lunaを上回るかどうかは未検証。数値が出ても、ベンダー自身による報告である。
- トークナイザの変更: 解説ブログは、従来モデルより約25%多くトークンを消費すると記すが、Anthropic公式では確認できておらず未検証。事実であれば、同じ文章でも課金対象のトークン数が増えるため、単価の比較だけでは実効コストを測れない。
なぜ重要か
軽量モデルの競争は、単価の引き下げに加えて、価格がどの長さで切り替わるかという設計の競争に広がっている。Haiku 5.5は短いプロンプトで極めて安い代わりに、10万トークンを超えると5倍に上がる。解説ブログによれば、競合のLunaは超過時の上がり方が緩やかだという。大量のエージェント呼び出しやバッチ処理を組む開発者は、カタログの単価ではなく、自分のリクエストの典型的な長さを境界に当てはめて、タスクあたりのコストを比べる必要がある。