まず結論 — 何が新しいのか
- 位置づけは「Opus 5の後継」であり、Fable 5.1の下位互換ではありません。Anthropicは「many work で Fable 5.1 と同等」「typical workload で Opus 5 より40%安い」と説明しています。
- 値下げが本題。入力$5→$4、出力$25→$20、キャッシュ読込$0.50→$0.20(60%減)。エージェント型コーディングではキャッシュ読込が請求の大半を占めるため、ここへの効きが大きいと説明されています。
- 「thinkingを切れない」仕様変更。Opus 5.5は思考モードをオフにできず、
effortパラメータ(low / medium / high…)で深さだけを調整します。既定は medium(公式のグラフ注記に「default effort (medium)」と明記)。 - 同世代のSonnet 5.5は2026-09-28に公開されました(当サイトの詳細ページ)。Haiku 5.5は「coming weeks」とされたままで、2026-10-01時点で当サイトは提供状況を確認していません。
料金(2026年9月22日公開時点・USD/1Mトークン)
Anthropic公式発表の料金表と公式料金ドキュメントで確認。当サイトの料金比較と同じく「標準料金」ベースです。
| 項目 | Claude Opus 5.5 | Claude Opus 5(前世代) | Fable 5.1(上位・参考) |
|---|---|---|---|
| 入力 | $4.00 | $5.00 | $10.00 |
| 出力 | $20.00 | $25.00 | $50.00 |
| キャッシュ読込(cache hit) | $0.20 | $0.50 | $0.25 |
| キャッシュ書込(5分TTL) | $5.00 | $6.25 | — |
※ Fable 5.1の行は公式料金ドキュメントに記載の単価です。Fable 5.1はキャッシュ読込が標準入力の2.5%($0.25)、Opus 5.5は5%($0.20)。「入力単価はOpus 5.5が安いが、キャッシュ読込の割引率はFable 5.1が深い」という関係になります。
Fast mode(Claude Code / Claude Platform 限定)
| モード | 入力 | 出力 | 速度 |
|---|---|---|---|
| 標準 | $4.00 | $20.00 | 基準 |
| Fast mode | $8.00 | $40.00 | 最大 2.5倍 |
※ Fast modeの料金は「200k入力トークン超のリクエストを含め、コンテキストウィンドウ全体に適用される」と公式料金ドキュメントに記載されています。
一次情報: anthropic.com/claude-opus-5-5(Pricing表)· platform.claude.com 料金ドキュメント(2026-09-25確認)
図: 単価の位置関係
← 横にスクロールできます →
モデル仕様
出典: Claude Platform Docs「Models overview」(Context window 1M / Max output 128K / Reliable knowledge cutoff Jun 2026 / Training data cutoff Jun 2026)· Anthropic公式発表(提供先・thinking仕様)。
公式ベンチマーク9項目 — ただし「誰のハーネスか」を必ず読む
Anthropic公式発表の表より。特に注記がない限り、Opus 5.5の数値は adaptive thinking・max effort での結果です(公式の逐語:「Unless otherwise noted, all Claude Opus 5.5 results use adaptive thinking at max effort」)。
| ベンチマーク | Opus 5.5 | Fable 5.1 | Opus 5 | GPT-6 Astra | GPT-5.6 Sol |
|---|---|---|---|---|---|
| Terminal-Bench 4.0(エージェント型コーディング) | 66.4% | 55.8% | 52.3% | 57.9% | 37.3% |
| FrontierCode v1.1 (Main) | 54.4% | 50.3% | 48.0% | 53.3% | 47.5% |
| CursorBench 4.0 | 57.8% | 51.8% | 46.6% | — | 41.7% |
| GDPval-AA v2.1(実務・Elo) | 1,846 | 1,735 | 1,708 | 1,542 | 1,588 |
| AutomationBench(業務ワークフロー) | 40.0% | 31.4% | 26.9% | 41.4% | 28.8% |
| Humanity's Last Exam(ツール使用) | 67.7% | 65.6% | 63.6% | 57.2% | — |
| Terminal-Bench-Science 0.1 | 58.7% | 52.6% | 29.0% | 64.6% | 22.4% |
| OSWorld 2.0(computer use・partial) | 81.8% | 80.7% | 74.0% | — | — |
| Chartography(ツール使用) | 89.0% | 88.4% | 83.4% | — | — |
「誰が測ったか」の内訳(ここが本質)
| ベンチマーク | 実施・報告した主体 | ハーネス・条件(公式注記の逐語要約) |
|---|---|---|
| Terminal-Bench 4.0 | Anthropic(自社setup) +公開リーダーボード | 公開リーダーボードはClaude Codeハーネス・5 trials/task でOpus 5を51.8%、Anthropic自社setupは52.3%(ノイズ範囲内)。Opus 5.5はxhigh effort、GPT-6 Astraはhigh effort(各モデルの最高スコア)。標準誤差 ±2.6pt。GPT-6 AstraとGPT-5.6 Solの値はOpenAIの報告値を引用。 |
| Terminal-Bench-Science 0.1 | Anthropic+公開リーダーボード | 公開リーダーボードは3 trials/task・Claude CodeハーネスでOpus 5を30.0%、自社setupは29.0%。標準誤差 ±3.5〜5pt。GPT-6 Astraの値はOpenAI報告値。 |
| AutomationBench | Zapierが実施・報告 | フォールバックモデル無しで実行したため、safeguardによる介入が「失敗」として扱われ、実際より低いスコアになる条件。Opus 5.5はZapierの早期アクセス評価、Opus 5・GPT-5.6 Sol・GPT-6 AstraはZapierの公開リーダーボード。 |
| GDPval-AA v2.1 | AnthropicがArtificial Analysisの評価を引用 | 公式の説明は「Artificial Analysis's GDPval-AA v2.1 … real-world professional work across 44 occupations」。44職種の実務タスクをEloで採点。 |
| CursorBench 4.0 / FrontierCode v1.1 | Anthropic(自社setup) | グラフ注記に「at default effort (medium)」の数値も併記(FrontierCode 54.6%、CursorBench 52.5%)。表の数値は最高スコア、グラフは既定エフォート、と条件が異なります。 |
| WANDR(表外・グラフのみ) | PerplexityのベンチをAnthropicが独自条件で実行 | 公式注記:「Claude models were run with offline versions of the web search and web fetch tools, programmatic tool calling, code execution, and a 980k-token task budget. This differs from Perplexity's published setup, scores are not directly comparable」。同じ条件で測ったモデルだけを並べているとのこと。 |
出典: Anthropic「Introducing Claude Opus 5.5」(ベンチマーク表と脚注1〜4・2026-09-25確認)
「効率」の主張の中身
性能表より、コスト面の説明の方が具体的です。公式発表に載っている数字をそのまま拾います。
| 比較 | 内容(公式発表の記載) |
|---|---|
| Opus 5.5 vs Opus 5 | 典型ワークロードでコスト40%減。出力生成速度は30%以上高速。 |
| Terminal-Bench 4.0 | 既定エフォートのOpus 5.5が、最大エフォートのOpus 5を約1/5のコストで上回る。GPT-6 Astraとは約40%のコストで同等。 |
| CursorBench 4.0 | GPT-5.6 Solの最高スコアを11ポイント上回り、コストは約1/3。 |
| 内部テスト(200,000行のコードベース監査) | Opus 5.5は3時間未満、Opus 5は20時間超で、しかもOpus 5は2.5倍のトークンを消費。 |
| HAProxyのC→Rust書き換え(内部テスト) | Opus 5.5は9.5時間・Fable 5.1は12時間。Opus 5.5の方が51%安い。 |
※ いずれもAnthropicの内部テスト/ベンダー報告であり、第三者が追試した数値ではありません。
安全性 — セーフガードと「評価を自覚している」という限界
| 項目 | 内容(公式の記載) |
|---|---|
| 外部評価 | 公開前に Frontier Design と METR が評価。 |
| サイバー | Fable 5.1と同クラスのセーフガード。大半のサイバーセキュリティタスクはOpus 4.8にルーティング(透過的にフォールバック)。 |
| 生物 | Fable 5.1と同じ生物分野セーフガード。検証済み組織向けの Life Sciences Verification Program で解除申請が可能。 |
| 蒸留(distillation)対策 | Fable 5.1で導入したpreserved thinkingを継承。2026年8月31日以降に作成されたAPIアカウントが対象。 |
| 新しい制御テスト | 境界を越えようと試みた頻度がOpus 5 / Mythos 5.1 比で約85%少ない。全試行が低severityで、モデル自身が申告したと説明。 |
| データ保持 | 従来のOpus同様、zero data retentionで利用可能。EU AI Act対応のウォーターマークあり。 |
出典: Anthropic「Introducing Claude Opus 5.5」(Safety節)
既存ページとの関係(当サイト内)
当サイトが追っているClaude系モデルとの位置づけを整理します。同一モデルの別名ではありません。
| モデル | 当サイトの扱い | 関係 |
|---|---|---|
| Claude Fable 5.1 | 個別ページあり | 別モデル(上位・高価)。入力$10/出力$50。Opus 5.5はFable 5.1と同等性能を低コストで、という立ち位置。 |
| Claude Mythos 5.1 | 個別ページあり | 別モデル(検証済み組織向けのトラステッドアクセス版)。Opus 5.5のサイバー/生物セーフガードはFable 5.1系と同クラスで、解除には検証プログラムが必要。 |
| Claude Opus 5.5 | 本ページ(新規) | Claude 5.5ファミリーの第一弾。Opus 5の後継。Sonnet 5.5は2026-09-28に公開済み(当サイトの詳細ページ)。Haiku 5.5は提供状況を確認していません。 |
| Claude Opus 5 / Opus 4.8 | 個別ページなし | Opus 5は前世代($5/$25)。Opus 4.8はサイバー分野のフォールバック先として登場。 |
※ 当サイトに /claude-opus-5/ のページは存在しません(2026-10-01時点)。Sonnet 5.5 は /claude-sonnet-5-5/ で扱っています。存在しないページへは内部リンクを張っていません。
向いている場面 / 注意すべき場面
- 長時間のエージェント型コーディング: キャッシュ読込が$0.20と安く、公式の説明でも「agentic と coding のコストの大半はキャッシュ読込」とされているため、リポジトリ文脈を繰り返し送る構成と相性が良いです。
- 思考を切れない前提で設計する: 無効化できないため、簡単なタスクでも出力トークンを消費します。相手が単純作業なら
effortを下げるか、より軽いモデルを使う判断が必要です。 - サイバー/生物の業務は要注意: セーフガードでOpus 4.8やOpus 5へ透過的にフォールバックします。同じタスクでも別モデルが応答している可能性があり、検証プログラムへの申請がない限りベンチの数値どおりの性能は出ません。
- 精度最優先なら: Terminal-Bench-ScienceではGPT-6 Astraが64.6%と上回っています。領域によって優劣が入れ替わるため、用途別の確認を推奨します。
- 値下げ競争の起点: 公開の直後にOpenAIがGPT-6 Sol / Lunaを約半額で発表しており、当サイトのGPT-6 Sol / Luna解説と併せて読むと、2026年9月の値下げ合戦が立体的に見えます。
実際のコストを試算する
Claude Opus 5.5を含む主要モデルのトークンコストを一括計算できます。
🧮 トークン計算機で試算する →📊 全モデル料金比較 · 🆚 GPT-6 Sol / Luna · 🤖 Fable 5.1 詳細 · 🗓️ リリース年表
⚠️ 免責事項
- 料金・仕様はAnthropic公式発表および公式ドキュメントを2026-09-25に確認したものです。予告なく変動します。契約前に必ず公式ページをご確認ください。
- ベンチマーク数値はベンダー報告を含みます。GPT-6 Astra / GPT-5.6 Solの値はOpenAIの報告値の引用で、Anthropicが測り直したものではありません。測定条件が同一とは限らず、実際の使用感を保証するものではありません。
- 本サイトは情報提供目的であり、特定プロバイダーの推薦・代理ではありません。