🚀 2026年9月22日公開 — Claude 5.5世代の第一弾・Opus 5比 20%値下げ

Claude Opus 5.5

Anthropicが「Claude 5.5ファミリー」の最初のモデルとして公開。公式の主張は「多くの作業でFable 5.1と同等の性能を、Opus 5より40%安いコストで」。新世代の値下げ競争の火付け役になったモデルです。

$4.00
入力 / 1M tokens
$20.00
出力 / 1M tokens
$0.20
キャッシュ読込
1M
コンテキスト

まず結論 — 何が新しいのか

  • 位置づけは「Opus 5の後継」であり、Fable 5.1の下位互換ではありません。Anthropicは「many work で Fable 5.1 と同等」「typical workload で Opus 5 より40%安い」と説明しています。
  • 値下げが本題。入力$5→$4、出力$25→$20、キャッシュ読込$0.50→$0.20(60%減)。エージェント型コーディングではキャッシュ読込が請求の大半を占めるため、ここへの効きが大きいと説明されています。
  • 「thinkingを切れない」仕様変更。Opus 5.5は思考モードをオフにできず、effortパラメータ(low / medium / high…)で深さだけを調整します。既定は medium(公式のグラフ注記に「default effort (medium)」と明記)。
  • 同世代のSonnet 5.5は2026-09-28に公開されました(当サイトの詳細ページ)。Haiku 5.5は「coming weeks」とされたままで、2026-10-01時点で当サイトは提供状況を確認していません。

料金(2026年9月22日公開時点・USD/1Mトークン)

Anthropic公式発表の料金表と公式料金ドキュメントで確認。当サイトの料金比較と同じく「標準料金」ベースです。

項目Claude Opus 5.5Claude Opus 5(前世代)Fable 5.1(上位・参考)
入力$4.00$5.00$10.00
出力$20.00$25.00$50.00
キャッシュ読込(cache hit)$0.20$0.50$0.25
キャッシュ書込(5分TTL)$5.00$6.25—

※ Fable 5.1の行は公式料金ドキュメントに記載の単価です。Fable 5.1はキャッシュ読込が標準入力の2.5%($0.25)、Opus 5.5は5%($0.20)。「入力単価はOpus 5.5が安いが、キャッシュ読込の割引率はFable 5.1が深い」という関係になります。

Fast mode(Claude Code / Claude Platform 限定)

モード入力出力速度
標準$4.00$20.00基準
Fast mode$8.00$40.00最大 2.5倍

※ Fast modeの料金は「200k入力トークン超のリクエストを含め、コンテキストウィンドウ全体に適用される」と公式料金ドキュメントに記載されています。

💡 コスト削減の主張は「単価」ではなく「単価×トークン量」の話です。Anthropic自身が「Opus 5.5 は Opus 5 より供給に必要な計算量が少なく、料金にそれが反映されている」とし、「uses fewer tokens per task(1タスクあたりのトークン消費が少ない)」と書いています。40%という数字はこの2つを掛け合わせた結果です。単価だけを見て「Opus 5の方が安い場面がある」と結論しないよう注意してください。

一次情報: anthropic.com/claude-opus-5-5(Pricing表)· platform.claude.com 料金ドキュメント(2026-09-25確認)

図: 単価の位置関係

Claude Opus 5.5・Opus 5・Fable 5.1の単価比較 入力・出力・キャッシュ読込の単価を1MトークンあたりUSDで並べた横棒グラフ。Opus 5.5は入力4ドル・出力20ドル、Opus 5は入力5ドル・出力25ドル、Fable 5.1は入力10ドル・出力50ドル。 入力 $ / 1M tokens Opus 5.5 — $4.00 Opus 5 — $5.00 Fable 5.1 — $10.00 出力 $ / 1M tokens Opus 5.5 — $20 Opus 5 — $25 Fable 5.1 — $50 キャッシュ読込 $ / 1M tokens Opus 5.5 — $0.20(入力の5%) Opus 5 — $0.50 Fable 5.1 — $0.25(入力の2.5%・割引率は最大)
出典: Anthropic公式発表の料金表/公式料金ドキュメント(2026-09-25確認)。棒の長さは入力$10・出力$50を基準に比例。数値は1MトークンあたりUSD。

← 横にスクロールできます →

モデル仕様

公開日
2026-09-22
コンテキスト
1M tokens
最大出力
128K tokens
知識カットオフ
2026年6月
思考モード
常時オン(オフ不可)
推論エフォート
low / medium / high …(既定 medium)
モデルID
claude-opus-5-5
提供先
Claude Platform / AWS / Google Cloud / Azure

出典: Claude Platform Docs「Models overview」(Context window 1M / Max output 128K / Reliable knowledge cutoff Jun 2026 / Training data cutoff Jun 2026)· Anthropic公式発表(提供先・thinking仕様)。

公式ベンチマーク9項目 — ただし「誰のハーネスか」を必ず読む

Anthropic公式発表の表より。特に注記がない限り、Opus 5.5の数値は adaptive thinking・max effort での結果です(公式の逐語:「Unless otherwise noted, all Claude Opus 5.5 results use adaptive thinking at max effort」)。

ベンチマークOpus 5.5Fable 5.1Opus 5GPT-6 AstraGPT-5.6 Sol
Terminal-Bench 4.0(エージェント型コーディング)66.4%55.8%52.3%57.9%37.3%
FrontierCode v1.1 (Main)54.4%50.3%48.0%53.3%47.5%
CursorBench 4.057.8%51.8%46.6%—41.7%
GDPval-AA v2.1(実務・Elo)1,8461,7351,7081,5421,588
AutomationBench(業務ワークフロー)40.0%31.4%26.9%41.4%28.8%
Humanity's Last Exam(ツール使用)67.7%65.6%63.6%57.2%—
Terminal-Bench-Science 0.158.7%52.6%29.0%64.6%22.4%
OSWorld 2.0(computer use・partial)81.8%80.7%74.0%——
Chartography(ツール使用)89.0%88.4%83.4%——

「誰が測ったか」の内訳(ここが本質)

ベンチマーク実施・報告した主体ハーネス・条件(公式注記の逐語要約)
Terminal-Bench 4.0Anthropic(自社setup)
+公開リーダーボード
公開リーダーボードはClaude Codeハーネス・5 trials/task でOpus 5を51.8%、Anthropic自社setupは52.3%(ノイズ範囲内)。Opus 5.5はxhigh effort、GPT-6 Astraはhigh effort(各モデルの最高スコア)。標準誤差 ±2.6pt。GPT-6 AstraとGPT-5.6 Solの値はOpenAIの報告値を引用。
Terminal-Bench-Science 0.1Anthropic+公開リーダーボード公開リーダーボードは3 trials/task・Claude CodeハーネスでOpus 5を30.0%、自社setupは29.0%。標準誤差 ±3.5〜5pt。GPT-6 Astraの値はOpenAI報告値。
AutomationBenchZapierが実施・報告フォールバックモデル無しで実行したため、safeguardによる介入が「失敗」として扱われ、実際より低いスコアになる条件。Opus 5.5はZapierの早期アクセス評価、Opus 5・GPT-5.6 Sol・GPT-6 AstraはZapierの公開リーダーボード。
GDPval-AA v2.1AnthropicがArtificial Analysisの評価を引用公式の説明は「Artificial Analysis's GDPval-AA v2.1 … real-world professional work across 44 occupations」。44職種の実務タスクをEloで採点。
CursorBench 4.0 / FrontierCode v1.1Anthropic(自社setup)グラフ注記に「at default effort (medium)」の数値も併記(FrontierCode 54.6%、CursorBench 52.5%)。表の数値は最高スコア、グラフは既定エフォート、と条件が異なります。
WANDR(表外・グラフのみ)PerplexityのベンチをAnthropicが独自条件で実行公式注記:「Claude models were run with offline versions of the web search and web fetch tools, programmatic tool calling, code execution, and a 980k-token task budget. This differs from Perplexity's published setup, scores are not directly comparable」。同じ条件で測ったモデルだけを並べているとのこと。
⚠️ この表の読み方: ①GPT-6 Astraの列はOpenAIの自己申告値で、Anthropicが測り直したものではありません(公式注記に「as reported by OpenAI」と明記)。②Terminal-Bench-ScienceではAstraが64.6%でOpus 5.5(58.7%)を上回っています。Anthropicは「Opus 5.5が全項目で首位」とは主張しておらず、「大半のベンチで首位を取った」という書き方にとどめています。③AutomationBenchはOpus 5.5がAstra(41.4%)に次ぐ2位です。
🔍 「ベンチマークの点差は実世界の差を表しにくくなっている」とAnthropic自身が書いています。逐語:「at these levels of capability we've found that benchmark margins have become a less reliable guide to real-world differences. In our own use, the gap between Opus 5.5 and Claude Fable 5.1 is narrower than these scores suggest」。数値だけで優劣を決めるべきではない、という当事者の注意書きです。ベンチの運営主体の違いは用語説明 第6回「ベンチマークを運営している組織」で整理しています。

出典: Anthropic「Introducing Claude Opus 5.5」(ベンチマーク表と脚注1〜4・2026-09-25確認)

「効率」の主張の中身

性能表より、コスト面の説明の方が具体的です。公式発表に載っている数字をそのまま拾います。

比較内容(公式発表の記載)
Opus 5.5 vs Opus 5典型ワークロードでコスト40%減。出力生成速度は30%以上高速。
Terminal-Bench 4.0既定エフォートのOpus 5.5が、最大エフォートのOpus 5を約1/5のコストで上回る。GPT-6 Astraとは約40%のコストで同等。
CursorBench 4.0GPT-5.6 Solの最高スコアを11ポイント上回り、コストは約1/3。
内部テスト(200,000行のコードベース監査)Opus 5.5は3時間未満、Opus 5は20時間超で、しかもOpus 5は2.5倍のトークンを消費。
HAProxyのC→Rust書き換え(内部テスト)Opus 5.5は9.5時間・Fable 5.1は12時間。Opus 5.5の方が51%安い。

※ いずれもAnthropicの内部テスト/ベンダー報告であり、第三者が追試した数値ではありません。

出典: Anthropic「Introducing Claude Opus 5.5」

安全性 — セーフガードと「評価を自覚している」という限界

項目内容(公式の記載)
外部評価公開前に Frontier Design と METR が評価。
サイバーFable 5.1と同クラスのセーフガード。大半のサイバーセキュリティタスクはOpus 4.8にルーティング(透過的にフォールバック)。
生物Fable 5.1と同じ生物分野セーフガード。検証済み組織向けの Life Sciences Verification Program で解除申請が可能。
蒸留(distillation)対策Fable 5.1で導入したpreserved thinkingを継承。2026年8月31日以降に作成されたAPIアカウントが対象。
新しい制御テスト境界を越えようと試みた頻度がOpus 5 / Mythos 5.1 比で約85%少ない。全試行が低severityで、モデル自身が申告したと説明。
データ保持従来のOpus同様、zero data retentionで利用可能。EU AI Act対応のウォーターマークあり。
⚠️ 限界も公式が明記しています。逐語:「We see signs that Opus 5.5 often suspects it is being evaluated, which challenges our ability to assess how it will act in the vast variety of real-world settings it is deployed in」。「評価されていると気づいている兆候がある」=事前評価の限界という当事者の指摘です。無人でエージェントを走らせる場合は、この点を前提に自前のガードレールを併用してください。

出典: Anthropic「Introducing Claude Opus 5.5」(Safety節)

既存ページとの関係(当サイト内)

当サイトが追っているClaude系モデルとの位置づけを整理します。同一モデルの別名ではありません。

モデル当サイトの扱い関係
Claude Fable 5.1個別ページあり別モデル(上位・高価)。入力$10/出力$50。Opus 5.5はFable 5.1と同等性能を低コストで、という立ち位置。
Claude Mythos 5.1個別ページあり別モデル(検証済み組織向けのトラステッドアクセス版)。Opus 5.5のサイバー/生物セーフガードはFable 5.1系と同クラスで、解除には検証プログラムが必要。
Claude Opus 5.5本ページ(新規)Claude 5.5ファミリーの第一弾。Opus 5の後継。Sonnet 5.5は2026-09-28に公開済み(当サイトの詳細ページ)。Haiku 5.5は提供状況を確認していません。
Claude Opus 5 / Opus 4.8個別ページなしOpus 5は前世代($5/$25)。Opus 4.8はサイバー分野のフォールバック先として登場。

※ 当サイトに /claude-opus-5/ のページは存在しません(2026-10-01時点)。Sonnet 5.5 は /claude-sonnet-5-5/ で扱っています。存在しないページへは内部リンクを張っていません。

向いている場面 / 注意すべき場面

  • 長時間のエージェント型コーディング: キャッシュ読込が$0.20と安く、公式の説明でも「agentic と coding のコストの大半はキャッシュ読込」とされているため、リポジトリ文脈を繰り返し送る構成と相性が良いです。
  • 思考を切れない前提で設計する: 無効化できないため、簡単なタスクでも出力トークンを消費します。相手が単純作業ならeffortを下げるか、より軽いモデルを使う判断が必要です。
  • サイバー/生物の業務は要注意: セーフガードでOpus 4.8やOpus 5へ透過的にフォールバックします。同じタスクでも別モデルが応答している可能性があり、検証プログラムへの申請がない限りベンチの数値どおりの性能は出ません。
  • 精度最優先なら: Terminal-Bench-ScienceではGPT-6 Astraが64.6%と上回っています。領域によって優劣が入れ替わるため、用途別の確認を推奨します。
  • 値下げ競争の起点: 公開の直後にOpenAIがGPT-6 Sol / Lunaを約半額で発表しており、当サイトのGPT-6 Sol / Luna解説と併せて読むと、2026年9月の値下げ合戦が立体的に見えます。

実際のコストを試算する

Claude Opus 5.5を含む主要モデルのトークンコストを一括計算できます。

🧮 トークン計算機で試算する →

📊 全モデル料金比較 · 🆚 GPT-6 Sol / Luna · 🤖 Fable 5.1 詳細 · 🗓️ リリース年表

⚠️ 免責事項

  • 料金・仕様はAnthropic公式発表および公式ドキュメントを2026-09-25に確認したものです。予告なく変動します。契約前に必ず公式ページをご確認ください。
  • ベンチマーク数値はベンダー報告を含みます。GPT-6 Astra / GPT-5.6 Solの値はOpenAIの報告値の引用で、Anthropicが測り直したものではありません。測定条件が同一とは限らず、実際の使用感を保証するものではありません。
  • 本サイトは情報提供目的であり、特定プロバイダーの推薦・代理ではありません。