主要LLMモデル リリース年表 【2025年1月〜2026年9月】

OpenAI(GPT-5系)・Anthropic(Claude 4/5系)・Google(Gemini 3系)・DeepSeek(R1・V4系)・xAI(Grok)の主要モデルリリースを各社公式発表で裏取り。現行モデル料金は料金比較ページ、コスト試算はトークン計算機を参照。

●最終更新: | 各項目に一次情報リンク掲載
OpenAIAnthropicGoogleDeepSeekZhipu/Z.aixAI
2025年
2025-01-20 DeepSeek

DeepSeek R1 公開 — 「DeepSeekショック」の起点

推論特化のオープンウェイトモデルをMITライセンスで公開。OpenAI o1相当の推論性能を低コストで実現し「DeepSeekショック」を引き起こした。

2025-08-07 OpenAI

GPT-5 公開 — 高速応答と推論を統合したルーター方式

高速応答モデルと推論モデルをリアルタイムルーターで自動選択するOpenAI初の統合型システム。現行はGPT-5.6系。

2025-11-18 Google

Gemini 3 Pro 公開 — 1Mトークン・マルチモーダル理解でLMArena首位

1Mトークンコンテキストウィンドウと強化されたマルチモーダル理解力。LMArenaで1501 Eloを記録。

2026年
2026-02-05 Anthropic

Claude Opus 4.6 公開 — フラッグシップに1Mトークンコンテキスト

Anthropicフラッグシップに1Mトークンコンテキストウィンドウ導入。長文検索精度が大幅改善。

2026-02-17 Anthropic

Claude Sonnet 4.6 公開

コーディング・コンピュータ操作・長文推論・エージェントプランニングを全面強化したバランス型。$3.00/$15.00

2026-02-19 Google

Gemini 3.1 Pro Preview 公開

抽象推論を大幅強化。ARC-AGI-2で77.1%記録。$2.00/$12.00(≤200K)

2026-03-05 OpenAI

GPT-5.4 公開 — ネイティブComputer Use API初搭載

Computer Use機能ネイティブ搭載(OSWorld 75%)。5段階推論エフォート制御。$2.50/$15.00

2026-04-16 Anthropic

Claude Opus 4.7 公開 — xhigh推論エフォート新設

コーディング(SWE-bench Pro 64.3%)・視覚認識強化。新トークナイザー採用開始。

2026-04-23 OpenAI

GPT-5.5 公開

エージェント的コンピュータ操作・科学研究支援を強化した当時のフラッグシップ。$5.00/$30.00

2026-04-24 DeepSeek

DeepSeek V4 Pro/Flash Preview 公開

1Mトークンコンテキスト・MITライセンス。V4 Pro(1.6T/49B active)・V4 Flash(284B/13B active)。V4 Pro $0.435/$0.87(当時プロモ・現在は廃止)

2026-05-19 Google

Gemini 3.5 Flash GA — Google I/O 2026

エージェント・コーディング向け最適化。3.1 Pro上回るベンチマークを4倍速。$1.50/$9.00

2026-05-28 Anthropic

Claude Opus 4.8 公開

コード欠陥見逃しを約1/4に低減。Dynamic Workflows研究プレビュー。$5.00/$25.00

2026-06-09 Anthropic

Claude Fable 5/Mythos 5 公開 — 新ティア「Mythosクラス」

Opus上位の新ティア。Fable 5一般提供、Mythos 5限定提供。6/12一時停止→7/1復旧。Fable 5 $10.00/$50.00

2026-06-30 Anthropic

Claude Sonnet 5 公開

「最もエージェント的」なSonnet。Opus 4.8に近い性能を低価格で。導入価格$2/$10は2026-08-10に恒久化(9/1の$3/$15値上げは実施されず)。$2.00/$10.00(恒久化)

2026-07-09 OpenAI

GPT-5.6ファミリー公開 — Sol/Terra/Luna

新フラッグシップSol・バランス型Terra・最速低コストLunaの3モデル同時公開。7/30にTerra/Luna値下げ。Sol $5/$30・Terra $2/$12・Luna $0.20/$1.20(7/30改定後)

2026-07-21 Google

Gemini 3.6 Flash・3.5 Flash-Lite・3.5 Flash Cyber 公開 New

3.6 Flashは3.5 Flashより出力安価($7.50 vs $9.00)。3.5 Flash-LiteはGemini 3.x最安($0.30/$2.50)で高スループットエージェント向け。3.5 Flash Cyberはサイバーセキュリティ特化。3.6 Flash $1.50/$7.50・Flash-Lite $0.30/$2.50

2026-07-24 Anthropic

Claude Opus 5 公開 — Opus 4.8後継・同価格で性能向上 New

Opus 4.8の後継プレミアムモデル。Opus 4.8と同価格($5/$25)ながらコーディング・専門業務で改善。Fast mode($10/$50)対応。安全分類器の介入がFable 5比約85%減。$5.00/$25.00

2026-07-30 OpenAI

GPT-5.6 Terra/Luna 大幅値下げ Updated

Terra: $2.50→$2.00 / $15.00→$12.00。Luna: $1.00→$0.20 / $6.00→$1.20(80%削減)。Priority processing→Fast modeに名称変更も同日実施。Terra $2/$12・Luna $0.20/$1.20

2026-07-31 DeepSeek

DeepSeek V4 Flash 公式リリース(public beta) New

APIはdeepseek-v4-flash。Responses APIネイティブ対応・Codex対応。AgentベンチマークでV4-Pro-Previewを大きく上回る。V4-Pro API・APP/WEBは変更なし。

2026-08-12 xAI

Grok 4.6 公開 — コード・エージェント特化の最新フラッグシップ

Grok 4.5後継。AA Intelligence Index 61でGPT-5.6 Solと並ぶ。500Kコンテキスト・知識カットオフ2026/2/1。$2/$6(fast 2倍)

2026-08-13 DeepSeek

DeepSeek V4 Pro 正式版(GA)リリース — ピーク/オフピーク価格制へ移行 New

APP/Web/APIにGA展開(APIはdeepseek-v4-pro)。Responses API対応、thinking effort 3段階(low/high/max)。8/16 16:00 UTCよりピーク/オフピーク価格制(オフピークはピークの半額)。8/23より土日は終日オフピーク。V4 Pro 出力 オフピーク$1.98 / ピーク$3.96

2026-08-14 Google

Gemini 3.7 Flash 公開 — コーディング・エージェント最強Flash

3.6 Flashから3週間で公開。初回価格は半額($0.75/$3.75 〜12/31 → $1.50/$7.50)。FrontierCode 43.6%・DeepSWE 65.3%。$0.75/$3.75(〜12/31)

2026-08-19 OpenAI / Cloudflare

Cloudflare AI GatewayでGPT-5.6 Solが50%オフ New

Cloudflare AI Gateway(Unified Billing限定・Bring Your Own Keys対象外)で openai/gpt-5.6-sol を指定すると自動で50%オフ。入力$2.50/出力$15/キャッシュ読込$0.25(〜2026-09-18)。

2026-08-21 DeepSeek

DeepSeek V4 Flash Vision Exp 公開(実験的モデル) New

マルチモーダル視覚理解の実験的モデル。APIはmodel='deepseek-v4-flash-vision-exp'。純テキスト能力はV4 Flashと同等、視覚理解を要するエージェントベンチマークで大幅向上。

2026-08-21 OpenAI

GPT-5.6 Sol プロモ価格へ — $4/$20(少なくとも〜11/21) New

フラッグシップSolを$5→$4(入力)/ $30→$20(出力)に値下げ(3ヶ月間)。Fast mode・long-context・Batch/Flexにも適用。旧標準$5/$30。プロモは「少なくとも2026-11-21まで」。$4/$20(Short context)

2026-08-26 Zhipu / Z.ai

GLM 5.3 Flash 公開 — ネイティブマルチモーダル×Flash価格 New

GLM-5シリーズ初のネイティブマルチモーダル。320B/18B MoE・1Mコンテキスト・128K出力・MIT。GLM-5.2を上回るコーディング/エージェント性能を約1/10の価格で。$0.15/$0.50(list・プロモ終了後)

2026-08-26 Alibaba / Qwen

Qwen3.8-Flash 公開 — Qwen4アーキテクチャのプレビュー・低コストマルチモーダル New

125B(6B active)+51B N-gramのマルチモーダルMoE。GDN+QSAハイブリッドで、Qwen3.7-Plusの約1/9のトレーニングコストでコーディング・Office・エージェント性能を上回る。オープンウェイト版(Flash-Next)もHF/ModelScopeで公開。$0.15/$0.47(国際版)

2026-09-01 Anthropic

Claude Fable 5.1 / Mythos 5.1 公開 — Mythosクラス新フラッグシップ New

コーディング・知識労働・長期間エージェントで新境地。同一モデル・セーフガード違いの2種(Fable 5.1一般提供 / Mythos 5.1トラステッドアクセス限定)。キャッシュ読込を75%減($1.00→$0.25)。1Mコンテキスト・128K出力。Terminal-Bench-Science 52.6%(Fable 5の24.7%から倍増)。$10/$50・キャッシュ読込$0.25

2026-09-02 Google

Gemini 3.8 Flash / 3.8 Flash Cyber 公開 — 推論・コーディング最強Flash New

3.7 Flashから3週間、6週間で3回目のFlashリリース。初回$0.75/$3.75(〜12/31 → $1.50/$7.50)。DeepSWE 73.8%・HLE-Verified 54.9%。サイバー特化の3.8 Flash CyberはFairwind Program限定。$0.75/$3.75(〜12/31)

2026-09-03 OpenAI

GPT-6 Astra 公開 — 新世代フラッグシップ($10/$50) New

GPT-5.6 Sol後継。「世界で最も知能が高く、アライメントされたモデル」。ARC-AGI-3 99.9%・ExploitBench 100%・Terminal-Bench Science 64.6%。1.05Mコンテキスト・128K出力。段階的ロールアウト(Daybreak→API/Plus)。$10/$50

2026-09-10 DeepSeek

DeepSeek-V4.1-Flash リリース — 大幅値下げ・ネイティブ画像入力(V4 Pro の 9/14 ルーティングはのちに撤回) New

新アーキテクチャ世代の最小モデル。1Mコンテキスト・384K出力・ネイティブ画像入力・thinking既定。API名はdeepseek-flash。V4 Flash / V4 Flash Vision Exp は退役し V4.1 Flash へ統合。当初は V4 Pro を 2026-09-14 から V4.1 Flash へルーティングすると告知されたが、のちに撤回され V4 Pro の提供は継続(V4.1 Pro のリリース時期は未発表)。$0.15/$0.60(オフピーク・cache miss入力/出力)

2026-09-13 DeepSeek(当サイト確認)

DeepSeek V4 Pro の提供継続を確認 — 9/14 の V4.1 Flash ルーティング予告は撤回

公式の料金ページ注記(2) と Change Log が「ユーザーの要望を受け、2026-09-14 以降も DeepSeek V4 Pro の API サービス提供を継続する。課金方法は変更しない」という文面に差し替えられ、V4 Pro の価格行(オフピーク 入力 $0.66 / 出力 $1.98)も維持された。deepseek-v4-pro は V4 Pro 専用の単価のまま使い続けられる。$0.66/$1.98(オフピーク・cache miss入力/出力)

2026-09-21 xAI

Grok 4.7 公開 — ベースモデルを大型化、価格は$2/$6で据え置き New

Grok 4.6後継。500Kコンテキスト・知識カットオフ2026年5月。公式ベンチ7項目すべてで4.6を上回り、EEBenchとHarvey Legal Agent Benchmarkは比較4モデル中トップ。第三者計測では総合知能指数46でFable 5.1/GPT-6(53)に及ばず。$2/$6(Fast 2倍・200K超 $4/$12)

2026-09-22 Anthropic

Claude Opus 5.5 公開 — Claude 5.5世代の第一弾、Opus 5より安く New

Anthropicが「Claude 5.5ファミリー」最初のモデルとして公開。公式の主張は「many work で Fable 5.1 と同等の性能を、typical workload で Opus 5 より40%安いコストで」。入力$5→$4・出力$25→$20・キャッシュ読込$0.50→$0.20(60%減)、Fast modeは$8/$40。1Mコンテキスト・128K出力・知識カットオフ2026年6月。thinkingは無効化できず、effortで深さを調整(既定medium)。Sonnet 5.5 は 9/28 に公開済み(下の項目)。Haiku 5.5 は「coming weeks」のままで未確認。$4/$20(キャッシュ読込$0.20・書込$5)

2026-09-22 Xiaomi

Xiaomi MiMo-V2.6 公開 — ネイティブ・オムニモーダル・1Mコンテキスト、料金はV2.5から据え置き New

Pro / Flash / Pro-UltraSpeed の3種。公式モデルページで入力=テキスト・画像・動画・音声、出力=テキスト、1Mコンテキストを確認。料金は Flash $0.14/$0.28、Pro $0.435/$0.87、Pro-UltraSpeed $4.35/$8.7(cache hit は $0.0028 / $0.0036 / $0.036)。公式は「Artificial Analysis Intelligence Index v4.3で46.32、現時点で最強のオープンソースモデル」と主張。technical report・学習環境・RLコードを公開し、RLの本番学習はライブ配信。$0.14 / $0.435 / $4.35(入力・1Mトークン)

2026-09-22 OpenAI

GPT-6 Sol / GPT-6 Luna 公開 — GPT-5.6版から50%値下げ New

GPT-6世代の実用2モデル。Solは入力$4→$2・出力$20→$10、Lunaは$0.20/$1.20→$0.10/$0.50。キャッシュ入力は90%割引(Sol $0.20・Luna $0.01)。1,050,000コンテキスト・128K出力・知識カットオフはSol 2026年4月/Sol以外はLuna 2026年5月。GPT-5.6 Sol / Luna は旧版に。ChatGPT Work / Codexで提供、Free / GoはデスクトップアプリでLuna利用可。エフォート変更でキャッシュを壊さない改善・診断ツールも同時発表。$2/$10(Sol)・$0.10/$0.50(Luna)

2026-09-22 Alibaba / Qwen

Qwen 4 は「学習中」と公式発表 — リリース日・料金・重みは未公表 New

Apsara Conference 2026(9/22・杭州)の Alibaba 公式プレスリリースで、次世代モデル Qwen 4 が現在学習中(currently in training)とだけ発表されました。リリース日・パラメータ数・ライセンス・料金・API ID はいずれも未公表です。同じ発表では、後続の Qwen 4.5 / Qwen 5 を 5〜10兆パラメータ規模へというロードマップも示されています(これは Qwen 4 の仕様ではありません)。あわせて Qwen3.8-LiveTranslate・Qwen-Audio-3.1 系・スマホ向けエージェント基盤 Qwen Intelligence を発表し、Qwen-Image 3.1 は 2026年内の提供予定としています。
当サイトの扱い: 予告・学習中の段階なので個別ページは作らず本ページに記録します。提供開始後に価格と仕様を一次情報で確認して掲載します。価格未公表

2026-09-28 Anthropic

Claude Sonnet 5.5 公開 — Claude 5.5世代のバランス型、Sonnet 5と同額で世代更新 New

AnthropicのClaude 5.5ファミリー2番目のモデル。公式の説明は「The best combination of speed and intelligence」。入力$2・出力$10・キャッシュ読込$0.20・5分キャッシュ書込$2.50・1時間$4で、前世代Sonnet 5と同額(値下げではありません)。1Mコンテキスト・128K出力・知識カットオフ2026年6月。thinkingはAdaptiveで既定ON、既定エフォートhigh、between_toolsで事前思考をオフにできます。公式ページにベンチマーク表は未掲載。提供はClaude API・Amazon Bedrock・Vertex AI・Microsoft Foundry・Claude Platform on AWSの5つ。$2/$10(キャッシュ読込$0.20・書込$2.50)

2026-09-30 Google

Gemini 4 Argon 発表 — サイバー防御の「信頼できるテスター」へ先行提供、一般提供は段階的 New

新フロンティアモデル。
提供段階: ①Fairwind Program(公式ブログの表現は trusted cyber defenders=信頼できるサイバー防御のテスター。一般公募ではなく、セキュリティ専門家など招待されたテスター向けの限定プログラム)で段階提供中 → ②開発者・企業・消費者へ「as soon as possible(できるだけ早く)」で、その順序は paid API customers と Google AI Ultra 購読者からと公式ブログに明記。米国政府の事前アクセス自主プロセスにも参加しています。
現時点でできること: 入手経路は Fairwind Program(招待制)のみで、一般の API・コンシューマ経路は未提供です(この価格ではまだ購入できません)。コンテキストは 100万トークン(ブログ要旨)。
価格: 正式提供時の導入価格(introductory price)として 入力 $2 / 出力 $10 / キャッシュ入力は入力価格から95%off が予告されています(公式ブログに課金開始の記載はありません)。
ベンチマーク: 公式ブログに表は未掲載のため、当サイトでは集約サイトのスコアを数値として掲載しません(言及する場合は「〜との報道」に留めます)。導入価格 予告 $2/$10(キャッシュ入力95%off)

この年表について

  • 掲載基準: 各社公式ブログ・リリースノートを一次情報として確認できたモデルのみ掲載。
  • 対象範囲: 主要5社のフラッグシップ級・話題性の高いリリースに限定。
  • 料金: 最新料金は料金比較ページを参照(本年表の価格表示は簡略版)。
  • 更新方針: 新モデルリリースに応じて随時追記。

⚠️ 免責事項

  • リリース日は各社公式発表または複数独立情報源で確認。記載漏れ・誤りの可能性あり。
  • 料金は変動するため契約前に必ず料金比較ページ・公式ページを確認。