DeepSeek R1 公開 — 「DeepSeekショック」の起点
推論特化のオープンウェイトモデルをMITライセンスで公開。OpenAI o1相当の推論性能を低コストで実現し「DeepSeekショック」を引き起こした。
OpenAI(GPT-5系)・Anthropic(Claude 4/5系)・Google(Gemini 3系)・DeepSeek(R1・V4系)・xAI(Grok)の主要モデルリリースを各社公式発表で裏取り。現行モデル料金は料金比較ページ、コスト試算はトークン計算機を参照。
推論特化のオープンウェイトモデルをMITライセンスで公開。OpenAI o1相当の推論性能を低コストで実現し「DeepSeekショック」を引き起こした。
高速応答モデルと推論モデルをリアルタイムルーターで自動選択するOpenAI初の統合型システム。現行はGPT-5.6系。
1Mトークンコンテキストウィンドウと強化されたマルチモーダル理解力。LMArenaで1501 Eloを記録。
Anthropicフラッグシップに1Mトークンコンテキストウィンドウ導入。長文検索精度が大幅改善。
コーディング・コンピュータ操作・長文推論・エージェントプランニングを全面強化したバランス型。$3.00/$15.00
Computer Use機能ネイティブ搭載(OSWorld 75%)。5段階推論エフォート制御。$2.50/$15.00
コーディング(SWE-bench Pro 64.3%)・視覚認識強化。新トークナイザー採用開始。
1Mトークンコンテキスト・MITライセンス。V4 Pro(1.6T/49B active)・V4 Flash(284B/13B active)。V4 Pro $0.435/$0.87(当時プロモ・現在は廃止)
エージェント・コーディング向け最適化。3.1 Pro上回るベンチマークを4倍速。$1.50/$9.00
Opus上位の新ティア。Fable 5一般提供、Mythos 5限定提供。6/12一時停止→7/1復旧。Fable 5 $10.00/$50.00
「最もエージェント的」なSonnet。Opus 4.8に近い性能を低価格で。導入価格$2/$10は2026-08-10に恒久化(9/1の$3/$15値上げは実施されず)。$2.00/$10.00(恒久化)
新フラッグシップSol・バランス型Terra・最速低コストLunaの3モデル同時公開。7/30にTerra/Luna値下げ。Sol $5/$30・Terra $2/$12・Luna $0.20/$1.20(7/30改定後)
APIはdeepseek-v4-flash。Responses APIネイティブ対応・Codex対応。AgentベンチマークでV4-Pro-Previewを大きく上回る。V4-Pro API・APP/WEBは変更なし。
APP/Web/APIにGA展開(APIはdeepseek-v4-pro)。Responses API対応、thinking effort 3段階(low/high/max)。8/16 16:00 UTCよりピーク/オフピーク価格制(オフピークはピークの半額)。8/23より土日は終日オフピーク。V4 Pro 出力 オフピーク$1.98 / ピーク$3.96
Cloudflare AI Gateway(Unified Billing限定・Bring Your Own Keys対象外)で openai/gpt-5.6-sol を指定すると自動で50%オフ。入力$2.50/出力$15/キャッシュ読込$0.25(〜2026-09-18)。
マルチモーダル視覚理解の実験的モデル。APIはmodel='deepseek-v4-flash-vision-exp'。純テキスト能力はV4 Flashと同等、視覚理解を要するエージェントベンチマークで大幅向上。
コーディング・知識労働・長期間エージェントで新境地。同一モデル・セーフガード違いの2種(Fable 5.1一般提供 / Mythos 5.1トラステッドアクセス限定)。キャッシュ読込を75%減($1.00→$0.25)。1Mコンテキスト・128K出力。Terminal-Bench-Science 52.6%(Fable 5の24.7%から倍増)。$10/$50・キャッシュ読込$0.25
新アーキテクチャ世代の最小モデル。1Mコンテキスト・384K出力・ネイティブ画像入力・thinking既定。API名はdeepseek-flash。V4 Flash / V4 Flash Vision Exp は退役し V4.1 Flash へ統合。当初は V4 Pro を 2026-09-14 から V4.1 Flash へルーティングすると告知されたが、のちに撤回され V4 Pro の提供は継続(V4.1 Pro のリリース時期は未発表)。$0.15/$0.60(オフピーク・cache miss入力/出力)
公式の料金ページ注記(2) と Change Log が「ユーザーの要望を受け、2026-09-14 以降も DeepSeek V4 Pro の API サービス提供を継続する。課金方法は変更しない」という文面に差し替えられ、V4 Pro の価格行(オフピーク 入力 $0.66 / 出力 $1.98)も維持された。deepseek-v4-pro は V4 Pro 専用の単価のまま使い続けられる。$0.66/$1.98(オフピーク・cache miss入力/出力)
Grok 4.6後継。500Kコンテキスト・知識カットオフ2026年5月。公式ベンチ7項目すべてで4.6を上回り、EEBenchとHarvey Legal Agent Benchmarkは比較4モデル中トップ。第三者計測では総合知能指数46でFable 5.1/GPT-6(53)に及ばず。$2/$6(Fast 2倍・200K超 $4/$12)
Anthropicが「Claude 5.5ファミリー」最初のモデルとして公開。公式の主張は「many work で Fable 5.1 と同等の性能を、typical workload で Opus 5 より40%安いコストで」。入力$5→$4・出力$25→$20・キャッシュ読込$0.50→$0.20(60%減)、Fast modeは$8/$40。1Mコンテキスト・128K出力・知識カットオフ2026年6月。thinkingは無効化できず、effortで深さを調整(既定medium)。Sonnet 5.5 は 9/28 に公開済み(下の項目)。Haiku 5.5 は「coming weeks」のままで未確認。$4/$20(キャッシュ読込$0.20・書込$5)
Pro / Flash / Pro-UltraSpeed の3種。公式モデルページで入力=テキスト・画像・動画・音声、出力=テキスト、1Mコンテキストを確認。料金は Flash $0.14/$0.28、Pro $0.435/$0.87、Pro-UltraSpeed $4.35/$8.7(cache hit は $0.0028 / $0.0036 / $0.036)。公式は「Artificial Analysis Intelligence Index v4.3で46.32、現時点で最強のオープンソースモデル」と主張。technical report・学習環境・RLコードを公開し、RLの本番学習はライブ配信。$0.14 / $0.435 / $4.35(入力・1Mトークン)
GPT-6世代の実用2モデル。Solは入力$4→$2・出力$20→$10、Lunaは$0.20/$1.20→$0.10/$0.50。キャッシュ入力は90%割引(Sol $0.20・Luna $0.01)。1,050,000コンテキスト・128K出力・知識カットオフはSol 2026年4月/Sol以外はLuna 2026年5月。GPT-5.6 Sol / Luna は旧版に。ChatGPT Work / Codexで提供、Free / GoはデスクトップアプリでLuna利用可。エフォート変更でキャッシュを壊さない改善・診断ツールも同時発表。$2/$10(Sol)・$0.10/$0.50(Luna)
Apsara Conference 2026(9/22・杭州)の Alibaba 公式プレスリリースで、次世代モデル Qwen 4 が現在学習中(currently in training)とだけ発表されました。リリース日・パラメータ数・ライセンス・料金・API ID はいずれも未公表です。同じ発表では、後続の Qwen 4.5 / Qwen 5 を 5〜10兆パラメータ規模へというロードマップも示されています(これは Qwen 4 の仕様ではありません)。あわせて Qwen3.8-LiveTranslate・Qwen-Audio-3.1 系・スマホ向けエージェント基盤 Qwen Intelligence を発表し、Qwen-Image 3.1 は 2026年内の提供予定としています。
当サイトの扱い: 予告・学習中の段階なので個別ページは作らず本ページに記録します。提供開始後に価格と仕様を一次情報で確認して掲載します。価格未公表
AnthropicのClaude 5.5ファミリー2番目のモデル。公式の説明は「The best combination of speed and intelligence」。入力$2・出力$10・キャッシュ読込$0.20・5分キャッシュ書込$2.50・1時間$4で、前世代Sonnet 5と同額(値下げではありません)。1Mコンテキスト・128K出力・知識カットオフ2026年6月。thinkingはAdaptiveで既定ON、既定エフォートhigh、between_toolsで事前思考をオフにできます。公式ページにベンチマーク表は未掲載。提供はClaude API・Amazon Bedrock・Vertex AI・Microsoft Foundry・Claude Platform on AWSの5つ。$2/$10(キャッシュ読込$0.20・書込$2.50)
新フロンティアモデル。
提供段階: ①Fairwind Program(公式ブログの表現は trusted cyber defenders=信頼できるサイバー防御のテスター。一般公募ではなく、セキュリティ専門家など招待されたテスター向けの限定プログラム)で段階提供中 → ②開発者・企業・消費者へ「as soon as possible(できるだけ早く)」で、その順序は paid API customers と Google AI Ultra 購読者からと公式ブログに明記。米国政府の事前アクセス自主プロセスにも参加しています。
現時点でできること: 入手経路は Fairwind Program(招待制)のみで、一般の API・コンシューマ経路は未提供です(この価格ではまだ購入できません)。コンテキストは 100万トークン(ブログ要旨)。
価格: 正式提供時の導入価格(introductory price)として 入力 $2 / 出力 $10 / キャッシュ入力は入力価格から95%off が予告されています(公式ブログに課金開始の記載はありません)。
ベンチマーク: 公式ブログに表は未掲載のため、当サイトでは集約サイトのスコアを数値として掲載しません(言及する場合は「〜との報道」に留めます)。導入価格 予告 $2/$10(キャッシュ入力95%off)