主要LLM API 料金比較
OpenAI(GPT-5.6 Sol/Terra/Luna・GPT-5.5/5.4系)、Anthropic Claude(Opus 5/4.8・Fable 5・Sonnet 5・Haiku 4.5)、Google Gemini(3.6 Flash・3.5 Flash-Lite・3.1 Flash-Lite・3.1 Pro)、DeepSeek V4.1 Flashの現行モデルをUSD/1Mトークンで比較。各社公式ページで直接確認。
料金比較を見る →✅ 一次情報で確認できた情報を随時更新 · 広告なし
OpenAI・Anthropic・Google Geminiなど各社公式ページに基づいたトークン料金データ。
エンジニアとプロダクトチームのためのコスト判断に使える実用ハブです。
公式一次情報に基づいた、エンジニア向けLLMコストデータ
OpenAI(GPT-5.6 Sol/Terra/Luna・GPT-5.5/5.4系)、Anthropic Claude(Opus 5/4.8・Fable 5・Sonnet 5・Haiku 4.5)、Google Gemini(3.6 Flash・3.5 Flash-Lite・3.1 Flash-Lite・3.1 Pro)、DeepSeek V4.1 Flashの現行モデルをUSD/1Mトークンで比較。各社公式ページで直接確認。
料金比較を見る →入力・出力トークン数を入れるだけで、主要LLM APIのコストをUSD+参考円換算で瞬時に比較。外部通信なし・すべてブラウザ内で計算。
計算機を使う →DeepSeek R1公開(2025年1月)からGPT-5.6・Claude Opus 5・Gemini 3.6 Flashまで、主要モデルのリリースを一次情報で裏取りして時系列に整理。各項目に公式発表へのリンク付き。
年表を見る →「cache hitって何が安いの?」「この数字は何を測っているの?」——料金表やニュースに出てくる用語を、1ページ1テーマでかみくだきます。cache hit・cache miss・キャッシュ書込の単価差、ベンチマーク数値の測定条件、TTLやコンテキスト上限の境界線まで、各社の公式ドキュメントで確認した内容だけを掲載。第1回はGPT-6 Astraのベンチ数値、第2回はプロンプトキャッシュ、第3回はハーネス(harness)、第4回は1Mコンテキスト、第5回はベンチマーク、第6回はベンチ運営組織、第7回はZDR(ゼロデータ保持)、第8回はデータを守る4要件(残さない・見せない・学ばせない・出さない)。第9回はZOA(ゼロオペレーターアクセス)。第10回は学習に使わせない(no-training)。第11回はデータレジデンシー(出さない=保存と処理を分けて確認)。
用語説明を読む →2026-09-22公開。Solは$2/$10、Lunaは$0.10/$0.50でGPT-5.6版から50%値下げ。1,050,000コンテキスト・128K出力・キャッシュ入力90%割引。公式ベンチ6項目を運営元つきで整理。GPT-5.6 Sol / Lunaは旧版です。
Sol / Luna詳細を見る →2026-09-22公開。入力$4・出力$20・キャッシュ読込$0.20(Opus 5の$5/$25から値下げ)。1Mコンテキスト・128K出力。公式ベンチ9項目と「誰のハーネスでの測定か」、40%安の根拠、thinking無効化不可の仕様変更まで一次情報で解説。
Opus 5.5詳細を見る →2026-09-28公開。入力$2・出力$10・キャッシュ読込$0.20で前世代Sonnet 5と同額(値下げではなく世代更新)。1Mコンテキスト・128K出力、thinkingはAdaptiveで既定ON・既定エフォートhigh、between_toolsで事前思考をオフにできます。公式ベンチマークは未掲載のため当サイトでも数値は載せず、仕様と提供5プラットフォームのモデルIDを一次情報で整理しました。
コーディング・知識労働・長期間エージェントで新境地。$10/$50・キャッシュ読込$0.25で実質最大約45%減。1Mコンテキスト・128K出力。Terminal-Bench-ScienceでFable 5の倍以上(52.6%)。姉妹モデルMythos 5.1はトラステッドアクセス限定。
Fable 5.1詳細を見る →「世界で最も知能が高く、アライメントされたモデル」。Computer Use・コーディング・サイバーセキュリティ・科学で最高水準。1.05Mコンテキスト・128K出力。ARC-AGI-3 99.9%・ExploitBench 100%。API/Plusへ順次展開中。
Astra詳細を見る →3.7 Flashから3週間で公開。初回$0.75/$3.75(〜12/31)→ $1.50/$7.50。1Mコンテキスト・64K出力。DeepSWE 73.8%・HLE-Verified 54.9%。サイバー特化の3.8 Flash Cyber(Fairwind Program限定)も同時発表。
3.8 Flash詳細を見る →わずか6B activeのMoEでQwen3.7-Plus超え。Qwen4アーキテクチャを先取り。入力$0.15/出力$0.47で1Mコンテキスト・64K出力・画像/動画対応。仕様・ベンチマーク・競合比較を一次情報で解説。
Qwen3.8-Flash詳細を見る →Z.ai(智譜)のGLM-5シリーズ初のネイティブマルチモーダル。320B MoE(18B active)でGLM-5.2を上回り、価格は約1/10。入力$0.15/出力$0.50。仕様・ベンチマーク・比較を一次情報で解説。
GLM 5.3 Flash詳細を見る →$0.20/$1.20に劇的値下げ(2026-09-22にGPT-6 Lunaへ後継・本ページは旧世代の記録)。Gemini Flash-Liteより安く、GPT-5.5超えの性能。競合比較・ユースケース・最短選び方を一次情報で徹底解説。
Luna詳細を見る →$4/$20に値下げ(2026-09-22にGPT-6 Solへ後継・本ページは旧世代の記録)。1.05Mコンテキスト・128K出力の最上位推論モデル。Claude Opus 5との比較・Cloudflare AI Gateway 50%オフも解説。
Sol詳細を見る →$0.25/$1.50でマルチモーダル対応。Gemini 3 Proアーキテクチャベースで2.5 Flash並みの品質。GPT-5.6 Lunaとの徹底比較・thinkingレベル制御を解説。
Flash-Lite詳細を見る →2026-09-21公開。公式ベンチ7項目すべてでGrok 4.6を上回る。500Kコンテキスト・200K超は$4/$12・Fastは2倍。第三者評価とのギャップも併記。
Grok 4.7詳細を見る →標準$2/$6・fast variant 2倍・500Kコンテキスト。AA Intelligence Index 61でGPT-5.6 Solと並ぶ。料金・性能・競合比較を一次情報で徹底解説。
Grok 4.6詳細を見る →初回$0.75/$3.75(〜12/31)→ 標準$1.50/$7.50の期間表示を明記。1Mコンテキスト・64K出力。FrontierCode 43.6%・DeepSWE 65.3%。
3.7 Flash詳細を見る →2026-09-10登場の DeepSeek V4.1 Flash($0.15/$0.60〜・1Mコンテキスト・画像入力対応)の料金・ベンチマーク・VS Code GitHub Copilot Chat での導入手順。V4 Pro の提供継続(9/14 ルーティング予告は撤回)と Azure AI Foundry でのデプロイ手順も解説。
実践ガイドを見る →画像・音声・動画・PDF/ファイルのIn/Out可否と料金を一覧。Gemini 3.8 Flash(画像/音声/動画/PDF入力対応)・GPT-6 Astra(画像入力のみ・$10/$50)・Claude Fable 5.1・Qwen3.8-Flash・GLM 5.3 Flash・Grok 4.6・DeepSeek V4.1 Flash(画像入力対応)。音声入力が2倍になるモデル、ライブ・画像生成・TTSが別モデルに分化している点も解説。マルチモーダル特集へ。
マルチモーダル特集を見る →Azure AI Foundry(Microsoft Foundry)で提供されるマイクロソフト自社開発ファミリー。MAI-Image-2.6/2.6-Flash(画像生成)、MAI-Transcribe-2(音声認識・$0.10/時限定)、MAI-Thinking-1(推論)など。料金・使い方・リリース年表を一次情報(microsoft.ai / Azure Foundry)で整理。
MAIシリーズを見る →DeepSeek・Qwen(Alibaba)・GLM(智譜)・Kimi(Moonshot)・MiniMaxを俯瞰。料金目安・オープンウェイト状況・更新履歴つき。一次情報で裏取りできる範囲のみ掲載。
中国系AI総覧を見る →データの品質方針