💰 2026年7月30日 80%値下げ — $1.00→$0.20 / $6.00→$1.20

GPT-5.6 Luna

OpenAIの最速・最安モデルが劇的値下げ。Gemini 3.1 Flash-Liteより安く、GPT-5.5超えの性能を1/25のコストで。

$0.20
入力 / 1M tokens
$1.20
出力 / 1M tokens
1.05M
コンテキストウィンドウ
128K
最大出力トークン
⚠️ このモデルは旧世代になりました(2026年9月22日)。後継は GPT-6 Luna($0.10/$0.50・半額) です。本ページの料金・仕様はGPT-5.6世代当時の記録として保存しています。新規導入を検討する場合は後継ページをご確認ください。
●最終更新: | 出典: OpenAI API Docs · OpenAI料金ページ | 料金比較 · 計算機 · Gemini 3.1 Flash-Lite

料金(2026年7月30日改定)

OpenAI公式料金ページ(developers.openai.com)で裏取り済み。価格はすべてUSD/1Mトークン。

区分入力キャッシュ入力出力備考
Standard(Short context)$0.20$0.02$1.20入力≤272Kトークン。標準レート
Long context$0.40$0.04$1.80入力>272Kトークン。入力2倍・出力1.5倍
Batch$0.10$0.01$0.60Standardの50%オフ。完了まで最長24時間
Flex$0.10$0.01$0.60低優先度。Standardの50%オフ
料金履歴:
$1.00 / $6.00(GA発表時・2026年7月9日)
→ $0.20 / $1.20(2026年7月30日 — 80%値下げ。発表からわずか21日後)
* キャッシュ書込は標準入力の1.25倍($0.25)。キャッシュ読込は標準入力の10%。最短キャッシュ保持: 30分。
⚠️ Short/Long contextの境界: 入力272Kトークン(OpenAI APIドキュメントで確認)。272Kトークンを超えるプロンプトは、キャッシュ入力も含めリクエスト全体にLong context料金が適用されます。

一次情報: developers.openai.com/api/docs/pricing · GPT-5.6 Luna モデルドキュメント(2026-08-07確認)

モデル仕様

GAリリース
2026年7月9日
知識カットオフ
2026年2月16日
コンテキストウィンドウ
1,050,000トークン
最大出力
128,000トークン
入力モダリティ
テキスト+画像
出力モダリティ
テキスト
ツール利用
Function Calling ✓
ティア
nano相当
リージョン加算
+10%(対象リージョン)
モデルID
gpt-5.6-luna

出典: OpenAI GPT-5.6 Luna ドキュメント · GPT-5.6 発表

性能 — 「nano」を超えて

nanoティア相当の位置づけながら、主要ベンチマークで前世代フラッグシップを上回ります。

  • Artificial Analysis Quality Index: 51 — 軽量モデルとしては高い総合スコアで上位層
  • Agents' Last Exam: GPT-5.5超え。専門エージェントタスクではSolとわずか2.4ポイント差
  • HealthBench Professional / DeepSWE: いずれもGPT-5.5超え
  • コーディング: BenchLM 215モデル中6位
  • 画像評価(Roboflow): 総合74.1%(16モデル中6位)
  • vs Claude Fable 5: Agents' Last ExamでFable 5超え、推定タスク単価は約1/16

OpenAIはLunaを「1年前のフロンティア級性能を、タスク単価約6%・約9倍の速度で提供」と説明しています。

出典: Artificial Analysis · BenchLM.ai · OpenAI

競合軽量モデルとの料金比較

GPT-5.6 Lunaの80%値下げにより、主要軽量モデルの中で最も安価な部類に。価格はすべてUSD/1Mトークン(標準料金・Short context)。

モデル提供元入力出力Lunaより備考
GPT-5.6 LunaOpenAI$0.20$1.20—基準モデル
GPT-5.4 nanoOpenAI$0.20$1.25入力同額旧世代最軽量。Lunaの方が高性能
Gemini 3.5 Flash-LiteGoogle$0.30$2.50Luna安Gemini 3.x最安。Lunaは入力33%安・出力52%安
Gemini 3.1 Flash-LiteGoogle$0.25$1.50Luna安詳細ページ。Lunaは入力20%安・出力20%安
Gemini 2.5 Flash-LiteGoogle$0.10$0.40Gemini安旧世代だが絶対額で安い。性能差大
Claude Haiku 4.5Anthropic$1.00$5.00Luna安Lunaは入力80%安・出力76%安
DeepSeek V4.1 FlashDeepSeek$0.15–$0.30$0.60–$1.20オフピークは入力・出力ともDeepSeek安ピーク/オフピーク制(8/16発効)。オフピークはピークの半額

※ DeepSeekは2026-09-10リリースの V4.1 Flash が現行(cache miss入力 オフピーク$0.15・ピーク$0.30、出力 オフピーク$0.60・ピーク$1.20)。V4 Flash は V4.1 Flash へ統合されましたが、V4 Pro は 2026-09-14 以降も提供継続(9/14 ルーティング予告は撤回済み)。オフピーク時は入力・出力ともGPT-5.6 Luna($0.20/$1.20)より安い計算です。

出典: 各社公式料金ページ(2026-08-07確認)。詳細は料金比較ページを参照。Gemini 3.1 Flash-Liteの詳細はこちら →

こんな用途に最適

高スループット・低コストが求められるワークロード全般。特に以下のシーンで真価を発揮。

💬

チャット・カスタマーサポート

大量の会話をリアルタイム処理。低レイテンシと低コストを両立。

🏷️

分類・タグ付け・抽出

文書分類、感情分析、エンティティ抽出など定型的なNLPタスク。

🤖

軽量エージェントワークフロー

ツール呼出・Function Callingを使った自動化。GPT-5.5超えのエージェント性能。

✍️

要約・下書き・校正

大量文書の自動要約、メール下書き、文章校正などのテキスト処理。

🔄

バッチ処理・データパイプライン

Batch/Flexでさらに50%オフ。大規模データの夜間処理に。

🔍

RAG・検索拡張生成

1.05Mコンテキストを活かした大量文書の検索・質問応答。

GPT-5.6シリーズの選び方

モデル入力出力選ぶべき場面
GPT-5.6 Sol$4.00$20.00最難関タスク・長期エージェント・失敗コストが高い業務(プロモ〜11/21)
GPT-5.6 Terra$2.00$12.00標準的なコーディング・分析・本番エージェント
GPT-5.6 Luna ⬅$0.20$1.20高スループット・コスト重視・定型処理・1次レビュー

💡 基本戦略: Lunaでまず処理し、品質不足ならTerra→Solとエスカレーション。コスト最適化の鉄則。テキスト中心ならLuna、音声・動画を含むマルチモーダル処理ならGemini 3.1 Flash-Liteも有力な選択肢。

実際のコストを試算する

GPT-5.6 Lunaを含む全モデルのトークンコストを一括計算。入力・出力トークン数を入れるだけ。

🧮 トークン計算機で試算する →

📊 全モデル料金比較 · ⚡ Gemini 3.1 Flash-Liteと比較 · 🗓️ リリース年表 · 🔗 OpenAI公式料金ページ

⚠️ 免責事項

  • 料金はOpenAI公式ページ(developers.openai.com)を2026-08-07に確認したものです。予告なく変動します。契約前に必ず公式ページをご確認ください。
  • 本サイトは情報提供目的であり、特定プロバイダーの推薦・代理ではありません。
  • ベンチマーク数値は各評価機関・OpenAIの公表値であり、実際の使用感を保証するものではありません。