料金(2026年7月30日改定)
OpenAI公式料金ページ(developers.openai.com)で裏取り済み。価格はすべてUSD/1Mトークン。
| 区分 | 入力 | キャッシュ入力 | 出力 | 備考 |
|---|---|---|---|---|
| Standard(Short context) | $0.20 | $0.02 | $1.20 | 入力≤272Kトークン。標準レート |
| Long context | $0.40 | $0.04 | $1.80 | 入力>272Kトークン。入力2倍・出力1.5倍 |
| Batch | $0.10 | $0.01 | $0.60 | Standardの50%オフ。完了まで最長24時間 |
| Flex | $0.10 | $0.01 | $0.60 | 低優先度。Standardの50%オフ |
$1.00 / $6.00(GA発表時・2026年7月9日)
→ $0.20 / $1.20(2026年7月30日 — 80%値下げ。発表からわずか21日後)
* キャッシュ書込は標準入力の1.25倍($0.25)。キャッシュ読込は標準入力の10%。最短キャッシュ保持: 30分。
一次情報: developers.openai.com/api/docs/pricing · GPT-5.6 Luna モデルドキュメント(2026-08-07確認)
モデル仕様
性能 — 「nano」を超えて
nanoティア相当の位置づけながら、主要ベンチマークで前世代フラッグシップを上回ります。
- Artificial Analysis Quality Index: 51 — 軽量モデルとしては高い総合スコアで上位層
- Agents' Last Exam: GPT-5.5超え。専門エージェントタスクではSolとわずか2.4ポイント差
- HealthBench Professional / DeepSWE: いずれもGPT-5.5超え
- コーディング: BenchLM 215モデル中6位
- 画像評価(Roboflow): 総合74.1%(16モデル中6位)
- vs Claude Fable 5: Agents' Last ExamでFable 5超え、推定タスク単価は約1/16
OpenAIはLunaを「1年前のフロンティア級性能を、タスク単価約6%・約9倍の速度で提供」と説明しています。
出典: Artificial Analysis · BenchLM.ai · OpenAI
競合軽量モデルとの料金比較
GPT-5.6 Lunaの80%値下げにより、主要軽量モデルの中で最も安価な部類に。価格はすべてUSD/1Mトークン(標準料金・Short context)。
| モデル | 提供元 | 入力 | 出力 | Lunaより | 備考 |
|---|---|---|---|---|---|
| GPT-5.6 Luna | OpenAI | $0.20 | $1.20 | — | 基準モデル |
| GPT-5.4 nano | OpenAI | $0.20 | $1.25 | 入力同額 | 旧世代最軽量。Lunaの方が高性能 |
| Gemini 3.5 Flash-Lite | $0.30 | $2.50 | Luna安 | Gemini 3.x最安。Lunaは入力33%安・出力52%安 | |
| Gemini 3.1 Flash-Lite | $0.25 | $1.50 | Luna安 | 詳細ページ。Lunaは入力20%安・出力20%安 | |
| Gemini 2.5 Flash-Lite | $0.10 | $0.40 | Gemini安 | 旧世代だが絶対額で安い。性能差大 | |
| Claude Haiku 4.5 | Anthropic | $1.00 | $5.00 | Luna安 | Lunaは入力80%安・出力76%安 |
| DeepSeek V4.1 Flash | DeepSeek | $0.15–$0.30 | $0.60–$1.20 | オフピークは入力・出力ともDeepSeek安 | ピーク/オフピーク制(8/16発効)。オフピークはピークの半額 |
※ DeepSeekは2026-09-10リリースの V4.1 Flash が現行(cache miss入力 オフピーク$0.15・ピーク$0.30、出力 オフピーク$0.60・ピーク$1.20)。V4 Flash は V4.1 Flash へ統合されましたが、V4 Pro は 2026-09-14 以降も提供継続(9/14 ルーティング予告は撤回済み)。オフピーク時は入力・出力ともGPT-5.6 Luna($0.20/$1.20)より安い計算です。
出典: 各社公式料金ページ(2026-08-07確認)。詳細は料金比較ページを参照。Gemini 3.1 Flash-Liteの詳細はこちら →
こんな用途に最適
高スループット・低コストが求められるワークロード全般。特に以下のシーンで真価を発揮。
チャット・カスタマーサポート
大量の会話をリアルタイム処理。低レイテンシと低コストを両立。
分類・タグ付け・抽出
文書分類、感情分析、エンティティ抽出など定型的なNLPタスク。
軽量エージェントワークフロー
ツール呼出・Function Callingを使った自動化。GPT-5.5超えのエージェント性能。
要約・下書き・校正
大量文書の自動要約、メール下書き、文章校正などのテキスト処理。
バッチ処理・データパイプライン
Batch/Flexでさらに50%オフ。大規模データの夜間処理に。
RAG・検索拡張生成
1.05Mコンテキストを活かした大量文書の検索・質問応答。
GPT-5.6シリーズの選び方
| モデル | 入力 | 出力 | 選ぶべき場面 |
|---|---|---|---|
| GPT-5.6 Sol | $4.00 | $20.00 | 最難関タスク・長期エージェント・失敗コストが高い業務(プロモ〜11/21) |
| GPT-5.6 Terra | $2.00 | $12.00 | 標準的なコーディング・分析・本番エージェント |
| GPT-5.6 Luna ⬅ | $0.20 | $1.20 | 高スループット・コスト重視・定型処理・1次レビュー |
💡 基本戦略: Lunaでまず処理し、品質不足ならTerra→Solとエスカレーション。コスト最適化の鉄則。テキスト中心ならLuna、音声・動画を含むマルチモーダル処理ならGemini 3.1 Flash-Liteも有力な選択肢。
実際のコストを試算する
GPT-5.6 Lunaを含む全モデルのトークンコストを一括計算。入力・出力トークン数を入れるだけ。
🧮 トークン計算機で試算する →📊 全モデル料金比較 · ⚡ Gemini 3.1 Flash-Liteと比較 · 🗓️ リリース年表 · 🔗 OpenAI公式料金ページ
⚠️ 免責事項
- 料金はOpenAI公式ページ(developers.openai.com)を2026-08-07に確認したものです。予告なく変動します。契約前に必ず公式ページをご確認ください。
- 本サイトは情報提供目的であり、特定プロバイダーの推薦・代理ではありません。
- ベンチマーク数値は各評価機関・OpenAIの公表値であり、実際の使用感を保証するものではありません。