短くまとめると
- 入力$2・出力$10はGPT-6 Solと同額。一方でキャッシュ入力は$0.10(入力の5%)と、GPT-6 Solの$0.20(90%引き)からさらに半額になりました(公式モデルページの記載)。
- reasoning effortはlow / medium(既定)/ high / xhigh / max。
noneとminimalは非対応です(GPT-6 Sol・Lunaはnoneに対応)。 - ツール呼び出しはResponses APIで。Chat Completionsはツールなしのリクエストのみ対応です。
- 速度ティアは価格が変わる: Fastは2倍、Ultrafastは6倍、BatchとFlexは50%引き。地域処理は+10%。
- 272,000トークン超の入力は「リクエスト全体」が入力2倍・出力1.5倍。長文を1回で流す設計は割高になります(公式逐語)。
- リリース日は公式モデルページに記載がありません。第三者報道は2026年9月29日で一致していますが、当サイトはこの点を明記して掲載します(後述)。
料金(USD / 1Mトークン、公式モデルページより)
Standardは公式ページの記載値そのまま。Fast・Batch/Flex・Ultrafastは公式の倍率(2倍・50%引き・6倍)から当サイトが算出した参考値です。
| 項目 | Standard | Fast(2倍) | Batch / Flex(50%引き) | Ultrafast(6倍) |
|---|---|---|---|---|
| 入力 | $2.00 | $4.00 | $1.00 | $12.00 |
| キャッシュ入力 | $0.10 | $0.20 | $0.05 | $0.60 |
| キャッシュ書込(1.25倍) | $2.50 | $5.00 | $1.25 | $15.00 |
| 出力 | $10.00 | $20.00 | $5.00 | $60.00 |
※ 公式ページの注記: キャッシュ入力は「入力の5%」、キャッシュ書込は「入力の1.25倍」。Fast 2倍・Batch/Flex 50%引き・Ultrafast 6倍・地域処理+10%。
出典: OpenAI — GPT-6.1 Sol(Pricing)(2026-10-09時点)
272Kトークンの壁:長文を1回で流すと割高になる
公式の注記は「272,000入力トークンを超えるプロンプトは、リクエスト全体が入力・キャッシュの2倍、出力の1.5倍で課金される」というものです。超過分だけではありません。
| ケース | 計算 | 金額 |
|---|---|---|
| 300,000トークン入力+5,000トークン出力 (1回で送る) | 入力 $4/M × 0.3 + 出力 $15/M × 0.005 ※272K超のため入力2倍・出力1.5倍 | $1.275 |
| 同内容を100,000トークンずつ3回に分ける (文脈が分断されない場合) | 入力 $2/M × 0.3 + 出力は各回の分だけ | $0.60+出力分 |
- 「1.05Mコンテキスト」と「1.05Mを1回で送る」は別の話です。272Kを超えるとそのリクエスト全体が割増になるため、長文一括処理はコスト設計の問題になります。
- 会話を長く続ける用途ではキャッシュ入力$0.10が効きます。ただし272Kを超えた時点でキャッシュも2倍($0.20/M)になります。
- 数字はすべて公式の倍率からの計算値です。実際の課金はAPIのレスポンスで確認してください。
GPT-6 Solとの違い
| 項目 | GPT-6.1 Sol | GPT-6 Sol(前世代) |
|---|---|---|
| 入力 | $2.00 | $2.00 |
| キャッシュ入力 | $0.10(入力の5%) | $0.20(90%引き) |
| キャッシュ書込 | $2.50(入力の1.25倍) | 公式モデルページに記載なし |
| 出力 | $10.00 | $10.00 |
| reasoning effort | low / medium(既定)/ high / xhigh / max(none・minimal非対応) | none を含む(reasoning_effort: "none"でのfunction callingに対応) |
| コンテキスト / 最大出力 | 1,050,000 / 128,000(最大入力922,000) | 1,050,000 / 128,000 |
| 知識カットオフ | 2026年4月30日 | 2026年4月 |
※ GPT-6 Solの単価・カットオフは当サイトの 料金比較 掲載値(2026-09-25時点の公式ページで確認)。GPT-6.1 Solは公式モデルページの記載値(2026-10-09確認)です。
移行時に効く公式の注意点
none以外のとき、temperature・top_p・top_logprobs(Chat Completionsではlogprobs)は送れません。移行ガイドの記載どおり削除が必要です。prompt_cache_retentionから、prompt_cache_options.ttl="30m"に置き換わっています。仕様
| 項目 | 値(公式モデルページ) |
|---|---|
| モデルID / スナップショット | gpt-6.1-sol |
| コンテキスト | 1,050,000トークン |
| 最大入力トークン | 922,000 |
| 最大出力 | 128,000トークン |
| 入出力 | テキスト・画像 → テキスト(音声・動画は非対応) |
| 知識カットオフ | 2026年4月30日(reasoningトークン対応) |
| 対応エンドポイント | Responses、Chat Completions(ツールなし)、Batch。Live / Realtime / Assistants / Embeddings / 画像生成 / 音声 / ファインチューニングは非対応 |
| 主なツール | web search、file search、image generation、code interpreter、computer use、MCP、apply_patch ほか |
| レート制限(Standard) | Build 5,000 RPM / 1,000,000 TPM、Launch 10,000 / 4,000,000、Grow 15,000 / 40,000,000 |
ベンチマークについて(当サイトの方針)
OpenAIのモデルページには数値のベンチマーク表が掲載されていません(2026-10-09時点で確認)。ページにあるのは「Near-Astra performance for complex work at a lower cost」という位置づけの説明です。
- 第三者の集計サイトがスコアを公開していますが、当サイトは運営元(OpenAI)が公表していない数値を掲載しません。推測で埋めると「一次情報で裏取りできる情報のみ」という方針に反するためです。
- 判断材料としては、公式が推奨する「自社タスクでAstraと比較する(Compare it with Astra on your tasks)」という手順が最も確実です。
関連ページ
- GPT-6 Sol / GPT-6 Luna — 同世代の前世代モデル(Solは$2/$10、Lunaは$0.10/$0.50)
- 主要LLM API 料金比較 — 各社の公式料金を1ページで比較
- トークン料金計算機 — 入力・出力トークン数から実額を計算
- Claude Sonnet 5.5 — 同価格帯の競合($2/$10・キャッシュ読込$0.10)
- プロンプトキャッシュとは — キャッシュ入力$0.10が効く条件
- リリース年表 — GPT-6世代の時系列
⚠️ 免責事項
- 料金・仕様は2026-10-09時点でOpenAI公式ドキュメント(GPT-6.1 Sol モデルページ・料金ページ)を確認したものです。
- Fast・Batch/Flex・Ultrafast・272K超の金額は公式の倍率から当サイトが算出した参考値です。請求額は公式の請求明細で確認してください。
- リリース日は公式モデルページに記載がないため、当サイトは第三者報道の日付を「第三者情報」と明記して掲載しています。
- 本サイトは情報提供目的であり、特定プロバイダーの推奨・代理ではありません。