⚡ GPT-6世代のバランス型 — 公式の位置づけは「Near-Astra performance for complex work at a lower cost」

GPT-6.1 Sol

OpenAI の GPT-6 世代で「知能とコストのバランス」を担うモデル。モデルIDは gpt-6.1-sol で、公式モデルページの説明は 「Near-Astra performance for complex work at a lower cost(Astraに近い性能を、より低いコストで)」。料金は 入力$2 / 出力$10、キャッシュ入力は入力の5%=$0.10 です。

$2.00
入力 / 1M
$0.10
キャッシュ入力 / 1M
$10.00
出力 / 1M
1.05M
コンテキスト

短くまとめると

  • 入力$2・出力$10はGPT-6 Solと同額。一方でキャッシュ入力は$0.10(入力の5%)と、GPT-6 Solの$0.20(90%引き)からさらに半額になりました(公式モデルページの記載)。
  • reasoning effortはlow / medium(既定)/ high / xhigh / max。noneとminimalは非対応です(GPT-6 Sol・Lunaはnoneに対応)。
  • ツール呼び出しはResponses APIで。Chat Completionsはツールなしのリクエストのみ対応です。
  • 速度ティアは価格が変わる: Fastは2倍、Ultrafastは6倍、BatchとFlexは50%引き。地域処理は+10%。
  • 272,000トークン超の入力は「リクエスト全体」が入力2倍・出力1.5倍。長文を1回で流す設計は割高になります(公式逐語)。
  • リリース日は公式モデルページに記載がありません。第三者報道は2026年9月29日で一致していますが、当サイトはこの点を明記して掲載します(後述)。

料金(USD / 1Mトークン、公式モデルページより)

Standardは公式ページの記載値そのまま。Fast・Batch/Flex・Ultrafastは公式の倍率(2倍・50%引き・6倍)から当サイトが算出した参考値です。

項目StandardFast(2倍)Batch / Flex(50%引き)Ultrafast(6倍)
入力$2.00$4.00$1.00$12.00
キャッシュ入力$0.10$0.20$0.05$0.60
キャッシュ書込(1.25倍)$2.50$5.00$1.25$15.00
出力$10.00$20.00$5.00$60.00

※ 公式ページの注記: キャッシュ入力は「入力の5%」、キャッシュ書込は「入力の1.25倍」。Fast 2倍・Batch/Flex 50%引き・Ultrafast 6倍・地域処理+10%。

出典: OpenAI — GPT-6.1 Sol(Pricing)(2026-10-09時点)

272Kトークンの壁:長文を1回で流すと割高になる

公式の注記は「272,000入力トークンを超えるプロンプトは、リクエスト全体が入力・キャッシュの2倍、出力の1.5倍で課金される」というものです。超過分だけではありません。

ケース計算金額
300,000トークン入力+5,000トークン出力
(1回で送る)
入力 $4/M × 0.3 + 出力 $15/M × 0.005
※272K超のため入力2倍・出力1.5倍
$1.275
同内容を100,000トークンずつ3回に分ける
(文脈が分断されない場合)
入力 $2/M × 0.3 + 出力は各回の分だけ$0.60+出力分
  • 「1.05Mコンテキスト」と「1.05Mを1回で送る」は別の話です。272Kを超えるとそのリクエスト全体が割増になるため、長文一括処理はコスト設計の問題になります。
  • 会話を長く続ける用途ではキャッシュ入力$0.10が効きます。ただし272Kを超えた時点でキャッシュも2倍($0.20/M)になります。
  • 数字はすべて公式の倍率からの計算値です。実際の課金はAPIのレスポンスで確認してください。

GPT-6 Solとの違い

項目GPT-6.1 SolGPT-6 Sol(前世代)
入力$2.00$2.00
キャッシュ入力$0.10(入力の5%)$0.20(90%引き)
キャッシュ書込$2.50(入力の1.25倍)公式モデルページに記載なし
出力$10.00$10.00
reasoning effortlow / medium(既定)/ high / xhigh / max(none・minimal非対応)none を含む(reasoning_effort: "none"でのfunction callingに対応)
コンテキスト / 最大出力1,050,000 / 128,000(最大入力922,000)1,050,000 / 128,000
知識カットオフ2026年4月30日2026年4月

※ GPT-6 Solの単価・カットオフは当サイトの 料金比較 掲載値(2026-09-25時点の公式ページで確認)。GPT-6.1 Solは公式モデルページの記載値(2026-10-09確認)です。

移行時に効く公式の注意点

ツール呼び出しはResponses API
Chat Completionsはツールなしのリクエストのみ対応。ツール付きの推論はResponses APIを使ってください(公式モデルページの逐語)。
effort≠none なら温度系は削除
reasoning effortがnone以外のとき、temperature・top_p・top_logprobs(Chat Completionsではlogprobs)は送れません。移行ガイドの記載どおり削除が必要です。
キャッシュTTLの指定方法が変更
GPT-5.5以前のprompt_cache_retentionから、prompt_cache_options.ttl="30m"に置き換わっています。
データレジデンシー
米国・EUに対応(Fast・Ultrafastモードを含む)。地域処理は+10%です。

仕様

項目値(公式モデルページ)
モデルID / スナップショットgpt-6.1-sol
コンテキスト1,050,000トークン
最大入力トークン922,000
最大出力128,000トークン
入出力テキスト・画像 → テキスト(音声・動画は非対応)
知識カットオフ2026年4月30日(reasoningトークン対応)
対応エンドポイントResponses、Chat Completions(ツールなし)、Batch。Live / Realtime / Assistants / Embeddings / 画像生成 / 音声 / ファインチューニングは非対応
主なツールweb search、file search、image generation、code interpreter、computer use、MCP、apply_patch ほか
レート制限(Standard)Build 5,000 RPM / 1,000,000 TPM、Launch 10,000 / 4,000,000、Grow 15,000 / 40,000,000

ベンチマークについて(当サイトの方針)

OpenAIのモデルページには数値のベンチマーク表が掲載されていません(2026-10-09時点で確認)。ページにあるのは「Near-Astra performance for complex work at a lower cost」という位置づけの説明です。

  • 第三者の集計サイトがスコアを公開していますが、当サイトは運営元(OpenAI)が公表していない数値を掲載しません。推測で埋めると「一次情報で裏取りできる情報のみ」という方針に反するためです。
  • 判断材料としては、公式が推奨する「自社タスクでAstraと比較する(Compare it with Astra on your tasks)」という手順が最も確実です。

関連ページ

⚠️ 免責事項

  • 料金・仕様は2026-10-09時点でOpenAI公式ドキュメント(GPT-6.1 Sol モデルページ・料金ページ)を確認したものです。
  • Fast・Batch/Flex・Ultrafast・272K超の金額は公式の倍率から当サイトが算出した参考値です。請求額は公式の請求明細で確認してください。
  • リリース日は公式モデルページに記載がないため、当サイトは第三者報道の日付を「第三者情報」と明記して掲載しています。
  • 本サイトは情報提供目的であり、特定プロバイダーの推奨・代理ではありません。