提供状況(段階的ロールアウト)
出典: OpenAI公式発表(GPT-6 Astra: A new generation of intelligence)(2026-09-04確認)
料金(Standard $10/$50・2026-09-04確認)
OpenAI公式モデルドキュメント(developers.openai.com)で裏取り済み。価格はすべてUSD/1Mトークン。
| 区分 | 入力 | キャッシュ入力 | キャッシュ書込 | 出力 | 備考 |
|---|---|---|---|---|---|
| Standard(Short context) | $10.00 | $1.00 | $12.50 | $50.00 | 入力≤272Kトークン。標準レート |
| Standard(Long context) | $20.00 | $2.00 | $25.00 | $75.00 | 入力>272Kトークン。入力2倍・出力1.5倍 |
| Batch / Flex | $5.00 | $0.50 | $6.25 | $25.00 | Standardの50%オフ |
| Fast mode(Short context) | $20.00 | $2.00 | $25.00 | $100.00 | 最大2倍の速度。Standardの2倍(Long context時はLong料金に倍率適用) |
一次情報: GPT-6 Astra モデルドキュメント · developers.openai.com/api/docs/pricing(2026-09-04確認)
モデル仕様
出典: OpenAI GPT-6 Astra Model Docs(2026-09-04確認)。reasoning.effort は low / medium / high / xhigh / max をサポート。音声・動画は非対応(画像は入力のみ)。Responses API で Web search・File search・画像生成・Code interpreter・Hosted Shell・Apply Patch・Skills・Computer Use・MCP・Tool search をフルサポート。
性能 — 主要ベンチマークで新記録
OpenAIはGPT-6 Astraを「Computer Use・ブラウジング・ソフトウェアエンジニアリング・サイバーセキュリティ・科学・専門業務で最高水準」と位置づけ。以下は公式発表(2026-09-03)の数値。
- FrontierMath Tier 4 (v2): 97.6% — 数学の難問で新記録(GPT-5.6 Sol 83.0%、Claude Fable 5.1 87.8%)。
- ARC-AGI-3: 99.9% — 抽象推論で人間同等(Sol 7.8%)。ARC Prize Foundationは「人間並み」と評価。
- ExploitBench: 100.0% — 脆弱性エクスプロイト開発で満点(Sol 78.5%)。
- Terminal-Bench Science 0.1: 64.6% — 科学ワークフロー(Sol 22.4%、Claude Fable 5.1 52.6%)。
- Agents' Last Exam: 59.3% — 複雑な専門タスク(Claude Opus 5 55.5%、Sol 53.6%)。
- OSWorld 2.0: 72.6% — Computer Use(Sol 65.7%)。約47%短い時間で達成。
- Terminal-Bench 4.0: 57.9% — ターミナル型エージェント(Sol 37.3%、Claude Fable 5.1 55.8%)。
- GPQA Diamond: 96.0% — 大学院レベルの科学推論(Sol 94.6%)。
- Artificial Analysis Intelligence Index v4.1.1: 61.2 — 総合指標。
OpenAIは多くのベンチマークを最大エフォート設定で評価。低コスト設定でも Sol の最高スコアを上回るケース(GPQA 94.9% vs 94.6%・推定APIコスト約37%減)があると説明しています。ベンチマーク数値は公表値であり、実使用感を保証するものではありません。
出典: OpenAI公式発表(GPT-6 Astra)(2026-09-04確認)
競合フラッグシップとの料金比較
すべてUSD/1Mトークン(標準・Short context)。GPT-6 Astra は最上位ティアの料金帯。価格はすべて Standard(プロモ含む表記は備考参照)。
| モデル | 提供元 | 入力 | 出力 | Astraより | 備考 |
|---|---|---|---|---|---|
| GPT-6 Astra | OpenAI | $10.00 | $50.00 | — | 新フラッグシップ(基準) |
| Claude Fable 5.1 | Anthropic | $10.00 | $50.00 | 同額 | Mythosクラス。詳細ページ |
| Claude Opus 5 | Anthropic | $5.00 | $25.00 | Opus安 | Opusは入力50%安・出力50%安 |
| GPT-5.6 Sol | OpenAI | $4.00 | $20.00 | Sol安 | プロモ価格(〜11/21)。前世代フラッグシップ |
| GPT-5.5 | OpenAI | $5.00 | $30.00 | 5.5安 | 旧フラッグシップ |
| Grok 4.6 | xAI | $2.00 | $6.00 | Grok安 | 絶対額で最安帯のフラッグシップ級 |
| Gemini 3.8 Flash | $0.75 | $3.75 | Gemini安 | Flash帯(異なるティア)。初回価格(〜12/31) |
※ GPT-6 Astra は最上位ティアの料金帯。コスト重視なら Sol($4/$20・プロモ)や Gemini 3.8 Flash($0.75/$3.75)が有力。OpenAIは「Astraはタスクあたりの出力トークンが少なく、タスク単価ベースでは割高に見えにくい」と説明していますが、公開データでは検証が限定的です。
出典: 各社公式料金ページ(2026-09-04確認)。詳細は料金比較ページを参照。
こんな用途に最適
最上位の推論・Computer Use能力が求められる、失敗コストの高いワークロード向け。
Computer Use / ブラウザ操作
フォーム入力・CRM更新・カレンダー整理など、GUIを横断する自動化。OSWorld 72.6%。
ソフトウェアエンジニアリング
Terminal-Bench 4.0で57.9%。Codexと組み合わせた長期コーディング・リファクタ。
科学研究・数学
FrontierMath 97.6%・GPQA 96.0%。素数ギャップ問題など未解決問題の解決を支援。
サイバーセキュリティ(防御)
ExploitBench満点級。安全なコードレビュー・パッチング用途(高度な攻撃系タスクは拒否)。
専門業務・文書生成
テンプレート準拠のスライド・スプレッドシート・文書。BenchCAD 95.9%。
長期・自律エージェント
MCP・Computer Use・ツール呼出を駆使したマルチステップ自動化。
OpenAI フラッグシップの選び方
| モデル | 入力 | 出力 | 選ぶべき場面 |
|---|---|---|---|
| GPT-6 Astra ⬅ | $10.00 | $50.00 | 最難関タスク・Computer Use・科学研究・失敗コストが高い業務 |
| GPT-5.6 Sol | $4.00 | $20.00 | 高精度推論を低コストで(プロモ〜11/21)。コスパ最優先のフラッグシップ用途 |
| GPT-5.6 Terra | $2.00 | $12.00 | 標準的なコーディング・分析・本番エージェント |
| GPT-5.6 Luna | $0.20 | $1.20 | 高スループット・コスト重視・定型処理・1次レビュー |
💡 基本戦略: Luna→Terra→Solとエスカレーションし、GPT-6 Astra は最難関タスク・Computer Use・科学研究の最終手段として温存するのがコスト最適化の鉄則。
⚠️ 免責事項
- 料金はOpenAI公式ページ(developers.openai.com)を2026-09-04に確認したものです。予告なく変動します。契約前に必ず公式ページをご確認ください。
- GPT-6 Astra は2026-09-03時点で限定的な組織への展開開始。API・ChatGPTプランへの一般展開は「今後数日以内」で、本ページ確認時点ではまだ広く利用できない可能性があります。
- ベンチマーク数値はOpenAIの公表値であり、実際の使用感を保証するものではありません。
- 本サイトは情報提供目的であり、特定プロバイダーの推薦・代理ではありません。