料金(QwenCloud・国際版)
Qwen公式ブログ(qwen.ai/blog、2026-08-26)に明記された本番版 Qwen3.8-Flash の価格。単位はUSD/1Mトークン。
| モデル | 入力 | 出力 | 備考 |
|---|---|---|---|
| Qwen3.8-Flash(本番API) | $0.15 | $0.47 | 本番SKU qwen3.8-flash。1Mコンテキスト・公式組み込みツール対応 |
| Qwen3.8-Flash-Next(オープンウェイト) | — | — | 重みはHugging Face / ModelScopeで無償公開(自己ホスト) |
| Qwen3.8-Max | $2.00 | $6.00 | フラッグシップ(2.4T MoE)。Flashの約13倍の価格 |
一次情報: qwen.ai/blog?id=qwen3.8-flash-next(2026-09-01確認)
モデル仕様
出典: Qwen公式ブログ「Qwen3.8-Flash-Next: A New Architecture, Towards Ultimate Cost-Efficiency」 · HuggingFace: Qwen/Qwen3.8-Flash-Next(2026-09-01確認)
性能 — 6B activeでQwen3.7-Plusを上回る
以下はQwen公式ブログ(2026-08-26)の自己公表値。独立評価と差が出る場合があります。
- コーディング: SWE-bench Pro 62.5(Claude Opus 4.6 Max 53.4、Qwen3.7-Plus 55.8、DeepSeek-V4-Flash 56.0)。DeepSWE 1.1 は58.7(Qwen3.7-Plus 16.5)。
- Office・エージェント: CoWorkBench 73.9(Claude Opus 4.6 68.2)、JobBench 55.7(Qwen3.7-Plus 27.6)。
- ツール呼出: Toolathlon Verified(Pass@1)73.5(Qwen3.7-Plus 50.6、DeepSeek-V4-Flash 70.3)。
- マルチモーダル: AndroidWorld 84.5(Claude Opus 4.6 62.0)、LVBench 76.6(Claude Opus 4.6 63.0)、RealWorldQA 88.5(Claude Opus 4.6 73.9)。
- 一般推論: GPQA Diamond 91.7(Claude Opus 4.6 91.3)、LiveCodeBench v6 91.9(Claude Opus 4.6 88.8)。
- 対Qwen3.7-Plus: トレーニングコストは約1/9ながら、コーディング・Office・エージェントの主要ベンチマークで上回る。
Qwenは本モデルを「究極のコスト効率へ向けた新アーキテクチャ」と位置づけています。QSA(Qwen Sparse Attention)により、1Mトークン時のAttention KernelはPrefill 7.6倍・Decode 4.9倍高速化し、90% Prefix Cacheヒットの条件下ではQwen3.7-Plus比で8.6倍のPrefillスループットを達成すると報告しています。Qwenは本モデルの重みを「正式なQwen4ファミリーに先立ち、コミュニティがアーキテクチャを検討できるよう」早期公開しており、本番版はQwenWorkの「Standard」モードにも採用されています。
出典: Qwen公式ブログ(2026-09-01確認)
競合モデルとの料金比較
中国系低価格モデル・軽量モデルとの比較。価格はUSD/1Mトークン(標準テキスト・キャッシュなし)。
| モデル | 提供元 | 入力 | 出力 | Flash比 | 備考 |
|---|---|---|---|---|---|
| Qwen3.8-Flash | Alibaba | $0.15 | $0.47 | — | 基準。マルチモーダル・Qwen4プレビュー |
| GLM-5.3-Flash | Zhipu(Z.ai) | $0.075 | $0.25 | GLM安 | プロモ価格(〜9/9、list $0.15/$0.50) |
| GPT-5.6 Luna | OpenAI | $0.20 | $1.20 | Qwen安 | Qwenは入力25%安・出力61%安 |
| Gemini 3.1 Flash-Lite | $0.25 | $1.50 | Qwen安 | Qwenは入力40%安・出力69%安 | |
| DeepSeek V4 Flash | DeepSeek | $0.22–$0.44 | $0.66–$1.32 | 拮抗 | ピーク/オフピーク制。オフピーク入力はQwenより高い |
| Qwen3.8-Max | Alibaba | $2.00 | $6.00 | Flash安 | フラッグシップ。Flashは約1/13 |
※ GLM-5.3-Flashは50%オフプロモ価格(list $0.15/$0.50・〜9/9)。DeepSeek V4 Flashはピーク/オフピーク価格制(cache miss入力 オフピーク$0.22・ピーク$0.44、出力 オフピーク$0.66・ピーク$1.32)。Qwen3.8-Flashの価格は公式ブログの国際版(USD建て)表記。
出典: 各社公式料金ページ・公式ブログ(2026-09-01確認)。詳細は料金比較ページを参照。GLM 5.3 Flashの詳細はこちら →
こんな用途に最適
低コスト×長文コンテキスト×マルチモーダルが必要なワークロード全般。
コーディング・エージェント
SWE-bench Pro 62.5・DeepSWE 58.7。Claude Code / Codex / Qoder CLI と直接連携。
Office・文書ワークフロー
CoWorkBench 73.9・JobBench 55.7。財務・法務・医療など専門タスク。
ツール呼出・Function Calling
Toolathlon 73.5。OpenAI互換(Chat Completions / Responses)+Anthropic互換プロトコル対応。
マルチモーダル理解
画像・動画入力。AndroidWorld 84.5・LVBench 76.6で長尺動画・GUI操作にも強い。
ローカル自己ホスト
オープンウェイト(HF / ModelScope公開)。6B activeで省メモリ推論が可能。
Qwen4移行の先行検証
次世代アーキテクチャ(GDN + QSA)を先行評価。将来のQwen4採用判断の材料に。
Qwen 3.8シリーズの選び方
| モデル | 入力 | 出力 | 選ぶべき場面 |
|---|---|---|---|
| Qwen3.8-Max | $2.00 | $6.00 | 最難関タスク・フラッグシップ品質 |
| Qwen3.8-Flash ⬅ | $0.15 | $0.47 | コスト重視・高スループット・マルチモーダル・コーディング |
| Qwen3.8-27B | — | — | ローカル実行向け小型denseモデル(ライセンスは公式モデルカード参照) |
💡 基本戦略: 日常的なコーディング・エージェント・文書処理・マルチモーダル理解はFlashで処理し、最難関タスクのみQwen3.8-Maxへエスカレーション。
⚠️ 免責事項
- 料金はQwen公式ブログ(qwen.ai/blog)を2026-09-01に確認したものです。予告なく変動します。契約前に必ずQwenCloudの料金ページをご確認ください。
- 価格表記は公式ブログ($0.15/$0.47)と公式X($0.16/$0.47)で差異があります。中国本土向けは人民元建て(1元/3元)。地域・契約条件により異なる場合があります。
- 性能数値はQwen公式ブログの自己公表値であり、独立評価と差が出る場合があります。実際の使用感を保証するものではありません。
- 本サイトは情報提供目的であり、特定プロバイダーの推薦・代理ではありません。Qwen・AlibabaはAlibaba Groupの商標です。