🧬 Qwen4アーキテクチャのプレビュー — 入力$0.15 / 出力$0.47

Qwen3.8 Flash

Alibaba(Qwen)の低コスト・マルチモーダルMoEモデル。わずか6B activeのパラメータで、コーディング・エージェント・Officeタスクの各ベンチマークでQwen3.7-Plusを上回る。次世代「Qwen4」のアーキテクチャを先取りしたオープンウェイト版(Flash-Next)も同時公開。

$0.15
入力 / 1M tokens
$0.47
出力 / 1M tokens
256K→1M
コンテキストウィンドウ
64K
最大出力トークン

料金(QwenCloud・国際版)

Qwen公式ブログ(qwen.ai/blog、2026-08-26)に明記された本番版 Qwen3.8-Flash の価格。単位はUSD/1Mトークン。

モデル入力出力備考
Qwen3.8-Flash(本番API)$0.15$0.47本番SKU qwen3.8-flash。1Mコンテキスト・公式組み込みツール対応
Qwen3.8-Flash-Next(オープンウェイト)重みはHugging Face / ModelScopeで無償公開(自己ホスト)
Qwen3.8-Max$2.00$6.00フラッグシップ(2.4T MoE)。Flashの約13倍の価格
💡 価格表記の注意: Qwen公式ブログでは「入力 0.15 USD / 出力 0.47 USD」と明記されています。一方、公式X(@Alibaba_Qwen)の投稿では「$0.16 / $0.47」と表記されており、中国本土向けは人民元建てで1元 / 3元(Reuters報道、約$0.149 / $0.447)です。契約時は必ずQwenCloudの料金ページで最終確認してください。
⚠️ コンテキストの違いに注意: オープンウェイト版 Flash-Next はネイティブ 262,144(256K)トークンで、YaRNにより1Mまで拡張可能。一方、本番API版 Qwen3.8-Flash は「1Mコンテキストがデフォルト」と公式ブログに明記されています。自己ホスト時とAPI利用時で利用可能なコンテキスト長が異なる点に注意してください。

一次情報: qwen.ai/blog?id=qwen3.8-flash-next(2026-09-01確認)

モデル仕様

公開日
2026-08-26
モデルID(API)
qwen3.8-flash
コンテキスト
256Kネイティブ → 1M(API版は1Mデフォルト)
最大出力
64K tokens
パラメータ
125B total / 6B active(+51B N-gram)
入力モダリティ
テキスト + 画像(+動画理解)
出力モダリティ
テキスト
アーキテクチャ
GDN + QSA ハイブリッド(スパースMoE)
推論エフォート
low / medium / xhigh(3段階)
ライセンス
オープンウェイト(HF / ModelScope公開)
提供元
Alibaba(Qwen / 阿里云)

出典: Qwen公式ブログ「Qwen3.8-Flash-Next: A New Architecture, Towards Ultimate Cost-Efficiency」 · HuggingFace: Qwen/Qwen3.8-Flash-Next(2026-09-01確認)

性能 — 6B activeでQwen3.7-Plusを上回る

以下はQwen公式ブログ(2026-08-26)の自己公表値。独立評価と差が出る場合があります。

  • コーディング: SWE-bench Pro 62.5(Claude Opus 4.6 Max 53.4、Qwen3.7-Plus 55.8、DeepSeek-V4-Flash 56.0)。DeepSWE 1.1 は58.7(Qwen3.7-Plus 16.5)。
  • Office・エージェント: CoWorkBench 73.9(Claude Opus 4.6 68.2)、JobBench 55.7(Qwen3.7-Plus 27.6)。
  • ツール呼出: Toolathlon Verified(Pass@1)73.5(Qwen3.7-Plus 50.6、DeepSeek-V4-Flash 70.3)。
  • マルチモーダル: AndroidWorld 84.5(Claude Opus 4.6 62.0)、LVBench 76.6(Claude Opus 4.6 63.0)、RealWorldQA 88.5(Claude Opus 4.6 73.9)。
  • 一般推論: GPQA Diamond 91.7(Claude Opus 4.6 91.3)、LiveCodeBench v6 91.9(Claude Opus 4.6 88.8)。
  • 対Qwen3.7-Plus: トレーニングコストは約1/9ながら、コーディング・Office・エージェントの主要ベンチマークで上回る。

Qwenは本モデルを「究極のコスト効率へ向けた新アーキテクチャ」と位置づけています。QSA(Qwen Sparse Attention)により、1Mトークン時のAttention KernelはPrefill 7.6倍・Decode 4.9倍高速化し、90% Prefix Cacheヒットの条件下ではQwen3.7-Plus比で8.6倍のPrefillスループットを達成すると報告しています。Qwenは本モデルの重みを「正式なQwen4ファミリーに先立ち、コミュニティがアーキテクチャを検討できるよう」早期公開しており、本番版はQwenWorkの「Standard」モードにも採用されています。

出典: Qwen公式ブログ(2026-09-01確認)

競合モデルとの料金比較

中国系低価格モデル・軽量モデルとの比較。価格はUSD/1Mトークン(標準テキスト・キャッシュなし)。

モデル提供元入力出力Flash比備考
Qwen3.8-FlashAlibaba$0.15$0.47基準。マルチモーダル・Qwen4プレビュー
GLM-5.3-FlashZhipu(Z.ai)$0.075$0.25GLM安プロモ価格(〜9/9、list $0.15/$0.50)
GPT-5.6 LunaOpenAI$0.20$1.20Qwen安Qwenは入力25%安・出力61%安
Gemini 3.1 Flash-LiteGoogle$0.25$1.50Qwen安Qwenは入力40%安・出力69%安
DeepSeek V4 FlashDeepSeek$0.22–$0.44$0.66–$1.32拮抗ピーク/オフピーク制。オフピーク入力はQwenより高い
Qwen3.8-MaxAlibaba$2.00$6.00Flash安フラッグシップ。Flashは約1/13

※ GLM-5.3-Flashは50%オフプロモ価格(list $0.15/$0.50・〜9/9)。DeepSeek V4 Flashはピーク/オフピーク価格制(cache miss入力 オフピーク$0.22・ピーク$0.44、出力 オフピーク$0.66・ピーク$1.32)。Qwen3.8-Flashの価格は公式ブログの国際版(USD建て)表記。

出典: 各社公式料金ページ・公式ブログ(2026-09-01確認)。詳細は料金比較ページを参照。GLM 5.3 Flashの詳細はこちら →

こんな用途に最適

低コスト×長文コンテキスト×マルチモーダルが必要なワークロード全般。

💻

コーディング・エージェント

SWE-bench Pro 62.5・DeepSWE 58.7。Claude Code / Codex / Qoder CLI と直接連携。

📄

Office・文書ワークフロー

CoWorkBench 73.9・JobBench 55.7。財務・法務・医療など専門タスク。

🔧

ツール呼出・Function Calling

Toolathlon 73.5。OpenAI互換(Chat Completions / Responses)+Anthropic互換プロトコル対応。

🖼️

マルチモーダル理解

画像・動画入力。AndroidWorld 84.5・LVBench 76.6で長尺動画・GUI操作にも強い。

🌐

ローカル自己ホスト

オープンウェイト(HF / ModelScope公開)。6B activeで省メモリ推論が可能。

🏗️

Qwen4移行の先行検証

次世代アーキテクチャ(GDN + QSA)を先行評価。将来のQwen4採用判断の材料に。

Qwen 3.8シリーズの選び方

モデル入力出力選ぶべき場面
Qwen3.8-Max$2.00$6.00最難関タスク・フラッグシップ品質
Qwen3.8-Flash ⬅$0.15$0.47コスト重視・高スループット・マルチモーダル・コーディング
Qwen3.8-27Bローカル実行向け小型denseモデル(ライセンスは公式モデルカード参照)

💡 基本戦略: 日常的なコーディング・エージェント・文書処理・マルチモーダル理解はFlashで処理し、最難関タスクのみQwen3.8-Maxへエスカレーション。

実際のコストを試算する

Qwen3.8-Flashを含む全モデルのトークンコストを一括計算。入力・出力トークン数を入れるだけ。

🧮 トークン計算機で試算する →

📊 全モデル料金比較 · 🇨🇳 中国系AI総覧 · 🗓️ リリース年表 · 🔗 QwenCloudモデルページ

⚠️ 免責事項

  • 料金はQwen公式ブログ(qwen.ai/blog)を2026-09-01に確認したものです。予告なく変動します。契約前に必ずQwenCloudの料金ページをご確認ください。
  • 価格表記は公式ブログ($0.15/$0.47)と公式X($0.16/$0.47)で差異があります。中国本土向けは人民元建て(1元/3元)。地域・契約条件により異なる場合があります。
  • 性能数値はQwen公式ブログの自己公表値であり、独立評価と差が出る場合があります。実際の使用感を保証するものではありません。
  • 本サイトは情報提供目的であり、特定プロバイダーの推薦・代理ではありません。Qwen・AlibabaはAlibaba Groupの商標です。