⚡ フロンティア性能をFlash価格で — 入力$0.075 / 出力$0.25(プロモ〜9/9)

GLM 5.3 Flash

Z.ai(智譜)のGLM-5シリーズ初のネイティブマルチモーダルモデル。320B MoE(18B active)でGLM-5.2を上回るコーディング・エージェント性能を、GLM-5.3/5.2の約1/10の価格で提供。

$0.075
入力 / 1M tokens
$0.25
出力 / 1M tokens
1M
コンテキストウィンドウ
128K
最大出力トークン

料金(プロモ50%オフ・2026-09-09まで)

Z.ai公式料金ページ(docs.z.ai)で確認。全額USD/1Mトークン。取り消し線はlist価格。

モデル入力キャッシュ入力キャッシュ保存出力備考
GLM-5.3-Flash$0.15 $0.075$0.03 $0.015期間限定無料$0.50 $0.2550%オフ。プロモは2026-09-09 24:00(UTC+8・シンガポール時間)まで
GLM-5.3$1.40$0.26期間限定無料$4.40推論モデル。Flashの約10倍の価格
GLM-5.2$1.40$0.26期間限定無料$4.40MITライセンス。Flashの前世代相当
💡 プロモ期限に注意: $0.075/$0.25は50%オフのプロモ価格で、2026-09-09 24:00(UTC+8)に終了。以降は現時点のlist価格(入力$0.15・出力$0.50)が適用される予定です。導入を検討している場合は、この期間内の比較・試算をおすすめします。
⚠️ thinkingは常時有効: GLM-5.3-Flashは thinking.typeenabled のみ(無効化不可)。推論トークンも出力として課金されるため、シンプルなタスクでもコストに注意。推奨設定は reasoning_effort: maxtemperature: 1top_p: 0.95

一次情報: docs.z.ai/guides/overview/pricing(2026-08-31確認)

モデル仕様

公開日
2026-08-26
モデルID
glm-5.3-flash
コンテキスト
1M tokens
最大出力
128K tokens
パラメータ
320B total / 18B active
入力モダリティ
テキスト + 画像 + 動画 + ファイル
出力モダリティ
テキスト
アーキテクチャ
スパース+線形Attention(ハイブリッド)
ライセンス
MIT(HuggingFace公開)
提供元
Zhipu AI(Z.ai)

出典: Z.ai: GLM-5.3-Flash · 公式ブログ · HuggingFace: zai-org/GLM-5.3-Flash

性能 — GLM-5.2を上回り、Claude Opus 4.8に接近

以下はZ.ai公式ブログ(2026-08-26)の自己公表値。独立評価と差が出る場合があります。

  • Artificial Analysis Intelligence Index v4.1.1: スコア57(プロモ価格で $0.045/タスク)。従来は約10倍のコストでしか得られなかった知能レベルと位置づけ。
  • DeepSWE v1.1: 63.4(GLM-5.2は46.2、Claude Opus 4.8は58.0、GPT-5.6 Terraは69.6、Gemini 3.7 Flashは65.3)。
  • Terminal-Bench 2.1: 84.3(Claude Opus 4.8 85.0・GPT-5.6 Terra 87.4・Gemini 3.7 Flash 85.8に迫る)。
  • AutomationBench v1.0.6: 48.8(GLM-5.2は26.2)。エージェントタスクでGLM-5.2を大幅に上回る。
  • Z.ai Code Bench v1.0: max effortで29.0(Claude Opus 4.8の29.5にほぼ並ぶ)。
  • 対GLM-5.2: 主要6ベンチマークすべてでGLM-5.2を上回る(しばしば大幅に)。
  • コスパ: GLM-5.3/5.2($1.40/$4.40)の約1/10の価格で、それらを上回る性能。

Z.aiは本モデルを「フロンティア知能はフロンティア価格を必要としない」ことを示すモデルと位置づけ。スパース+線形Attentionのハイブリッドアーキテクチャにより、GLM-5.3比でAttention計算を約3.0倍、KVキャッシュを約4.4倍削減し、長文コンテキストの推論コストを大幅に低減している。公開前は ox-alpha のコードネームでOpenCode/OpenRouterで匿名テストされ、その週の最人気モデルとなった。

出典: Z.ai公式ブログ「GLM-5.3-Flash: Frontier Intelligence, Flash Cost」(2026-08-31確認)

競合モデルとの料金比較

中国系低価格モデルとの比較。価格はUSD/1Mトークン(標準テキスト・キャッシュなし)。GLM-5.3-Flashはプロモ価格。

モデル提供元入力出力Flash比備考
GLM-5.3-FlashZhipu(Z.ai)$0.075$0.25基準。プロモ価格(〜9/9)。マルチモーダル
GPT-5.6 LunaOpenAI$0.20$1.20Flash安Flashは入力62.5%安・出力79%安。Lunaはテキスト+画像
Gemini 3.1 Flash-LiteGoogle$0.25$1.50Flash安Flashは入力70%安・出力83%安
DeepSeek V4 FlashDeepSeek$0.22–$0.44$0.66–$1.32入力・出力ともFlash安ピーク/オフピーク制。オフピークはピークの半額
MiniMax M3MiniMax$0.30$1.20Flash安「永久50%オフ」適用後(第三者調べ)
GLM-5.3 / 5.2Zhipu(Z.ai)$1.40$4.40Flash安Flashは約1/10。上位推論モデル

※ GLM-5.3-Flashの$0.075/$0.25はプロモ価格(list $0.15/$0.50・〜9/9)。DeepSeek V4 Flashは2026-08-16よりピーク/オフピーク価格制(cache miss入力 オフピーク$0.22・ピーク$0.44、出力 オフピーク$0.66・ピーク$1.32)。GPT-5.6 Lunaはテキスト入力比較。

出典: 各社公式料金ページ(2026-08-31確認)。詳細は料金比較ページを参照。GPT-5.6 Lunaの詳細はこちら →

こんな用途に最適

低コスト×長文コンテキスト×マルチモーダルが必要なワークロード全般。

💻

コーディング・エージェント

Terminal-Bench 84.3・DeepSWE 63.4。長文コードベースの自律エージェントに。

🖼️

ビジュアルコーディング

スクリーンショット・録画・URLからUI/フロントエンドを再現。自己検証ループ対応。

📄

Office・文書ワークフロー

PPTX/PDF/DOCX/XLSX生成。財務リサーチ・ドキュメント処理。

🔧

ツール呼出・エージェント

Toolathlon 78.4。Function Calling・構造化出力(JSON)対応。

🎮

3D・ゲーム開発

Blenderシーン・Godotゲームのプロトタイピング。CUA/BUAで操作検証。

🌐

ローカル自己ホスト

MITライセンス・HF公開。SGLang/vLLM/TokenSpeedで推論可能。

GLM 5.xシリーズの選び方

モデル入力出力選ぶべき場面
GLM-5.3$1.40$4.40最難関推論・最大品質が必要な場面
GLM-5.2$1.40$4.40MITライセンスでの自己ホスト・安定運用
GLM-5.3-Flash ⬅$0.075$0.25コスト重視・高スループット・マルチモーダル・コーディング

💡 基本戦略: 日常的なコーディング・エージェント・文書処理はFlashで処理し、最難関タスクのみGLM-5.3へエスカレーション。

実際のコストを試算する

GLM-5.3-Flashを含む全モデルのトークンコストを一括計算。入力・出力トークン数を入れるだけ。

🧮 トークン計算機で試算する →

📊 全モデル料金比較 · 🇨🇳 中国系AI総覧 · 🗓️ リリース年表 · 🔗 Z.ai公式料金ページ

⚠️ 免責事項

  • 料金はZ.ai公式ページ(docs.z.ai)を2026-08-31に確認したものです。予告なく変動します。特にプロモ価格は2026-09-09 24:00(UTC+8)まで。契約前に必ず公式ページをご確認ください。
  • 性能数値はZ.ai公式ブログの自己公表値であり、独立評価と差が出る場合があります。実際の使用感を保証するものではありません。
  • 本サイトは情報提供目的であり、特定プロバイダーの推薦・代理ではありません。GLM・Z.aiはZhipu AIの商標です。