料金(プロモ50%オフ・2026-09-09まで)
Z.ai公式料金ページ(docs.z.ai)で確認。全額USD/1Mトークン。取り消し線はlist価格。
| モデル | 入力 | キャッシュ入力 | キャッシュ保存 | 出力 | 備考 |
|---|---|---|---|---|---|
| GLM-5.3-Flash | 期間限定無料 | 50%オフ。プロモは2026-09-09 24:00(UTC+8・シンガポール時間)まで | |||
| GLM-5.3 | $1.40 | $0.26 | 期間限定無料 | $4.40 | 推論モデル。Flashの約10倍の価格 |
| GLM-5.2 | $1.40 | $0.26 | 期間限定無料 | $4.40 | MITライセンス。Flashの前世代相当 |
thinking.type が enabled のみ(無効化不可)。推論トークンも出力として課金されるため、シンプルなタスクでもコストに注意。推奨設定は reasoning_effort: max・temperature: 1・top_p: 0.95。
一次情報: docs.z.ai/guides/overview/pricing(2026-08-31確認)
モデル仕様
出典: Z.ai: GLM-5.3-Flash · 公式ブログ · HuggingFace: zai-org/GLM-5.3-Flash
性能 — GLM-5.2を上回り、Claude Opus 4.8に接近
以下はZ.ai公式ブログ(2026-08-26)の自己公表値。独立評価と差が出る場合があります。
- Artificial Analysis Intelligence Index v4.1.1: スコア57(プロモ価格で $0.045/タスク)。従来は約10倍のコストでしか得られなかった知能レベルと位置づけ。
- DeepSWE v1.1: 63.4(GLM-5.2は46.2、Claude Opus 4.8は58.0、GPT-5.6 Terraは69.6、Gemini 3.7 Flashは65.3)。
- Terminal-Bench 2.1: 84.3(Claude Opus 4.8 85.0・GPT-5.6 Terra 87.4・Gemini 3.7 Flash 85.8に迫る)。
- AutomationBench v1.0.6: 48.8(GLM-5.2は26.2)。エージェントタスクでGLM-5.2を大幅に上回る。
- Z.ai Code Bench v1.0: max effortで29.0(Claude Opus 4.8の29.5にほぼ並ぶ)。
- 対GLM-5.2: 主要6ベンチマークすべてでGLM-5.2を上回る(しばしば大幅に)。
- コスパ: GLM-5.3/5.2($1.40/$4.40)の約1/10の価格で、それらを上回る性能。
Z.aiは本モデルを「フロンティア知能はフロンティア価格を必要としない」ことを示すモデルと位置づけ。スパース+線形Attentionのハイブリッドアーキテクチャにより、GLM-5.3比でAttention計算を約3.0倍、KVキャッシュを約4.4倍削減し、長文コンテキストの推論コストを大幅に低減している。公開前は ox-alpha のコードネームでOpenCode/OpenRouterで匿名テストされ、その週の最人気モデルとなった。
出典: Z.ai公式ブログ「GLM-5.3-Flash: Frontier Intelligence, Flash Cost」(2026-08-31確認)
競合モデルとの料金比較
中国系低価格モデルとの比較。価格はUSD/1Mトークン(標準テキスト・キャッシュなし)。GLM-5.3-Flashはプロモ価格。
| モデル | 提供元 | 入力 | 出力 | Flash比 | 備考 |
|---|---|---|---|---|---|
| GLM-5.3-Flash | Zhipu(Z.ai) | $0.075 | $0.25 | — | 基準。プロモ価格(〜9/9)。マルチモーダル |
| GPT-5.6 Luna | OpenAI | $0.20 | $1.20 | Flash安 | Flashは入力62.5%安・出力79%安。Lunaはテキスト+画像 |
| Gemini 3.1 Flash-Lite | $0.25 | $1.50 | Flash安 | Flashは入力70%安・出力83%安 | |
| DeepSeek V4 Flash | DeepSeek | $0.22–$0.44 | $0.66–$1.32 | 入力・出力ともFlash安 | ピーク/オフピーク制。オフピークはピークの半額 |
| MiniMax M3 | MiniMax | $0.30 | $1.20 | Flash安 | 「永久50%オフ」適用後(第三者調べ) |
| GLM-5.3 / 5.2 | Zhipu(Z.ai) | $1.40 | $4.40 | Flash安 | Flashは約1/10。上位推論モデル |
※ GLM-5.3-Flashの$0.075/$0.25はプロモ価格(list $0.15/$0.50・〜9/9)。DeepSeek V4 Flashは2026-08-16よりピーク/オフピーク価格制(cache miss入力 オフピーク$0.22・ピーク$0.44、出力 オフピーク$0.66・ピーク$1.32)。GPT-5.6 Lunaはテキスト入力比較。
出典: 各社公式料金ページ(2026-08-31確認)。詳細は料金比較ページを参照。GPT-5.6 Lunaの詳細はこちら →
こんな用途に最適
低コスト×長文コンテキスト×マルチモーダルが必要なワークロード全般。
コーディング・エージェント
Terminal-Bench 84.3・DeepSWE 63.4。長文コードベースの自律エージェントに。
ビジュアルコーディング
スクリーンショット・録画・URLからUI/フロントエンドを再現。自己検証ループ対応。
Office・文書ワークフロー
PPTX/PDF/DOCX/XLSX生成。財務リサーチ・ドキュメント処理。
ツール呼出・エージェント
Toolathlon 78.4。Function Calling・構造化出力(JSON)対応。
3D・ゲーム開発
Blenderシーン・Godotゲームのプロトタイピング。CUA/BUAで操作検証。
ローカル自己ホスト
MITライセンス・HF公開。SGLang/vLLM/TokenSpeedで推論可能。
GLM 5.xシリーズの選び方
| モデル | 入力 | 出力 | 選ぶべき場面 |
|---|---|---|---|
| GLM-5.3 | $1.40 | $4.40 | 最難関推論・最大品質が必要な場面 |
| GLM-5.2 | $1.40 | $4.40 | MITライセンスでの自己ホスト・安定運用 |
| GLM-5.3-Flash ⬅ | $0.075 | $0.25 | コスト重視・高スループット・マルチモーダル・コーディング |
💡 基本戦略: 日常的なコーディング・エージェント・文書処理はFlashで処理し、最難関タスクのみGLM-5.3へエスカレーション。
⚠️ 免責事項
- 料金はZ.ai公式ページ(docs.z.ai)を2026-08-31に確認したものです。予告なく変動します。特にプロモ価格は2026-09-09 24:00(UTC+8)まで。契約前に必ず公式ページをご確認ください。
- 性能数値はZ.ai公式ブログの自己公表値であり、独立評価と差が出る場合があります。実際の使用感を保証するものではありません。
- 本サイトは情報提供目的であり、特定プロバイダーの推薦・代理ではありません。GLM・Z.aiはZhipu AIの商標です。