GLM-5.3-Flashは、Z.aiの効率重視のネイティブマルチモーダルモデルです。約100万トークンのコンテキストウィンドウをサポートし、テキスト、画像、動画の入力を受け付け、コーディングエージェント、複雑な推論、長期的なソフトウェアエンジニアリングを対象としています。多くの反復で大量のトークンを消費するワークロードにおいては、アクセス料金のわずかな違いでもすぐに累積する可能性があります。
2026年9月1日現在、公式Z.ai APIとOpenRouterのZ.aiルートの両方で、GLM-5.3-Flashは100万入力トークンあたり$0.075、100万出力トークンあたり$0.25、100万キャッシュ入力トークンあたり$0.015と記載されています。OpenRouterの従量課金プランは5.5%のプラットフォーム手数料も課金されます。同じプロモーション期間中に、AIHubMix GLM-5.3-Flashは100万入力トークンあたり$0.056、100万出力トークンあたり$0.197、100万キャッシュ入力トークンあたり$0.014と記載されています。
3つのオプションすべてが同じモデルへのアクセスを提供しますが、価格、ルーティングの挙動、プラットフォームの機能は同一ではありません。
GLM-5.3-Flashの価格比較
| アクセスオプション | 入力 / 1Mトークン | 出力 / 1Mトークン | キャッシュ読み取り / 1Mトークン | プラットフォーム手数料 | 割引前価格 (入力 / 出力 / キャッシュ) | ポジショニング |
|---|---|---|---|---|---|---|
| Z.ai公式API | $0.075 | $0.250 | $0.015 | 記載なし | $0.150 / $0.500 / $0.030 | 直接公式API |
| OpenRouter (Z.aiプロバイダー) | $0.075 | $0.250 | $0.015 | 5.5% | $0.150 / $0.500 / $0.030 | 複数プロバイダーのルーティングを持つ統一API |
| AIHubMix GLM-5.3-Flash | $0.056 | $0.197 | $0.014 | 記載なし | $0.113 / $0.394 / $0.028 | 複数プロバイダーのフォールバックを持つ低価格 |
上記のすべての価格は、公開されている価格ページに合わせて丸められた100万トークンあたりの表示料金です。AIHubMix、OpenRouter、Z.aiの期間限定50%プロモーションはすべて2026年9月9日16:00 UTC(9月10日00:00 UTC+8)に終了します。
OpenRouterの5.5%プラットフォーム手数料
OpenRouterの価格ページには、従量課金アカウントに対して5.5%のプラットフォーム手数料が記載されています。OpenRouterはまた、モデルカタログに表示されているプロバイダーの価格をマークアップしないと述べています。言い換えれば、$0.075 / $0.25は記載されたモデル推論価格のままですが、プラットフォーム手数料はクレジットの総支払額に含める必要があります。
5.5%の手数料がモデル使用に比例して割り当てられ、購入したクレジットがすべて使用された場合、Z.aiルートのOpenRouterの実質コストはおおよそ次の通りです:
- 入力: $0.0791 per million tokens
- 出力: $0.2638 per million tokens
- キャッシュ読み取り: $0.0158 per million tokens
異なるキャッシュ比率でのコスト例
Z.aiのコンテキストキャッシングドキュメントによると、繰り返しのシステムプロンプト、会話履歴、その他の共有コンテキストは手動設定なしで自動的に検出され、キャッシュされることができます。キャッシュから提供されるトークンは、標準の入力料金ではなくキャッシュ読み取り料金で請求されます。
すべてのワークロードを表す単一のキャッシュ比率はありません:
- 一度きりのリクエストや、毎回まったく異なる入力を持つタスクは、キャッシュ比率が0%に近い場合があります。
- 固定のシステムプロンプトを再利用するバッチジョブは、意味のある高いキャッシュ比率を達成できます。
- マルチターンのコーディングエージェントは、システムの指示、コードのコンテキスト、会話履歴を繰り返し持ちます。後のリクエストは高いキャッシュ比率を持つかもしれませんが、コンテンツの変更、フォーマットの違い、キャッシュの有効期限がそれを減少させる可能性があります。
価格差を明確にするために、以下の例では合計100万入力トークンと100万出力トークンを仮定し、両プラットフォームで同じキャッシュ比率を使用します。OpenRouterの合計には5.5%のプラットフォーム手数料が含まれています。
| 入力キャッシュ比率 | AIHubMix | OpenRouterモデルコスト | OpenRouterプラットフォーム手数料込み | AIHubMixのOpenRouter合計に対する節約 |
|---|---|---|---|---|
| 0% (コールドリクエスト) | $0.253 | $0.325 | $0.343 | 26.2% |
| 50% | $0.232 | $0.295 | $0.311 | 25.5% |
| 80% (非常に繰り返しのあるコンテキスト) | $0.219 | $0.277 | $0.292 | 24.9% |
計算式は次の通りです:標準入力トークン x 入力料金 + キャッシュトークン x キャッシュ読み取り料金 + 出力トークン x 出力料金。例えば、80%のキャッシュ比率では、合計100万入力トークンが20万標準入力トークンと80万キャッシュ入力トークンに分割されます。
高いキャッシュ比率は、両プラットフォームの総コストを削減します。キャッシュ読み取り料金の差が標準入力および出力料金の差よりも小さいため、キャッシュ比率が上がるにつれてAIHubMixの相対的な節約はわずかに狭まります。これらの例では、節約は約24.9%から26.2%の範囲に留まります。
なぜ最も低いトークン価格が唯一の要因ではないのか
現在のトークン料金だけを見ると、AIHubMixは3つのアクセスオプションの中で最も安価です。生産決定は、ルーティングの挙動やプラットフォームの機能も考慮する必要があります。
Z.aiの公式APIは、直接ベンダー統合を好み、中間層を最小限に抑えたいチームに自然に適しています。
OpenRouterは、統一APIと広範なマルチプロバイダーエコシステムを提供します。リクエストがZ.aiに固定されている場合、そのカタログ料金はZ.aiの公式価格と一致しますが、従量課金ユーザーは5.5%のプラットフォーム手数料も支払います。OpenRouterが他のプロバイダーを自動的に選択することが許可されている場合、モデル価格、レイテンシ、キャッシュ読み取り料金は選択されたルートによって異なる場合があります。
AIHubMixは、現在、低い入力および出力価格をプロバイダーの監視とフォールバックと組み合わせて提供しています。これは、コストに敏感なコーディングエージェント、バッチ処理、その他の高トークンワークロードに特に役立ちます。
実用的なポイント
2026年9月1日現在、Z.aiの公式APIとOpenRouterのZ.aiルートは同じカタログ料金を持っています:100万入力トークンあたり$0.075、100万出力トークンあたり$0.25。OpenRouterの従量課金プランには5.5%のプラットフォーム手数料もかかります。AIHubMixは現在、100万入力トークンあたり$0.056、100万出力トークンあたり$0.197を請求しています。上記の0%から80%の入力キャッシュシナリオでは、AIHubMixはプラットフォーム手数料を含めた後、OpenRouterよりも約24.9%から26.2%安価です。
コーディング、評価、エージェントワークフローのためにGLM-5.3-Flashのトークンコストを削減することが主な目標である場合、AIHubMix GLM-5.3-Flashが現在の低コストオプションです。OpenRouterは、統一されたマルチプロバイダーエンドポイントと柔軟なルーティングがより重要な場合に価値がありますが、Z.aiの公式APIは直接のベンダールートです。
価格、プロモーション、プロバイダーの可用性は変更される可能性があります。長期間のワークロードをコミットする前に、リンクされた価格ページを確認してください。




