GLM-5.3-Flash 是 Z.ai 专注于效率的原生多模态模型。它支持大约一百万个标记的上下文窗口,接受文本、图像和视频输入,目标是编码代理、复杂推理和长周期软件工程。对于在多个迭代中消耗大量标记的工作负载,即使是访问定价上的小差异也会迅速累积。
截至 2026年9月1日,官方 Z.ai API 和 OpenRouter 上的 Z.ai 路由 均将 GLM-5.3-Flash 列为 每百万输入标记 $0.075,每百万输出标记 $0.25,以及每百万缓存输入标记 $0.015。OpenRouter 的按需付费计划还收取 5.5% 的平台费用。在同一促销期间,AIHubMix GLM-5.3-Flash 的定价为 每百万输入标记 $0.056,每百万输出标记 $0.197,以及每百万缓存输入标记 $0.014。
这三种选择都提供对同一模型的访问,但它们的定价、路由行为和平台特性并不相同。
GLM-5.3-Flash 定价比较
| 访问选项 | 输入 / 1M 标记 | 输出 / 1M 标记 | 缓存读取 / 1M 标记 | 平台费用 | 折扣前价格 (输入 / 输出 / 缓存) | 定位 |
|---|---|---|---|---|---|---|
| Z.ai 官方 API | $0.075 | $0.250 | $0.015 | 未列出 | $0.150 / $0.500 / $0.030 | 直接官方 API |
| OpenRouter (Z.ai 提供商) | $0.075 | $0.250 | $0.015 | 5.5% | $0.150 / $0.500 / $0.030 | 统一 API 和多提供商路由 |
| AIHubMix GLM-5.3-Flash | $0.056 | $0.197 | $0.014 | 未列出 | $0.113 / $0.394 / $0.028 | 较低的当前费率与多提供商后备 |
以上所有价格均为每百万标记的显示费率,已四舍五入以匹配公开定价页面。AIHubMix、OpenRouter 和 Z.ai 的限时 50% 促销均于 2026年9月9日16:00 UTC(9月10日00:00 UTC+8)结束。
OpenRouter 的 5.5% 平台费用
OpenRouter 定价页面 列出了按需付费账户的 5.5% 平台费用。OpenRouter 还表示,它不会提高其模型目录中显示的提供商价格。换句话说,$0.075 / $0.25 仍然是列出的模型推理价格,但平台费用仍需包含在支付的总金额中。
如果将 5.5% 的费用按比例分配到模型使用上,并且所有购买的积分都被使用,那么 Z.ai 路由的有效 OpenRouter 成本大约为:
- 输入:$0.0791 每百万标记
- 输出:$0.2638 每百万标记
- 缓存读取:$0.0158 每百万标记
不同缓存比率的成本示例
根据 Z.ai 的上下文缓存文档,重复的系统提示、对话历史和其他共享上下文可以自动检测和缓存,无需手动配置。从缓存提供的标记按缓存读取费率计费,而不是标准输入费率。
没有单一的缓存比率可以代表每个工作负载:
- 一次性请求或每次输入完全不同的任务,可能具有接近 0% 的缓存比率。
- 重用固定系统提示的批处理作业可以实现显著更高的缓存比率。
- 多轮编码代理重复携带系统指令、代码上下文和对话历史。它们后续的请求可能具有较高的缓存比率,尽管内容变化、格式差异和缓存过期可能会降低它。
为了隔离定价差异,以下示例假设 一百万个总输入标记和一百万个输出标记,并且两个平台上的缓存比率相同。OpenRouter 的总费用包括其 5.5% 的平台费用。
| 输入缓存比率 | AIHubMix | OpenRouter 模型成本 | OpenRouter 包括平台费用 | AIHubMix 相较于 OpenRouter 总费用的节省 |
|---|---|---|---|---|
| 0% (冷请求) | $0.253 | $0.325 | $0.343 | 26.2% |
| 50% | $0.232 | $0.295 | $0.311 | 25.5% |
| 80% (高度重复的上下文) | $0.219 | $0.277 | $0.292 | 24.9% |
计算公式为:标准输入标记 x 输入费率 + 缓存标记 x 缓存读取费率 + 输出标记 x 输出费率。例如,在 80% 的缓存比率下,一百万个总输入标记被分为 200,000 个标准输入标记和 800,000 个缓存输入标记。
更高的缓存比率会降低两个平台的总成本。由于它们的缓存读取费率之间的差异小于标准输入和输出费率之间的差异,AIHubMix 的相对节省在缓存比率上升时略微缩小。在这些示例中,节省大约保持在 24.9% 到 26.2%。
为什么最低的标记价格不是唯一因素
仅从当前的标记费率来看,AIHubMix 是三种访问选项中最便宜的。生产决策仍应考虑路由行为和平台能力。
Z.ai 的官方 API 非常适合那些希望直接与供应商集成并希望最小化中介层的团队。
OpenRouter 提供统一的 API 和广泛的多提供商生态系统。当请求固定在 Z.ai 时,其目录费率与 Z.ai 的官方定价相匹配,但按需付费用户还需支付 5.5% 的平台费用。如果允许 OpenRouter 自动选择其他提供商,则模型价格、延迟和缓存读取费率可能会随所选路由而变化。
AIHubMix 目前结合了较低的输入和输出价格,并在上游提供商失败或响应过慢时提供监控和后备。这种组合对于对成本敏感的编码代理、批处理和其他高标记工作负载特别有用。
实际收获
截至 2026 年 9 月 1 日,Z.ai 的官方 API 和 OpenRouter 的 Z.ai 路由具有相同的目录费率:每百万输入标记 $0.075 和每百万输出标记 $0.25。OpenRouter 的按需付费还需支付 5.5% 的平台费用。AIHubMix 目前收取 每百万输入标记 $0.056 和每百万输出标记 $0.197。在上述 0% 到 80% 的输入缓存场景中,AIHubMix 的成本大约比 OpenRouter 低 24.9% 到 26.2%,包括平台费用。
如果主要目标是降低 GLM-5.3-Flash 的编码、评估和代理工作流的标记成本,AIHubMix GLM-5.3-Flash 目前是较低成本的选项。当统一的多提供商端点和灵活的路由更重要时,OpenRouter 仍然具有价值,而 Z.ai 的官方 API 是直接的供应商路线。
定价、促销和提供商可用性可能会变化。在承诺长期工作负载之前,请检查链接的定价页面。




