- 上下文窗口
- 1M
- 最大输出
- 128K
- 输入模态
- text
- 输出模态
- text
- 能力
- Reasoning · Tool Calling · Coding · Cache
- 上游发布
- 2026-08-26
- RouteMux 名
- zhipu/glm-5.3-flash
在线模型 Playground
直接试用 GLM-5.3 Flash
调整请求参数、查看当前费用上限,并在模型介绍页内直接看到真实结果。
streamchat
1配置输入
0 / 20,000
最高预估费用—
2实时结果
结果会显示在这里
在左侧填写输入。这里与 RouteMux 完整 Playground 共用同一条执行与计费链路。
GLM-5.3 Flash API 定价
来源: opencode_x0.15 · 核验于 2026-08-30
输入官方 $0.15 / 百万 tokens
$0.0225/ 百万 tokens省 85%
≈¥0.153 / 百万 tokens输出官方 $0.5 / 百万 tokens
$0.075/ 百万 tokens省 85%
≈¥0.51 / 百万 tokens缓存读 $0.0045/M · 缓存写 —/M
本币价按固定汇率折算(1 美元 = 6.8 CNY),汇率更新于 2026-08-02,仅供参考;计费始终以美元结算。
成本估算
预估费用$0.0003
限时首充加送 20%,最高送 200 Credits
注册后 72 小时内完成第一笔充值即可享受。满 $20 起,仅限第一笔。
注册并领取无需订阅,按用量结算。
能力亮点
ReasoningTool CallingCodingCache
接口与协议
OpenAI Chat Completions支持流式OpenAI Responses支持流式Anthropic Messages支持流式
API 调用时用任一 ID 都可以。
RouteMux 名
zhipu/glm-5.3-flash把 ROUTEMUX_KEY 占位符替换为你的 API Key。 创建 →
from openai import OpenAI
client = OpenAI(
base_url="https://api.routemux.com/v1",
api_key="<ROUTEMUX_KEY>",
)
completion = client.chat.completions.create(
model="zhipu/glm-5.3-flash",
messages=[{"role": "user", "content": "What is the meaning of life?"}],
)
print(completion.choices[0].message.content)base_url: https://api.routemux.com/v1
性能数据 (近 30 天)
GLM-5.3 Flash 常见问题
›GLM-5.3 Flash 是什么?
GLM-5.3 Flash —— GLM-5.3 的轻量版,主打速度与极低成本。
›GLM-5.3 Flash 的上下文窗口有多大?
GLM-5.3 Flash 支持最多 1M tokens 的上下文窗口,单次最多输出 128K tokens。
›GLM-5.3 Flash 的 API 价格是多少?
通过 RouteMux 调用 GLM-5.3 Flash:输入 $0.0225、输出 $0.075(USD / 1M tokens),低于官方定价。
›如何通过 API 调用 GLM-5.3 Flash?
GLM-5.3 Flash 兼容 OpenAI 接口:把 base URL 换成 RouteMux、model 填 zhipu/glm-5.3-flash 即可,无需改代码。
›GLM-5.3 Flash 支持哪些输入输出模态?
GLM-5.3 Flash 的输入模态:text;输出模态:text。
›GLM-5.3 Flash 是什么时候发布的?
GLM-5.3 Flash 发布于 2026年8月26日。