GLM-5.3 vs GLM-5.3-Flash

GLM-5.3 与 GLM-5.3-Flash 的逐项对比: 输入/输出单价、能力、可用端点, 数据实时取自 932.ai。两者用同一个 API Key 即可切换。

定价对比

项目GLM-5.3GLM-5.3-Flash
输入 (每 1M tokens)$0.77$0.0825
输出 (每 1M tokens)$2.42$0.275
缓存命中 显式 (每 1M tokens)$0.143$0.0165

规格

项目GLM-5.3GLM-5.3-Flash
上下文窗口1,048,5761,048,576
最大输出131,072131,072

能力对比

项目GLM-5.3GLM-5.3-Flash
function_calling支持支持
prompt_caching支持支持

怎么选

GLM-5.3 和 GLM-5.3-Flash 哪个更便宜?

输入侧 GLM-5.3-Flash 更便宜 (每百万 token $0.77 vs $0.0825);输出侧 GLM-5.3-Flash 更便宜 (每百万 token $2.42 vs $0.275)。价格均为美元。

GLM-5.3 和 GLM-5.3-Flash 的能力差别是什么?

两者都支持 function_calling, prompt_caching。

在 GLM-5.3 和 GLM-5.3-Flash 之间切换需要改代码吗?

不需要。两者都在 932.ai 上, 共用同一个 API Key 和同一个 OpenAI 兼容端点, 切换只需把请求里的 model 从 "glm-5.3" 改成 "glm-5.3-flash", 其余代码不动。

两者都在 932.ai 上, 用同一个 API Key 调用 —— 换模型只需要改请求里的 model 字段, 其余代码不用动, 所以可以按任务分别选用而不必二选一。

GLM-5.3 · GLM-5.3-Flash · 全部模型