GLM-5.3 与 GLM-5.3-Flash 的逐项对比: 输入/输出单价、能力、可用端点, 数据实时取自 932.ai。两者用同一个 API Key 即可切换。
| 项目 | GLM-5.3 | GLM-5.3-Flash |
|---|---|---|
| 输入 (每 1M tokens) | $0.77 | $0.0825 |
| 输出 (每 1M tokens) | $2.42 | $0.275 |
| 缓存命中 显式 (每 1M tokens) | $0.143 | $0.0165 |
| 项目 | GLM-5.3 | GLM-5.3-Flash |
|---|---|---|
| 上下文窗口 | 1,048,576 | 1,048,576 |
| 最大输出 | 131,072 | 131,072 |
| 项目 | GLM-5.3 | GLM-5.3-Flash |
|---|---|---|
| function_calling | 支持 | 支持 |
| prompt_caching | 支持 | 支持 |
输入侧 GLM-5.3-Flash 更便宜 (每百万 token $0.77 vs $0.0825);输出侧 GLM-5.3-Flash 更便宜 (每百万 token $2.42 vs $0.275)。价格均为美元。
两者都支持 function_calling, prompt_caching。
不需要。两者都在 932.ai 上, 共用同一个 API Key 和同一个 OpenAI 兼容端点, 切换只需把请求里的 model 从 "glm-5.3" 改成 "glm-5.3-flash", 其余代码不动。
两者都在 932.ai 上, 用同一个 API Key 调用 —— 换模型只需要改请求里的 model 字段, 其余代码不用动, 所以可以按任务分别选用而不必二选一。
GLM-5.3 · GLM-5.3-Flash · 全部模型