GLM 5.3 · QuickSilver Pro
GLM 5.3 是 Z.ai 最新的推理旗舰,针对复杂软件工程和长程 agent 任务调优,拥有 1M token 的上下文窗口和 131K 最大输出。在 QuickSilver Pro 上,每百万 token 输入 $1.12 / 输出 $3.52,比 Z.ai 自家刊例价低约 20%,后者为 $1.40 / $4.40。与 GLM 5.2 不同,这个 endpoint 上推理始终开启、无法关闭 —— 请改用 `reasoning_effort` 控制深度。
概览
复杂软件工程和长程 agent —— Z.ai 最新的推理旗舰,拥有 1M token 的上下文窗口。
价格对比($/1M token)
| 服务商 | 输入 | 输出 | 对比 QSP |
|---|---|---|---|
| QuickSilver Pro | $1.12 | $3.52 | 最低价 |
| Z.ai (z-ai/glm-5.3) | $1.40 | $4.40 | 低 20% |
| OpenAI (GPT-4o) | $2.50 | $10.00 | 低 65% |
适用场景
Z.ai 系列里最难的任务交给 GLM 5.3:仓库级重构、在长程任务中协调大量工具调用的「先规划后执行」型 agent,以及既需要在 1M token 上下文中容纳大型工作集、又需要单次调用输出最多 131K token 的任务。它以相同的每 token 价格接替 GLM 5.2,因此对于需要深思熟虑式推理的新项目,它是该系列的默认之选。推理始终开启;可用 `reasoning_effort` 在深度与延迟、成本之间取舍。
何时该选其他模型
这里推理是强制开启的,所以即使是简单的轮次也会消耗思考 token —— 如果你想要一个直接作答的 GLM,同价位的 GLM 5.2 是该系列中更合适的选择。对于日常对话、短上下文代码生成或单次任务,它的每 token 价格和推理开销都大材小用 —— DeepSeek V4 Flash($0.086/$0.173)或 V4 Pro($0.70/$2.10)能以更低的成本搞定其中大部分。如果你已有一套针对 GLM 5.2 调优的提示词,切换前请先做 A/B 测试 —— 价格相同,但推理轨迹和工具调用节奏不同。具体到 agent 式编码,还应与 Kimi K2.7 Code 做 A/B 对比。
快速开始(curl)
curl https://api.quicksilverpro.io/v1/chat/completions \
-H "Authorization: Bearer $QSP_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.3",
"messages": [{"role": "user", "content": "Hello!"}]
}'兼容 OpenAI。只需改一行 base_url 即可迁移。
常见问题
推理始终开启 —— 在这个 endpoint 上推理是强制的,无法关闭(试图关闭推理的请求会被上游拒绝)。可以用 `reasoning_effort` 在深度与延迟、成本之间取舍。推理 token 按输出 token 计费,并会先于可见回答从你的 `max_tokens` 预算中扣除,所以 `max_tokens` 要设得宽裕一些,否则回复可能被截断。如果你想要一个不是始终思考的 GLM,请使用 GLM 5.2 —— 价格相同,默认直接作答。
GLM 5.3 是 Z.ai 的后继版本(2026-08-18 发布),在复杂软件工程和长程 agent 任务上表现更好,上下文窗口同为 1M token,并明确给出 131K 的最大输出上限。有一处行为差异值得注意:GLM 5.3 的推理是强制的、无法关闭,而 GLM 5.2 默认直接作答。两者定价完全相同,都是每百万 token 输入 $1.12 / 输出 $3.52,所以升级只需换一个模型 ID —— 记得为始终开启的思考多预留一些输出 token。
可以 —— GLM 5.3 在 QuickSilver Pro 上是一个 OpenAI 兼容的 chat completions endpoint(Responses API 同样可用)。设置 base_url=https://api.quicksilverpro.io/v1,填入你的 QSP key,并使用 model="glm-5.3"。流式输出、工具调用(`tool_choice: "auto"` —— 这个 endpoint 不接受强制指定某个函数)和 usage.cost 统计都可用。`response_format: json_schema` 在这个 endpoint 上暂不强制生效;如果需要严格的结构化输出,请使用 GLM 5.2。
Z.ai 对 GLM 5.3 的标价是每百万 token 输入 $1.40 / 输出 $4.40;QuickSilver Pro 是 $1.12 / $3.52,输入输出两端都低约 20%。同样的 OpenAI 兼容接口;迁移只需更换 base_url 和 key,并去掉模型 ID 中的 `z-ai/` 提供商前缀。