Grok 4.7 · QuickSilver Pro
Grok 4.7 是 xAI 面向编码、agent 任务和知识工作的旗舰,接替 Grok 4.6。它为长时间运行的软件工程而构建,并会在作答前检查自己的工作。它可在 500K token 的上下文中接受文本和图像,并支持流式输出、工具和结构化输出。QuickSilver Pro 的收费是每百万 token 输入 $2.00 / 输出 $6.00 —— 即 xAI 公布的刊例价,QSP 不加价。
概览
长时间运行的 agent 式编码和知识工作,具备自我验证能力,拥有 500K token 的上下文。
价格对比($/1M token)
| 服务商 | 输入 | 输出 | 对比 QSP |
|---|---|---|---|
| QuickSilver Pro | $2.00 | $6.00 | — |
| xAI 刊例价 (Grok API) | $2.00 | $6.00 | 相同 |
适用场景
Grok 4.7 适合长时间运行的软件工程、多步 agent 循环、技术研究,以及需要模型在交付前自行验证输出的知识工作。它通过同一个 OpenAI 兼容的 QSP endpoint 同时支持 Chat Completions 和 Responses,包括流式输出、函数调用、JSON Schema 输出和图像输入。
何时该选其他模型
推理始终开启、无法关闭 —— reasoning.enabled=false 会被拒绝;请用 reasoning_effort 在深度与延迟、成本之间取舍。对于日常对话、抽取或大批量自动化,Flash 档的模型通常成本更低。提示词超过 200,000 token 时,整个请求按每百万 token 输入 $4、输出 $12 计费,所以在不需要完整的 500K 上下文时,请使用检索或提示词压缩。
快速开始(curl)
curl https://api.quicksilverpro.io/v1/chat/completions \
-H "Authorization: Bearer $QSP_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "grok-4.7",
"messages": [{"role": "user", "content": "Hello!"}]
}'兼容 OpenAI。只需改一行 base_url 即可迁移。
常见问题
对于提示词不超过 200,000 token 的请求,价格为每百万输入 token $2.00、每百万输出 token $6.00、每百万缓存输入 token $0.50。提示词超过 200,000 token 时,整个请求按每百万 token 输入 $4、输出 $12、缓存输入 $1 计费。QuickSilver Pro 与 xAI 公布的价格一致,不加价。
不可以。Grok 4.7 始终会推理,带 reasoning.enabled=false 的请求会被拒绝。可以设置 reasoning_effort 来控制它思考的深度 —— effort 越低,速度越快,消耗的输出 token 也越少。
设置 base_url=https://api.quicksilverpro.io/v1,使用你的 QSP API key,并设置 model="grok-4.7"。`/v1/chat/completions` 和 `/v1/responses` 均受支持。
Grok 4.7 是 xAI 推出的 Grok 4.6 后继版本,针对长时间运行的软件工程和自我验证调优,价格不变:每百万 token $2.00 / $6.00。两者都保留 500K token 的上下文,并支持图像输入、工具和结构化输出。Grok 4.6 仍然可用,所以切换只需改一行模型名。