MiMo-V2.6-Pro · QuickSilver Pro
MiMo-V2.6-Pro 是 Xiaomi 的旗舰开放权重模型 —— 1.02T 参数的 mixture-of-experts,激活参数 42B —— 也是 Artificial Analysis Intelligence Index v4.3 上排名第一的开放权重模型,得分 46(MiMo-V2.5-Pro 得分 26)。它可在 1M token 的上下文中接受文本和图像,并支持流式输出、工具和结构化输出。QuickSilver Pro 的收费是每百万 token 输入 $0.348 / 输出 $0.696 —— 输入输出两端都比 Xiaomi 的刊例价 $0.435 / $0.87 低 20%。
概览
最强的开放权重编码与 agent 模型,支持图像输入,拥有 1M token 的上下文。
价格对比($/1M token)
| 服务商 | 输入 | 输出 | 对比 QSP |
|---|---|---|---|
| QuickSilver Pro | $0.348 | $0.696 | 最低价 |
| Xiaomi 刊例价 (Xiaomi MiMo API) | $0.435 | $0.87 | 低 20% |
适用场景
想以远低于闭源模型的价格,从开放权重模型获得前沿级的编码和 agent 表现时,选 MiMo-V2.6-Pro:多步工具调用 agent、仓库级代码生成与审查、基于 1M token 工作集的长文档处理,以及截图或图表理解。在 Artificial Analysis 上,它位于「智能水平 vs 单任务成本」的帕累托前沿,因此当你追求每一美元换来的质量时,它是很好的默认选择。
何时该选其他模型
对于大批量、对延迟敏感、用不上旗舰的流量,MiMo-V2.6-Flash($0.112/$0.224)的价格大约只有三分之一。对于最难的推理和长程 agent 工作,Claude Opus 5 或 GPT-6 Astra 这样的闭源前沿模型得分仍然更高 —— 但每 token 价格要高出许多倍。在 QuickSilver Pro 上它以非思考模式运行,输出因此简短且便宜。
快速开始(curl)
curl https://api.quicksilverpro.io/v1/chat/completions \
-H "Authorization: Bearer $QSP_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "mimo-v2.6-pro",
"messages": [{"role": "user", "content": "Hello!"}]
}'兼容 OpenAI。只需改一行 base_url 即可迁移。
常见问题
每百万输入 token $0.348,每百万输出 token $0.696,每百万缓存输入 token $0.00288。这比 Xiaomi 的刊例价输入 $0.435 / 输出 $0.87(缓存 $0.0036)低 20% —— 输入和输出都更低,所以对输出占比高的编码 agent 同样省钱。
它是一个具备推理能力的模型,但 QuickSilver Pro 以非思考模式提供它:推理处于关闭状态,所以调用会返回直接的回答,不会为隐藏的推理轨迹计费。目前,请求中带 `reasoning` 字段也不会重新开启推理。如果某个任务需要逐步推理,请使用默认会推理的模型,例如 Kimi K3 或 DeepSeek V4 Pro。
在 Artificial Analysis Intelligence Index v4.3 上它得分 46,在发布时(2026-09-21)是所有开放权重模型中最高的,远超 MiMo-V2.5-Pro 的 26。它也位于 AA 的「智能水平 vs 单任务成本」帕累托前沿。和往常一样,在切换生产流量之前,请先用你自己的评测跑一遍。
设置 base_url=https://api.quicksilverpro.io/v1,使用你的 QSP API key,并设置 model="mimo-v2.6-pro"。`/v1/chat/completions` 和 `/v1/responses` 均受支持,同时支持流式输出、工具调用、json_schema strict mode、图像输入和 usage.cost 统计。