MiMo-V2.6-Flash · QuickSilver Pro
MiMo-V2.6-Flash 是 Xiaomi MiMo-V2.6-Pro 的高速低价版本 —— 309B 参数的 mixture-of-experts,激活参数 15B。它可在 1M token 的上下文中接受文本和图像,并支持流式输出、工具和结构化输出。QuickSilver Pro 的收费是每百万 token 输入 $0.112 / 输出 $0.224 —— 比 Xiaomi 的刊例价 $0.14 / $0.28 低 20%,与 MiMo-V2.5 同价。
概览
快速、低成本的开放权重编码与 agent 模型,支持图像输入,拥有 1M token 的上下文。
价格对比($/1M token)
| 服务商 | 输入 | 输出 | 对比 QSP |
|---|---|---|---|
| QuickSilver Pro | $0.112 | $0.224 | 最低价 |
| Xiaomi 刊例价 (Xiaomi MiMo API) | $0.14 | $0.28 | 低 20% |
适用场景
MiMo-V2.6-Flash 适合大批量编码循环、工具调用 agent、抽取和分类、批量代码生成,以及成本和延迟比峰值推理能力更重要的截图或文档理解。它是 MiMo-V2.5 顺理成章的升级:每 token 价格相同,代际更新,还支持图像输入。
何时该选其他模型
对于最难的编码、多文件重构和长 agent 链路,请升级到 MiMo-V2.6-Pro($0.348/$0.696),它是 Artificial Analysis Intelligence Index 上排名第一的开放权重模型。纯数学推理选 DeepSeek V4 Pro。MiMo-V2.6-Flash 在 QuickSilver Pro 上以非思考模式运行。
快速开始(curl)
curl https://api.quicksilverpro.io/v1/chat/completions \
-H "Authorization: Bearer $QSP_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "mimo-v2.6-flash",
"messages": [{"role": "user", "content": "Hello!"}]
}'兼容 OpenAI。只需改一行 base_url 即可迁移。
常见问题
MiMo-V2.6-Flash 是 Xiaomi 更新一代的高速模型:一个 309B / 15B 激活的 MoE,新增了图像输入,在 QuickSilver Pro 上的价格与 MiMo-V2.5 完全相同($0.112 / $0.224)。MiMo-V2.5 仍然可用,所以切换只需改一行模型名。
不会。QuickSilver Pro 以非思考模式提供它,所以调用会返回直接的回答,不会为隐藏的推理轨迹计费。目前,请求中带 `reasoning` 字段也不会开启推理。
QuickSilver Pro 的价格是每百万 token 输入 $0.112 / 输出 $0.224,每百万缓存输入 token $0.00224 —— 比 Xiaomi 的刊例价 $0.14 / $0.28(缓存 $0.0028)低 20%,输入输出两端都更低。
可以。设置 base_url=https://api.quicksilverpro.io/v1,填入你的 QSP key,并使用 model="mimo-v2.6-flash"。Chat Completions 和 Responses API 都可用,并支持流式输出、工具调用、json_schema strict mode、图像输入和 usage.cost 统计。