首页/模型/MiMo-V2.6-Flash
1M 上下文多模态Responses API

MiMo-V2.6-Flash · QuickSilver Pro

MiMo-V2.6-Flash 是 Xiaomi MiMo-V2.6-Pro 的高速低价版本 —— 309B 参数的 mixture-of-experts,激活参数 15B。它可在 1M token 的上下文中接受文本和图像,并支持流式输出、工具和结构化输出。QuickSilver Pro 的收费是每百万 token 输入 $0.112 / 输出 $0.224 —— 比 Xiaomi 的刊例价 $0.14 / $0.28 低 20%,与 MiMo-V2.5 同价。

每 1M token:输入 $0.112 · 输出 $0.224
作者Raullen Chai·更新于

概览

上下文
1M token
输入 / 1M
$0.112
输出 / 1M
$0.224
默认思考
否

快速、低成本的开放权重编码与 agent 模型,支持图像输入,拥有 1M token 的上下文。

价格对比($/1M token)

服务商输入输出对比 QSP
QuickSilver Pro$0.112$0.224最低价
Xiaomi 刊例价 (Xiaomi MiMo API)$0.14$0.28低 20%

适用场景

MiMo-V2.6-Flash 适合大批量编码循环、工具调用 agent、抽取和分类、批量代码生成,以及成本和延迟比峰值推理能力更重要的截图或文档理解。它是 MiMo-V2.5 顺理成章的升级:每 token 价格相同,代际更新,还支持图像输入。

何时该选其他模型

对于最难的编码、多文件重构和长 agent 链路,请升级到 MiMo-V2.6-Pro($0.348/$0.696),它是 Artificial Analysis Intelligence Index 上排名第一的开放权重模型。纯数学推理选 DeepSeek V4 Pro。MiMo-V2.6-Flash 在 QuickSilver Pro 上以非思考模式运行。

快速开始(curl)

curl https://api.quicksilverpro.io/v1/chat/completions \
  -H "Authorization: Bearer $QSP_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "mimo-v2.6-flash",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

兼容 OpenAI。只需改一行 base_url 即可迁移。

常见问题

MiMo-V2.6-Flash 是 Xiaomi 更新一代的高速模型:一个 309B / 15B 激活的 MoE,新增了图像输入,在 QuickSilver Pro 上的价格与 MiMo-V2.5 完全相同($0.112 / $0.224)。MiMo-V2.5 仍然可用,所以切换只需改一行模型名。

不会。QuickSilver Pro 以非思考模式提供它,所以调用会返回直接的回答,不会为隐藏的推理轨迹计费。目前,请求中带 `reasoning` 字段也不会开启推理。

QuickSilver Pro 的价格是每百万 token 输入 $0.112 / 输出 $0.224,每百万缓存输入 token $0.00224 —— 比 Xiaomi 的刊例价 $0.14 / $0.28(缓存 $0.0028)低 20%,输入输出两端都更低。

可以。设置 base_url=https://api.quicksilverpro.io/v1,填入你的 QSP key,并使用 model="mimo-v2.6-flash"。Chat Completions 和 Responses API 都可用,并支持流式输出、工具调用、json_schema strict mode、图像输入和 usage.cost 统计。

充值翻倍试用 MiMo-V2.6-Flash —— 最高赠送 $50 额度

获取 API Key