MiMo-V2.6-Flash QuickSilver Pro पर
MiMo-V2.6-Flash Xiaomi के MiMo-V2.6-Pro का तेज़, कम लागत वाला sibling है — 309B-parameter mixture-of-experts, 15B active के साथ। यह 1M-token context में text और images लेता है, streaming, tools, और structured output के साथ। QuickSilver Pro $0.112 input / $0.224 output प्रति million tokens लेता है — Xiaomi की $0.14 / $0.28 list price से 20% कम, और MiMo-V2.5 के बराबर कीमत।
एक नज़र में
तेज़, कम लागत वाली open-weight coding और agents, image input और 1M-token context के साथ।
Pricing तुलना ($/1M tokens)
| Provider | Input | Output | QSP की तुलना में |
|---|---|---|---|
| QuickSilver Pro | $0.112 | $0.224 | सबसे कम कीमत |
| Xiaomi list price (Xiaomi MiMo API) | $0.14 | $0.28 | 20% कम |
कब इस्तेमाल करें
MiMo-V2.6-Flash को high-volume coding loops, tool-calling agents, extraction और classification, batch codegen, और screenshot या document की समझ के लिए इस्तेमाल करें, जहाँ लागत और latency peak reasoning से ज़्यादा मायने रखती हैं। यह MiMo-V2.5 से स्वाभाविक upgrade है: वही per-token कीमत, नई generation, और image input।
कब कोई और model चुनें
सबसे कठिन coding, multi-file refactors, और लंबी agent chains के लिए MiMo-V2.6-Pro ($0.348/$0.696) पर जाएँ, जो Artificial Analysis Intelligence Index पर शीर्ष open-weights मॉडल है। शुद्ध गणितीय reasoning के लिए DeepSeek V4 Pro। QuickSilver Pro पर MiMo-V2.6-Flash non-thinking mode में चलता है।
Quickstart (curl)
curl https://api.quicksilverpro.io/v1/chat/completions \
-H "Authorization: Bearer $QSP_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "mimo-v2.6-flash",
"messages": [{"role": "user", "content": "Hello!"}]
}'OpenAI-संगत। base_url बदलकर एक लाइन में migration।
FAQ
MiMo-V2.6-Flash Xiaomi का नई generation का तेज़ मॉडल है: 309B / 15B-active MoE जो image input जोड़ता है, QuickSilver Pro पर ठीक MiMo-V2.5 वाली कीमत ($0.112 / $0.224) पर। MiMo-V2.5 उपलब्ध बना हुआ है, इसलिए switch करना एक लाइन का model बदलाव है।
नहीं। QuickSilver Pro इसे non-thinking mode में serve करता है, इसलिए calls किसी छिपे हुए reasoning trace का bill लगाए बिना सीधा जवाब लौटाती हैं। Request में `reasoning` field देने से फ़िलहाल reasoning चालू नहीं होती।
QuickSilver Pro पर कीमत $0.112 input / $0.224 output प्रति million tokens है, और $0.00224 प्रति million cached-input tokens — Xiaomi की list price $0.14 / $0.28 ($0.0028 cached) से 20% कम, input और output दोनों पर सस्ता।
हाँ। base_url=https://api.quicksilverpro.io/v1 सेट करें, अपनी QSP key paste करें, और model="mimo-v2.6-flash" इस्तेमाल करें। Chat Completions और Responses API दोनों काम करते हैं, streaming, tool calling, json_schema strict mode, image input, और usage.cost accounting के साथ।