होम/Models/MiMo-V2.6-Flash
1M contextMultimodalResponses API

MiMo-V2.6-Flash QuickSilver Pro पर

MiMo-V2.6-Flash Xiaomi के MiMo-V2.6-Pro का तेज़, कम लागत वाला sibling है — 309B-parameter mixture-of-experts, 15B active के साथ। यह 1M-token context में text और images लेता है, streaming, tools, और structured output के साथ। QuickSilver Pro $0.112 input / $0.224 output प्रति million tokens लेता है — Xiaomi की $0.14 / $0.28 list price से 20% कम, और MiMo-V2.5 के बराबर कीमत।

प्रति 1M tokens: input $0.112 · output $0.224
लेखक:Raullen Chai·अपडेट:

एक नज़र में

Context
1M tokens
Input / 1M
$0.112
Output / 1M
$0.224
Default में सोचता है
नहीं

तेज़, कम लागत वाली open-weight coding और agents, image input और 1M-token context के साथ।

Pricing तुलना ($/1M tokens)

ProviderInputOutputQSP की तुलना में
QuickSilver Pro$0.112$0.224सबसे कम कीमत
Xiaomi list price (Xiaomi MiMo API)$0.14$0.2820% कम

कब इस्तेमाल करें

MiMo-V2.6-Flash को high-volume coding loops, tool-calling agents, extraction और classification, batch codegen, और screenshot या document की समझ के लिए इस्तेमाल करें, जहाँ लागत और latency peak reasoning से ज़्यादा मायने रखती हैं। यह MiMo-V2.5 से स्वाभाविक upgrade है: वही per-token कीमत, नई generation, और image input।

कब कोई और model चुनें

सबसे कठिन coding, multi-file refactors, और लंबी agent chains के लिए MiMo-V2.6-Pro ($0.348/$0.696) पर जाएँ, जो Artificial Analysis Intelligence Index पर शीर्ष open-weights मॉडल है। शुद्ध गणितीय reasoning के लिए DeepSeek V4 Pro। QuickSilver Pro पर MiMo-V2.6-Flash non-thinking mode में चलता है।

Quickstart (curl)

curl https://api.quicksilverpro.io/v1/chat/completions \
  -H "Authorization: Bearer $QSP_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "mimo-v2.6-flash",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

OpenAI-संगत। base_url बदलकर एक लाइन में migration।

FAQ

MiMo-V2.6-Flash Xiaomi का नई generation का तेज़ मॉडल है: 309B / 15B-active MoE जो image input जोड़ता है, QuickSilver Pro पर ठीक MiMo-V2.5 वाली कीमत ($0.112 / $0.224) पर। MiMo-V2.5 उपलब्ध बना हुआ है, इसलिए switch करना एक लाइन का model बदलाव है।

नहीं। QuickSilver Pro इसे non-thinking mode में serve करता है, इसलिए calls किसी छिपे हुए reasoning trace का bill लगाए बिना सीधा जवाब लौटाती हैं। Request में `reasoning` field देने से फ़िलहाल reasoning चालू नहीं होती।

QuickSilver Pro पर कीमत $0.112 input / $0.224 output प्रति million tokens है, और $0.00224 प्रति million cached-input tokens — Xiaomi की list price $0.14 / $0.28 ($0.0028 cached) से 20% कम, input और output दोनों पर सस्ता।

हाँ। base_url=https://api.quicksilverpro.io/v1 सेट करें, अपनी QSP key paste करें, और model="mimo-v2.6-flash" इस्तेमाल करें। Chat Completions और Responses API दोनों काम करते हैं, streaming, tool calling, json_schema strict mode, image input, और usage.cost accounting के साथ।

MiMo-V2.6-Flash को double credits के साथ आज़माएँ — $50 तक bonus credits

API Key पाएँ