होम/Models/Qwen3.6 Plus
1M contextResponses API

Qwen3.6 Plus QuickSilver Pro पर

Qwen 3.6 Plus, Alibaba का 1-trillion-parameter MoE flagship है — आकार में 3.6-35B और 3.7 Max के बीच, 1M context के साथ। QuickSilver Pro पर यह $0.26 input / $1.56 output प्रति 1M tokens है, OpenRouter से ~20% कम और output पर GPT-4o से ~10× सस्ता। उन teams के लिए sweet spot जिन्हें 3.5/3.6-35B जैसी price economics चाहिए, लेकिन ज़्यादा reasoning depth और million-token context के साथ।

प्रति 1M tokens: input $0.26 · output $1.56
लेखक:Raullen Chai·अपडेट:

एक नज़र में

Context
1M tokens
Input / 1M
$0.26
Output / 1M
$1.56
Default में सोचता है
नहीं

Production reasoning + long-context RAG, GPT-4o से 10× कम output लागत पर।

Pricing तुलना ($/1M tokens)

ProviderInputOutputQSP की तुलना में
QuickSilver Pro$0.26$1.56सबसे कम कीमत
OpenRouter (qwen/qwen3.6-plus)$0.325$1.9520% कम
OpenAI (GPT-4o)$2.50$10.0084% कम

कब इस्तेमाल करें

3.6 Plus production-default की जगह पर बैठता है: 3.6-35B से इतना छोटा कदम कि इसे छोड़ा नहीं जा सकता, और reasoning-heavy workloads के लिए इतना सस्ता कि इसे अनदेखा नहीं किया जा सकता। इसे 100K+ tokens पर multi-document RAG, ऐसी customer-facing chat जहाँ आपको 3.7 Max की कीमत के बिना 3.6-35B से साफ़ तौर पर बेहतर जवाब चाहिए, ऐसे agentic workflows जहाँ thinking की per-call latency penalty स्वीकार्य है, और चीनी भाषा के उन कामों के लिए इस्तेमाल करें जहाँ Qwen के training data की बढ़त और बढ़ जाती है।

कब कोई और model चुनें

Deterministic, बिना thinking वाली production chat के लिए, जहाँ token budgets कसे रखने हों, `reasoning.enabled=false` के साथ DeepSeek V4 Flash ($0.086/$0.173) सस्ता non-thinking विकल्प है। Frontier-level reasoning के लिए, जिसमें 3.6 Plus आपके eval पर साफ़ तौर पर विफल होता है, 3.7 Max या V4 Pro पर जाएँ। QuickSilver Pro 3.6 Plus को non-thinking mode में serve करता है: जवाब सीधे आते हैं, और request में `reasoning` field देने से thinking चालू नहीं होती।

Quickstart (curl)

curl https://api.quicksilverpro.io/v1/chat/completions \
  -H "Authorization: Bearer $QSP_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3.6-plus",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

OpenAI-संगत। base_url बदलकर एक लाइन में migration।

FAQ

3.6-35B compact MoE tier है (35B params, 3B active, 262K context, $0.112/$0.80 प्रति 1M tokens)। 3.6 Plus उससे अगला कदम है — 1T-parameter MoE, 1M context, $0.26/$1.56 प्रति 1M tokens। कीमत का अंतर अच्छा-ख़ासा है, लेकिन जहाँ 3.6-35B अपनी सीमा पर पहुँच जाता है वहाँ जवाब की बेहतर गुणवत्ता और चौड़ा context इसे जायज़ ठहराते हैं।

हाँ — Qwen family में 3.6 Plus production-default है और 3.7 Max flagship। कीमत का अनुपात ~7-8× है (3.6 Plus $0.26/$1.56 बनाम 3.7 Max $2.0/$6.0)। ज़्यादातर teams को 3.6 Plus से शुरू करना चाहिए और 3.7 Max को requests के उस हिस्से पर A/B करना चाहिए जहाँ 3.6 Plus के जवाब साफ़ तौर पर कमज़ोर पड़ते हैं। दोनों का 1M context और OpenAI-compatible surface एक जैसा है, इसलिए बदलना सिर्फ़ model ID का बदलाव है।

OpenRouter Qwen 3.6 Plus को $0.325 input / $1.95 output प्रति 1M tokens पर list करता है। QuickSilver Pro $0.26 / $1.56 है — input और output दोनों पर ~20% कम। वही OpenAI-compatible surface; migration सिर्फ़ base_url + key बदलना है (model ID से `qwen/` provider prefix हटा दें)।

Qwen3.6 Plus को double credits के साथ आज़माएँ — $50 तक bonus credits

API Key पाएँ