होम/Models/Qwen3.6-35B-A3B
262K contextResponses API

Qwen3.6-35B-A3B QuickSilver Pro पर

Qwen 3.6-35B-A3B, Alibaba का MoE workhorse है — 35B params, प्रति token 3B active, 262K context window, और बेहद कम serving लागत पर मज़बूत reasoning। QuickSilver Pro पर यह $0.112 input / $0.80 output प्रति 1M tokens है, OpenRouter से ~20% कम, और जिन long-context RAG कामों के लिए यह असल में बना है उन पर GPT-4o से ~12–22× सस्ता।

प्रति 1M tokens: input $0.112 · output $0.80
लेखक:Raullen Chai·अपडेट:

एक नज़र में

Context
262K tokens
Input / 1M
$0.112
Output / 1M
$0.80
Default में सोचता है
नहीं

Long-context RAG, document summarization, reasoning के साथ कम लागत वाला MoE।

Pricing तुलना ($/1M tokens)

ProviderInputOutputQSP की तुलना में
QuickSilver Pro$0.112$0.80सबसे कम कीमत
OpenRouter (qwen/qwen3.6-35b-a3b)$0.14$1.0020% कम
OpenAI (GPT-4o)$2.50$10.0092% कम

कब इस्तेमाल करें

Qwen 3.6 लंबे दस्तावेज़ों के summarization, 100K+ token corpora पर multi-document RAG, और चीनी भाषा के उन कामों में चमकता है जहाँ इसके training data की बढ़त असली है। 3B-active MoE का मतलब है कि यह बड़े scale पर सस्ते में serve होता है; 262K context की बदौलत आप किसी Confluence space या technical spec को chunking के बिना जोड़कर दे सकते हैं।

कब कोई और model चुनें

Coding-agent workloads के लिए DeepSeek V4 Flash, HumanEval-style benchmarks पर इससे बेहतर है और सस्ता भी। Top-tier reasoning के लिए V4 Pro। QuickSilver Pro Qwen 3.6-35B को non-thinking mode में serve करता है: जवाब सीधे आते हैं, और request में `reasoning` field देने से thinking चालू नहीं होती।

Quickstart (curl)

curl https://api.quicksilverpro.io/v1/chat/completions \
  -H "Authorization: Bearer $QSP_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3.6-35b",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

OpenAI-संगत। base_url बदलकर एक लाइन में migration।

FAQ

यह 35B-param MoE है जिसमें प्रति token केवल 3B active होते हैं, इसलिए यह बड़े scale पर सस्ते में serve होता है और गणित, coding तथा long-context retrieval पर मज़बूत reasoning बनाए रखता है। 262K context window इसे multi-document RAG और लंबे दस्तावेज़ों के summarization के लिए स्वाभाविक पसंद बनाती है। QuickSilver Pro इसे non-thinking mode में serve करता है, इसलिए जवाब सीधे आते हैं, बिना reasoning trace के।

नहीं। QuickSilver Pro Qwen 3.6-35B को non-thinking mode में serve करता है, इसलिए आप thinking trace के लिए कभी भुगतान नहीं करते। Request में `reasoning` field देने से thinking चालू नहीं होती; step-by-step reasoning के लिए ऐसा मॉडल इस्तेमाल करें जो डिफ़ॉल्ट रूप से reasoning करता है, जैसे DeepSeek V4 Pro।

OpenRouter Qwen 3.6-35B-A3B को $0.14 input / $1.00 output प्रति 1M tokens पर list करता है। QuickSilver Pro $0.112 / $0.80 है — input और output दोनों पर 20% कम। वही OpenAI-compatible surface; migration सिर्फ़ base_url + key बदलना है। Model ID से `qwen/` provider prefix हटा दें।

Qwen3.6-35B-A3B को double credits के साथ आज़माएँ — $50 तक bonus credits

API Key पाएँ