GLM 5.2 QuickSilver Pro पर
GLM 5.2 Z.ai का large-scale reasoning flagship है: 1M-token context window, जो long-horizon agent workflows और project-level software engineering के लिए tune किया गया है। QuickSilver Pro पर इसकी कीमत $1.12 input / $3.52 output प्रति 1M tokens है, जो Z.ai की अपनी list price $1.40 / $4.40 (वह rate जो ज़्यादातर providers लेते हैं) से ~20% कम है। QuickSilver Pro इसे non-thinking mode में serve करता है, इसलिए जवाब सीधे आते हैं, बिना किसी reasoning trace के।
एक नज़र में
Long-horizon agents और project-level coding — Z.ai का reasoning flagship, 1M-token context window के साथ।
Pricing तुलना ($/1M tokens)
| Provider | Input | Output | QSP की तुलना में |
|---|---|---|---|
| QuickSilver Pro | $1.12 | $3.52 | सबसे कम कीमत |
| Z.ai (z-ai/glm-5.2) | $1.40 | $4.40 | 20% कम |
| OpenAI (GPT-4o) | $2.50 | $10.00 | 65% कम |
कब इस्तेमाल करें
GLM 5.2 को long-horizon agent loops और repo-scale software engineering के लिए चुनें: multi-step refactors, कई tool calls का तालमेल बिठाने वाले plan-then-act agents, और ऐसे tasks जिन्हें इसके 1M-token context में बड़ा working set रखना होता है।
कब कोई और model चुनें
Routine chat, short-context codegen, या single-shot tasks के लिए per-token कीमत और reasoning overhead ज़रूरत से ज़्यादा हैं — DeepSeek V4 Flash ($0.086/$0.173) या V4 Pro ($0.70/$2.10) इनमें से ज़्यादातर काम कम में कर देते हैं। शुद्ध गणितीय reasoning के लिए DeepSeek V4 Pro। ख़ास तौर पर agentic coding के लिए Kimi K2.7 Code के साथ A/B करें।
Quickstart (curl)
curl https://api.quicksilverpro.io/v1/chat/completions \
-H "Authorization: Bearer $QSP_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.2",
"messages": [{"role": "user", "content": "Hello!"}]
}'OpenAI-संगत। base_url बदलकर एक लाइन में migration।
FAQ
GLM 5.2 reasoning करने में सक्षम मॉडल है, लेकिन QuickSilver Pro इसे non-thinking mode में serve करता है: आपको सीधा जवाब मिलता है और किसी छिपे हुए reasoning trace का bill कभी नहीं आता। Request में `reasoning` field देने से यह चालू नहीं होती। अगर किसी task को इसी परिवार में step-by-step reasoning चाहिए, तो GLM 5.3 इस्तेमाल करें, जहाँ reasoning हमेशा चालू रहती है।
हाँ — QuickSilver Pro पर GLM 5.2 एक OpenAI-compatible chat completions endpoint है। base_url=https://api.quicksilverpro.io/v1 सेट करें, अपनी QSP key paste करें, और model="glm-5.2" इस्तेमाल करें। Streaming, tool calling, json_schema strict mode, और usage.cost accounting सब काम करते हैं।
Z.ai GLM 5.2 को $1.40 input / $4.40 output प्रति 1M tokens पर list करता है — वही rate जो ज़्यादातर providers लेते हैं; QuickSilver Pro पर यह $1.12 / $3.52 है, input और output दोनों पर ~20% कम। वही OpenAI-compatible surface; migration के लिए बस base_url और key बदलें, और model ID से `z-ai/` provider prefix हटा दें।