1M contextResponses API

GLM 5.2 QuickSilver Pro पर

GLM 5.2 Z.ai का large-scale reasoning flagship है: 1M-token context window, जो long-horizon agent workflows और project-level software engineering के लिए tune किया गया है। QuickSilver Pro पर इसकी कीमत $1.12 input / $3.52 output प्रति 1M tokens है, जो Z.ai की अपनी list price $1.40 / $4.40 (वह rate जो ज़्यादातर providers लेते हैं) से ~20% कम है। QuickSilver Pro इसे non-thinking mode में serve करता है, इसलिए जवाब सीधे आते हैं, बिना किसी reasoning trace के।

प्रति 1M tokens: input $1.12 · output $3.52
लेखक:Raullen Chai·अपडेट:

एक नज़र में

Context
1M tokens
Input / 1M
$1.12
Output / 1M
$3.52
Default में सोचता है
नहीं

Long-horizon agents और project-level coding — Z.ai का reasoning flagship, 1M-token context window के साथ।

Pricing तुलना ($/1M tokens)

ProviderInputOutputQSP की तुलना में
QuickSilver Pro$1.12$3.52सबसे कम कीमत
Z.ai (z-ai/glm-5.2)$1.40$4.4020% कम
OpenAI (GPT-4o)$2.50$10.0065% कम

कब इस्तेमाल करें

GLM 5.2 को long-horizon agent loops और repo-scale software engineering के लिए चुनें: multi-step refactors, कई tool calls का तालमेल बिठाने वाले plan-then-act agents, और ऐसे tasks जिन्हें इसके 1M-token context में बड़ा working set रखना होता है।

कब कोई और model चुनें

Routine chat, short-context codegen, या single-shot tasks के लिए per-token कीमत और reasoning overhead ज़रूरत से ज़्यादा हैं — DeepSeek V4 Flash ($0.086/$0.173) या V4 Pro ($0.70/$2.10) इनमें से ज़्यादातर काम कम में कर देते हैं। शुद्ध गणितीय reasoning के लिए DeepSeek V4 Pro। ख़ास तौर पर agentic coding के लिए Kimi K2.7 Code के साथ A/B करें।

Quickstart (curl)

curl https://api.quicksilverpro.io/v1/chat/completions \
  -H "Authorization: Bearer $QSP_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "glm-5.2",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

OpenAI-संगत। base_url बदलकर एक लाइन में migration।

FAQ

GLM 5.2 reasoning करने में सक्षम मॉडल है, लेकिन QuickSilver Pro इसे non-thinking mode में serve करता है: आपको सीधा जवाब मिलता है और किसी छिपे हुए reasoning trace का bill कभी नहीं आता। Request में `reasoning` field देने से यह चालू नहीं होती। अगर किसी task को इसी परिवार में step-by-step reasoning चाहिए, तो GLM 5.3 इस्तेमाल करें, जहाँ reasoning हमेशा चालू रहती है।

हाँ — QuickSilver Pro पर GLM 5.2 एक OpenAI-compatible chat completions endpoint है। base_url=https://api.quicksilverpro.io/v1 सेट करें, अपनी QSP key paste करें, और model="glm-5.2" इस्तेमाल करें। Streaming, tool calling, json_schema strict mode, और usage.cost accounting सब काम करते हैं।

Z.ai GLM 5.2 को $1.40 input / $4.40 output प्रति 1M tokens पर list करता है — वही rate जो ज़्यादातर providers लेते हैं; QuickSilver Pro पर यह $1.12 / $3.52 है, input और output दोनों पर ~20% कम। वही OpenAI-compatible surface; migration के लिए बस base_url और key बदलें, और model ID से `z-ai/` provider prefix हटा दें।

GLM 5.2 को double credits के साथ आज़माएँ — $50 तक bonus credits

API Key पाएँ