DeepSeek V4 Flash QuickSilver Pro पर
DeepSeek V4 Flash 0731 आधिकारिक public-beta agent मॉडल है: 1M-token context, बेहतर coding और tool use, और Codex के लिए अनुकूलित native Responses API। QuickSilver Pro आधिकारिक DeepSeek build को FP8 या उससे बेहतर precision पर $0.086 / $0.173 प्रति million tokens में serve करता है।
एक नज़र में
Codex, agentic coding, tool use और long-context automation।
Pricing तुलना ($/1M tokens)
| Provider | Input | Output | QSP की तुलना में |
|---|---|---|---|
| QuickSilver Pro | $0.086 | $0.173 | — |
| OpenRouter (deepseek/deepseek-v4-flash-0731) | $0.0785 | $0.1571 | 10% महँगा |
| OpenAI (GPT-4o-mini) | $0.15 | $0.60 | 71% कम |
कब इस्तेमाल करें
Codex और agentic coding, multi-step tool use, code generation, structured output और long-context automation के लिए V4 Flash को डिफ़ॉल्ट बनाएँ। आधिकारिक 0731 build OpenAI Chat Completions और Responses API, दोनों तरह के clients को support करता है, और QSP का stable model ID वही रहता है।
कब कोई और model चुनें
वाकई कठिन reasoning (competitive programming, multi-step proofs, जटिल गणित) के लिए V4 Pro पर जाएँ। Opus-class agentic / long-horizon planning के लिए Kimi K2.6 बेहतर बैठता है। Audio या GPT-4-class creative writing के लिए OpenAI पर ही रहें। V4 Flash खुद केवल text लेता है — अगर आपको image input चाहिए, तो हमारे 68 models में से 35 उसे स्वीकार करते हैं।
Quickstart (curl)
curl https://api.quicksilverpro.io/v1/chat/completions \
-H "Authorization: Bearer $QSP_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4-flash",
"messages": [{"role": "user", "content": "Hello!"}]
}'OpenAI-संगत। base_url बदलकर एक लाइन में migration।
FAQ
हाँ — V4 Flash डिफ़ॉल्ट रूप से सोचता है। Chat Completions के ज़रिए सीधी, बिना thinking वाली chat के लिए `reasoning: { enabled: false }` पास करें; Responses API clients गहराई नियंत्रित करने के लिए `reasoning.effort` सेट कर सकते हैं।
QuickSilver Pro आधिकारिक 0731 build को $0.086 input / $0.173 output प्रति 1M tokens पर list करता है, जो OpenRouter के mainstream $0.0785 / $0.1571 rate से लगभग 10% ऊपर है। इस revision के लिए OpenRouter की सबसे सस्ती listings अक्सर FP4-quantized होती हैं; QuickSilver Pro इसे केवल FP8 या उससे बेहतर पर serve करता है।
हाँ। base_url=https://api.quicksilverpro.io/v1 को model="deepseek-v4-flash" के साथ इस्तेमाल करें। QSP `/v1/chat/completions` और `/v1/responses` दोनों उपलब्ध कराता है; Codex में `wire_api = "responses"` इस्तेमाल करें।