होम/Models/DeepSeek V4 Flash
1M contextReasoningResponses API

DeepSeek V4 Flash QuickSilver Pro पर

DeepSeek V4 Flash 0731 आधिकारिक public-beta agent मॉडल है: 1M-token context, बेहतर coding और tool use, और Codex के लिए अनुकूलित native Responses API। QuickSilver Pro आधिकारिक DeepSeek build को FP8 या उससे बेहतर precision पर $0.086 / $0.173 प्रति million tokens में serve करता है।

प्रति 1M tokens: input $0.086 · output $0.173
लेखक:Raullen Chai·अपडेट:

एक नज़र में

Context
1M tokens
Input / 1M
$0.086
Output / 1M
$0.173
Default में सोचता है
हाँ

Codex, agentic coding, tool use और long-context automation।

Pricing तुलना ($/1M tokens)

ProviderInputOutputQSP की तुलना में
QuickSilver Pro$0.086$0.173—
OpenRouter (deepseek/deepseek-v4-flash-0731)$0.0785$0.157110% महँगा
OpenAI (GPT-4o-mini)$0.15$0.6071% कम

कब इस्तेमाल करें

Codex और agentic coding, multi-step tool use, code generation, structured output और long-context automation के लिए V4 Flash को डिफ़ॉल्ट बनाएँ। आधिकारिक 0731 build OpenAI Chat Completions और Responses API, दोनों तरह के clients को support करता है, और QSP का stable model ID वही रहता है।

कब कोई और model चुनें

वाकई कठिन reasoning (competitive programming, multi-step proofs, जटिल गणित) के लिए V4 Pro पर जाएँ। Opus-class agentic / long-horizon planning के लिए Kimi K2.6 बेहतर बैठता है। Audio या GPT-4-class creative writing के लिए OpenAI पर ही रहें। V4 Flash खुद केवल text लेता है — अगर आपको image input चाहिए, तो हमारे 68 models में से 35 उसे स्वीकार करते हैं।

Quickstart (curl)

curl https://api.quicksilverpro.io/v1/chat/completions \
  -H "Authorization: Bearer $QSP_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4-flash",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

OpenAI-संगत। base_url बदलकर एक लाइन में migration।

FAQ

हाँ — V4 Flash डिफ़ॉल्ट रूप से सोचता है। Chat Completions के ज़रिए सीधी, बिना thinking वाली chat के लिए `reasoning: { enabled: false }` पास करें; Responses API clients गहराई नियंत्रित करने के लिए `reasoning.effort` सेट कर सकते हैं।

QuickSilver Pro आधिकारिक 0731 build को $0.086 input / $0.173 output प्रति 1M tokens पर list करता है, जो OpenRouter के mainstream $0.0785 / $0.1571 rate से लगभग 10% ऊपर है। इस revision के लिए OpenRouter की सबसे सस्ती listings अक्सर FP4-quantized होती हैं; QuickSilver Pro इसे केवल FP8 या उससे बेहतर पर serve करता है।

हाँ। base_url=https://api.quicksilverpro.io/v1 को model="deepseek-v4-flash" के साथ इस्तेमाल करें। QSP `/v1/chat/completions` और `/v1/responses` दोनों उपलब्ध कराता है; Codex में `wire_api = "responses"` इस्तेमाल करें।

DeepSeek V4 Flash को double credits के साथ आज़माएँ — $50 तक bonus credits

API Key पाएँ