Gemini 3.6 Flash QuickSilver Pro पर
Gemini 3.6 Flash Google का मौजूदा general-purpose Flash GA मॉडल है, 1M-token context window के साथ। QuickSilver Pro इसे एक OpenAI-compatible endpoint के ज़रिए प्रति million tokens $0.6375 input / $3.1875 output पर serve करता है, जो Google की $0.75/$3.75 list price से 15% कम है।
एक नज़र में
नए production integrations के लिए recommended Gemini Flash।
Pricing तुलना ($/1M tokens)
| Provider | Input | Output | QSP की तुलना में |
|---|---|---|---|
| QuickSilver Pro | $0.6375 | $3.1875 | सबसे कम कीमत |
| Google की list price (google/gemini-3.6-flash) | $0.75 | $3.75 | 15% कम |
| OpenAI (GPT-4o) | $2.50 | $10.00 | 68% कम |
कब इस्तेमाल करें
Production chat, multimodal analysis, coding, agent turns और उन long-context workloads के लिए Gemini 3.6 Flash को default बनाएँ जिन्हें मौजूदा Flash quality और GA stability चाहिए।
कब कोई और model चुनें
High-volume classification और extraction के लिए, जहाँ reasoning depth से ज़्यादा कीमत मायने रखती है, Gemini 3.5 Flash-Lite इस्तेमाल करें। ज़्यादा कठिन flagship reasoning के लिए, preview stability को परखने के बाद Gemini 3.1 Pro Preview इस्तेमाल करें।
Quickstart (curl)
curl https://api.quicksilverpro.io/v1/chat/completions \
-H "Authorization: Bearer $QSP_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3.6-flash",
"messages": [{"role": "user", "content": "Hello!"}]
}'OpenAI-संगत। base_url बदलकर एक लाइन में migration।
FAQ
हाँ। Preview ID को केवल तब तक रखें जब तक आप मौजूदा integrations को migrate कर रहे हैं। नए workloads को gemini-3.6-flash इस्तेमाल करना चाहिए, जो Google का मौजूदा GA Flash मॉडल है।
इसकी कीमत प्रति 1M tokens $0.6375 input और $3.1875 output है, जो Google की $0.75/$3.75 list price से 15% कम है।
हाँ। OpenAI SDK को https://api.quicksilverpro.io/v1 पर point करें और model को gemini-3.6-flash पर सेट करें।