Gemini 3.5 Flash-Lite QuickSilver Pro पर
Gemini 3.5 Flash-Lite high-throughput workloads के लिए Google का मौजूदा low-cost GA मॉडल है। QuickSilver Pro इसे 1M-token context window के साथ प्रति million tokens $0.255 input / $2.125 output पर serve करता है, जो Google की $0.30/$2.50 list price से 15% कम है।
एक नज़र में
GA stability और predictable लागत वाले high-volume Gemini workloads।
Pricing तुलना ($/1M tokens)
| Provider | Input | Output | QSP की तुलना में |
|---|---|---|---|
| QuickSilver Pro | $0.255 | $2.125 | सबसे कम कीमत |
| Google की list price (google/gemini-3.5-flash-lite) | $0.30 | $2.50 | 15% कम |
| OpenAI (GPT-4o mini) | $0.15 | $0.60 | 254% महँगा |
कब इस्तेमाल करें
Gemini 3.5 Flash-Lite का उपयोग classification, extraction, routing, summarization, साधारण chat और उन agent subtasks के लिए करें जहाँ throughput और कीमत सबसे ज़्यादा मायने रखते हैं।
कब कोई और model चुनें
Reasoning-heavy coding या multimodal analysis के लिए Gemini 3.6 Flash इस्तेमाल करें। सबसे कठिन long-context reasoning tasks के लिए Gemini 3.1 Pro Preview को परखें।
Quickstart (curl)
curl https://api.quicksilverpro.io/v1/chat/completions \
-H "Authorization: Bearer $QSP_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3.5-flash-lite",
"messages": [{"role": "user", "content": "Hello!"}]
}'OpenAI-संगत। base_url बदलकर एक लाइन में migration।
FAQ
हाँ। मौजूदा integrations migration के दौरान पुरानी ID इस्तेमाल करते रह सकते हैं, लेकिन नए workloads को gemini-3.5-flash-lite इस्तेमाल करना चाहिए।
QuickSilver Pro प्रति 1M tokens $0.255 input और $2.125 output चार्ज करता है, जो Google की $0.30/$2.50 list price से 15% कम है।
हाँ। Base URL के रूप में https://api.quicksilverpro.io/v1 और model ID के रूप में gemini-3.5-flash-lite इस्तेमाल करें।