होम/Models/Gemini 3.5 Flash-Lite
1M contextMultimodalResponses API

Gemini 3.5 Flash-Lite QuickSilver Pro पर

Gemini 3.5 Flash-Lite high-throughput workloads के लिए Google का मौजूदा low-cost GA मॉडल है। QuickSilver Pro इसे 1M-token context window के साथ प्रति million tokens $0.255 input / $2.125 output पर serve करता है, जो Google की $0.30/$2.50 list price से 15% कम है।

प्रति 1M tokens: input $0.255 · output $2.125
लेखक:Raullen Chai·अपडेट:

एक नज़र में

Context
1M tokens
Input / 1M
$0.255
Output / 1M
$2.125
Default में सोचता है
नहीं

GA stability और predictable लागत वाले high-volume Gemini workloads।

Pricing तुलना ($/1M tokens)

ProviderInputOutputQSP की तुलना में
QuickSilver Pro$0.255$2.125सबसे कम कीमत
Google की list price (google/gemini-3.5-flash-lite)$0.30$2.5015% कम
OpenAI (GPT-4o mini)$0.15$0.60254% महँगा

कब इस्तेमाल करें

Gemini 3.5 Flash-Lite का उपयोग classification, extraction, routing, summarization, साधारण chat और उन agent subtasks के लिए करें जहाँ throughput और कीमत सबसे ज़्यादा मायने रखते हैं।

कब कोई और model चुनें

Reasoning-heavy coding या multimodal analysis के लिए Gemini 3.6 Flash इस्तेमाल करें। सबसे कठिन long-context reasoning tasks के लिए Gemini 3.1 Pro Preview को परखें।

Quickstart (curl)

curl https://api.quicksilverpro.io/v1/chat/completions \
  -H "Authorization: Bearer $QSP_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-3.5-flash-lite",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

OpenAI-संगत। base_url बदलकर एक लाइन में migration।

FAQ

हाँ। मौजूदा integrations migration के दौरान पुरानी ID इस्तेमाल करते रह सकते हैं, लेकिन नए workloads को gemini-3.5-flash-lite इस्तेमाल करना चाहिए।

QuickSilver Pro प्रति 1M tokens $0.255 input और $2.125 output चार्ज करता है, जो Google की $0.30/$2.50 list price से 15% कम है।

हाँ। Base URL के रूप में https://api.quicksilverpro.io/v1 और model ID के रूप में gemini-3.5-flash-lite इस्तेमाल करें।

Gemini 3.5 Flash-Lite को double credits के साथ आज़माएँ — $50 तक bonus credits

API Key पाएँ