Gemini 3.5 Flash-Lite в QuickSilver Pro
Gemini 3.5 Flash-Lite — актуальная недорогая GA-модель Google для нагрузок с высокой пропускной способностью. QuickSilver Pro отдаёт её с контекстным окном 1M токенов по цене $0.255 за входные / $2.125 за выходные токены за миллион — на 15% ниже списочной цены Google $0.30/$2.50.
Коротко
Массовые нагрузки на Gemini со стабильностью GA и предсказуемой стоимостью.
Сравнение цен ($/1M токенов)
| Провайдер | Вход | Выход | к QSP |
|---|---|---|---|
| QuickSilver Pro | $0.255 | $2.125 | самая низкая цена |
| Списочная цена Google (google/gemini-3.5-flash-lite) | $0.30 | $2.50 | на 15% ниже |
| OpenAI (GPT-4o mini) | $0.15 | $0.60 | на 254% дороже |
Когда использовать
Используйте Gemini 3.5 Flash-Lite для классификации, извлечения данных, роутинга, суммаризации, простого чата и подзадач агентов — там, где важнее всего пропускная способность и цена.
Когда выбрать другую модель
Для кодинга с интенсивным reasoning или мультимодального анализа используйте Gemini 3.6 Flash. Для самых сложных reasoning-задач с длинным контекстом оцените Gemini 3.1 Pro Preview.
Быстрый старт (curl)
curl https://api.quicksilverpro.io/v1/chat/completions \
-H "Authorization: Bearer $QSP_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3.5-flash-lite",
"messages": [{"role": "user", "content": "Hello!"}]
}'Совместимо с OpenAI. Миграция в одну строку через base_url.
FAQ
Да. Существующие интеграции могут продолжать использовать старый ID на время миграции, но для новых нагрузок используйте gemini-3.5-flash-lite.
QuickSilver Pro берёт $0.255 за входные и $2.125 за выходные токены за 1M токенов — на 15% ниже списочной цены Google $0.30/$2.50.
Да. Укажите https://api.quicksilverpro.io/v1 в качестве base URL и gemini-3.5-flash-lite в качестве ID модели.