Gemini 3.1 Flash Lite в QuickSilver Pro
Gemini 3.1 Flash Lite остаётся доступной только ради совместимости с существующими интеграциями. Переводите production- и новые нагрузки на gemini-3.5-flash-lite — актуальную недорогую GA-модель Flash-Lite от Google.
Коротко
Временная совместимость для интеграций, мигрирующих на Gemini 3.5 Flash-Lite.
Сравнение цен ($/1M токенов)
| Провайдер | Вход | Выход | к QSP |
|---|---|---|---|
| QuickSilver Pro | $0.2125 | $1.275 | самая низкая цена |
| OpenRouter (google/gemini-3.1-flash-lite) | $0.25 | $1.50 | на 15% ниже |
| OpenAI (GPT-4o mini) | $0.15 | $0.60 | на 112% дороже |
Когда использовать
Используйте 3.1 Flash Lite для массовой, чувствительной к цене работы, где цепочка рассуждений не нужна: роутинг и классификация, извлечение данных, суммаризация, простой чат и подзадачи агентов, где задержка и цена важнее глубины рассуждений. Отсутствие thinking по умолчанию делает число выходных токенов предсказуемым — бюджет легко планировать на масштабе.
Когда выбрать другую модель
Для многошагового reasoning, сложного кодинга или анализа переходите на 3.5 Flash ($1.275/$7.65) или уровень Pro — Flash Lite жертвует глубиной ради цены. Если вам нужна именно думающая Gemini по низкой цене, 3 Flash Preview ($0.425/$2.55) рассуждает по умолчанию. Для генерации изображений используйте image-модели Gemini или FLUX.
Быстрый старт (curl)
curl https://api.quicksilverpro.io/v1/chat/completions \
-H "Authorization: Bearer $QSP_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3.1-flash-lite",
"messages": [{"role": "user", "content": "Hello!"}]
}'Совместимо с OpenAI. Миграция в одну строку через base_url.
FAQ
Нет — Flash Lite относится к уровню без thinking, поэтому отвечает сразу, без цепочки рассуждений. Благодаря этому число выходных токенов (и стоимость) предсказуемо — именно то, что нужно массовым нагрузкам. Если нужен reasoning, 3 Flash Preview и 3.5 Flash думают по умолчанию.
Да — при цене $0.2125 за входные / $1.275 за выходные токены за 1M токенов это самая дешёвая Gemini в каталоге и естественный выбор для массового роутинга, классификации и извлечения данных. Если нужен недорогой чат не на Gemini, DeepSeek V4 Flash ($0.086/$0.173) стоит ещё меньше и на входе, и на выходе.
В QuickSilver Pro 3.1 Flash Lite стоит $0.2125 за входные / $1.275 за выходные токены за 1M токенов — примерно на 15% ниже розничной цены Vertex $0.25/$1.50. Один OpenAI-совместимый ключ на 18 моделей, один счёт и поле `usage.cost` в каждом ответе, чтобы сверять расходы по каждому запросу.