Главная/Модели/Gemini 3.1 Flash Lite
Legacyконтекст 1MМультимодальнаяResponses API

Gemini 3.1 Flash Lite в QuickSilver Pro

Gemini 3.1 Flash Lite остаётся доступной только ради совместимости с существующими интеграциями. Переводите production- и новые нагрузки на gemini-3.5-flash-lite — актуальную недорогую GA-модель Flash-Lite от Google.

$0.2125 вход · $1.275 выход за 1M токенов
Автор:Raullen Chai·Обновлено

Коротко

Контекст
1M токенов
Вход / 1M
$0.2125
Выход / 1M
$1.275
Думает по умолчанию
Нет

Временная совместимость для интеграций, мигрирующих на Gemini 3.5 Flash-Lite.

Сравнение цен ($/1M токенов)

ПровайдерВходВыходк QSP
QuickSilver Pro$0.2125$1.275самая низкая цена
OpenRouter (google/gemini-3.1-flash-lite)$0.25$1.50на 15% ниже
OpenAI (GPT-4o mini)$0.15$0.60на 112% дороже

Когда использовать

Используйте 3.1 Flash Lite для массовой, чувствительной к цене работы, где цепочка рассуждений не нужна: роутинг и классификация, извлечение данных, суммаризация, простой чат и подзадачи агентов, где задержка и цена важнее глубины рассуждений. Отсутствие thinking по умолчанию делает число выходных токенов предсказуемым — бюджет легко планировать на масштабе.

Когда выбрать другую модель

Для многошагового reasoning, сложного кодинга или анализа переходите на 3.5 Flash ($1.275/$7.65) или уровень Pro — Flash Lite жертвует глубиной ради цены. Если вам нужна именно думающая Gemini по низкой цене, 3 Flash Preview ($0.425/$2.55) рассуждает по умолчанию. Для генерации изображений используйте image-модели Gemini или FLUX.

Быстрый старт (curl)

curl https://api.quicksilverpro.io/v1/chat/completions \
  -H "Authorization: Bearer $QSP_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-3.1-flash-lite",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

Совместимо с OpenAI. Миграция в одну строку через base_url.

FAQ

Нет — Flash Lite относится к уровню без thinking, поэтому отвечает сразу, без цепочки рассуждений. Благодаря этому число выходных токенов (и стоимость) предсказуемо — именно то, что нужно массовым нагрузкам. Если нужен reasoning, 3 Flash Preview и 3.5 Flash думают по умолчанию.

Да — при цене $0.2125 за входные / $1.275 за выходные токены за 1M токенов это самая дешёвая Gemini в каталоге и естественный выбор для массового роутинга, классификации и извлечения данных. Если нужен недорогой чат не на Gemini, DeepSeek V4 Flash ($0.086/$0.173) стоит ещё меньше и на входе, и на выходе.

В QuickSilver Pro 3.1 Flash Lite стоит $0.2125 за входные / $1.275 за выходные токены за 1M токенов — примерно на 15% ниже розничной цены Vertex $0.25/$1.50. Один OpenAI-совместимый ключ на 18 моделей, один счёт и поле `usage.cost` в каждом ответе, чтобы сверять расходы по каждому запросу.

Попробуйте Gemini 3.1 Flash Lite с удвоенным балансом — до $50 бонусных кредитов

Получить API Key