Gemini 3.7 Flash в QuickSilver Pro
Gemini 3.7 Flash — новейшая Flash-модель Google для production-агентов, кодинга, мультимодального анализа и работы с длинным контекстом. Принимает текст и изображения в контексте 1M токенов, поддерживает reasoning, streaming, инструменты и структурированный вывод. До 31 декабря 2026 года QuickSilver Pro берёт $0.6375 за входные / $3.1875 за выходные токены за миллион — на 15% ниже промо-цены API Google.
Коротко
Быстрые мультимодальные агенты и кодинг с контекстом 1M — на 15% ниже промо-цены API Google на 2026 год.
Сравнение цен ($/1M токенов)
| Провайдер | Вход | Выход | к QSP |
|---|---|---|---|
| QuickSilver Pro | $0.6375 | $3.1875 | самая низкая цена |
| Промо-цена Google (Gemini API promotional rate) | $0.75 | $3.75 | на 15% ниже |
| OpenAI (GPT-4o) | $2.50 | $10.00 | на 68% ниже |
Когда использовать
Используйте Gemini 3.7 Flash для production-агентов, ассистентов по коду, понимания изображений, анализа документов, сценариев с tool calling и длинных промптов, которым нужен контекст 1M токенов. Модель поддерживает и Chat Completions, и Responses через один и тот же OpenAI-совместимый endpoint QSP.
Когда выбрать другую модель
Для простой классификации или извлечения данных, где цена важнее качества рассуждений, дешевле Gemini 3.5 Flash-Lite. Если нужен premium-reasoning только по тексту при более низкой цене токена, оцените DeepSeek V4 Pro. Текущая цена Gemini 3.7 Flash — промо, действует до 31 декабря 2026 года, поэтому для чувствительных к бюджету production-нагрузок стоит пересмотреть цены до 2027 года.
Быстрый старт (curl)
curl https://api.quicksilverpro.io/v1/chat/completions \
-H "Authorization: Bearer $QSP_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3.7-flash",
"messages": [{"role": "user", "content": "Hello!"}]
}'Совместимо с OpenAI. Миграция в одну строку через base_url.
FAQ
До 31 декабря 2026 года — $0.6375 за миллион входных токенов и $3.1875 за миллион выходных. Кэшированный ввод — $0.06375 за миллион токенов. Эти ставки на 15% ниже промо-цен API Google; цены будут пересмотрены до окончания акции.
Да. Модель принимает на вход текст и изображения, поддерживает streaming, reasoning, function calling и структурированный вывод по JSON Schema. Максимальный контекст — 1M токенов, максимальный вывод — 65,536 токенов.
Укажите base_url=https://api.quicksilverpro.io/v1, используйте свой API-ключ QSP и задайте model="gemini-3.7-flash". Поддерживаются и `/v1/chat/completions`, и `/v1/responses`, включая streaming и tool calls.
Да. QuickSilver Pro непрерывно мониторит модель, а на запуске проверил на production-endpoint Chat Completions без стриминга и со стримингом, Responses API, стриминг Responses и принудительный function calling.