Gemini 3.1 Pro Preview в QuickSilver Pro
Gemini 3.1 Pro Preview — флагманская reasoning-модель Google: контекстное окно 1M токенов, глубокий thinking по умолчанию, мультимодальная основа. В QuickSilver Pro она стоит $1.70 за входные / $10.20 за выходные токены за 1M токенов — примерно на 15% ниже розничной цены Google Vertex и цены OpenRouter $2/$12. Это preview API; семантика может измениться до GA.
Коротко
Reasoning на длинном контексте, многошаговый анализ, сложное code review — качество класса o1 при примерно в 6 раз меньшей стоимости вывода.
Сравнение цен ($/1M токенов)
| Провайдер | Вход | Выход | к QSP |
|---|---|---|---|
| QuickSilver Pro | $1.70 | $10.20 | самая низкая цена |
| OpenRouter (google/gemini-3.1-pro-preview) | $2.00 | $12.00 | на 15% ниже |
| OpenAI (o1) | $15.00 | $60.00 | на 83% ниже |
Когда использовать
Берите Gemini 3.1 Pro Preview, когда задаче действительно полезен chain-of-thought на длинном контексте: review большой кодовой базы, синтез множества юридических или исследовательских документов, сложное агентное планирование с богатой памятью, математические рассуждения над длинной задачей. Контекст 1M вмещает солидный корпус без чанкинга, а цепочка рассуждений повышает качество ответа на сложных задачах. Тот же уровень качества, что у OpenAI o1, за малую долю стоимости.
Когда выбрать другую модель
Не делайте 3.1 Pro Preview выбором по умолчанию для рутинного чата или классификации коротких промптов — модель думает по умолчанию, так что вопрос в одну строку может сжечь 100-200 reasoning-токенов ещё до видимого ответа. Для массового недорогого чата по стоимости задачи выигрывают Gemini 3.1 Flash Lite ($0.2125/$1.275) или DeepSeek V4 Flash ($0.086/$0.173). Если нужен reasoning не в стиле Gemini, DeepSeek V4 Pro ($0.70/$2.10) дешевле и на входе, и на выходе.
Быстрый старт (curl)
curl https://api.quicksilverpro.io/v1/chat/completions \
-H "Authorization: Bearer $QSP_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3.1-pro-preview",
"messages": [{"role": "user", "content": "Hello!"}]
}'Совместимо с OpenAI. Миграция в одну строку через base_url.
FAQ
Это preview API — так его обозначает сам Google, и семантика может измениться до GA. Форматы вывода, обработка thinkingConfig и rate limits могут меняться без предупреждения. Для прототипирования и evals — запускайте уже сегодня. В критичных для выручки сценариях закрепитесь на GA-модели Gemini (например, Gemini 3.5 Flash), а 3.1 Pro держите как эксперимент за флагом, пока Google не переведёт её в GA.
Gemini 3.1 Pro Preview думает по умолчанию: перед финальным ответом модель выдаёт длинную цепочку рассуждений, а usage.completion_tokens включает и reasoning_tokens, и text_tokens. Простой запрос «what is 7+8?» в нашем smoke-тесте вернул 160 reasoning-токенов + 3 текстовых. Закладывайте max_tokens соответственно: при значении меньше ~200 токенов есть риск, что модель исчерпает бюджет на этапе thinking и вернёт пустой ответ.
В QuickSilver Pro пока нет — `reasoning: { enabled: false }` для Gemini 3.1 Pro молча отбрасывается. Если нужна Gemini без thinking, используйте gemini-3.1-flash-lite ($0.2125/$1.275) — она действительно не думает. Учтите: уровни Flash думают по умолчанию — без reasoning поставляется только Flash Lite.
В QuickSilver Pro Gemini 3.1 Pro Preview стоит $1.70 за входные / $10.20 за выходные токены за 1M токенов — примерно на 15% ниже розничной цены Google Vertex и цены OpenRouter $2/$12. Вы оплачиваете один счёт за 14 моделей по одному OpenAI-совместимому ключу, с учётом `usage.cost` в каждом ответе. Чтобы перейти с другого провайдера, достаточно заменить base_url и ключ в OpenAI SDK и указать `model="gemini-3.1-pro-preview"`.