Главная/Модели/Gemini 3.1 Pro Preview
контекст 1MМультимодальнаяReasoningResponses API

Gemini 3.1 Pro Preview в QuickSilver Pro

Gemini 3.1 Pro Preview — флагманская reasoning-модель Google: контекстное окно 1M токенов, глубокий thinking по умолчанию, мультимодальная основа. В QuickSilver Pro она стоит $1.70 за входные / $10.20 за выходные токены за 1M токенов — примерно на 15% ниже розничной цены Google Vertex и цены OpenRouter $2/$12. Это preview API; семантика может измениться до GA.

$1.70 вход · $10.20 выход за 1M токенов
Автор:Raullen Chai·Обновлено

Коротко

Контекст
1M токенов
Вход / 1M
$1.70
Выход / 1M
$10.20
Думает по умолчанию
Да

Reasoning на длинном контексте, многошаговый анализ, сложное code review — качество класса o1 при примерно в 6 раз меньшей стоимости вывода.

Сравнение цен ($/1M токенов)

ПровайдерВходВыходк QSP
QuickSilver Pro$1.70$10.20самая низкая цена
OpenRouter (google/gemini-3.1-pro-preview)$2.00$12.00на 15% ниже
OpenAI (o1)$15.00$60.00на 83% ниже

Когда использовать

Берите Gemini 3.1 Pro Preview, когда задаче действительно полезен chain-of-thought на длинном контексте: review большой кодовой базы, синтез множества юридических или исследовательских документов, сложное агентное планирование с богатой памятью, математические рассуждения над длинной задачей. Контекст 1M вмещает солидный корпус без чанкинга, а цепочка рассуждений повышает качество ответа на сложных задачах. Тот же уровень качества, что у OpenAI o1, за малую долю стоимости.

Когда выбрать другую модель

Не делайте 3.1 Pro Preview выбором по умолчанию для рутинного чата или классификации коротких промптов — модель думает по умолчанию, так что вопрос в одну строку может сжечь 100-200 reasoning-токенов ещё до видимого ответа. Для массового недорогого чата по стоимости задачи выигрывают Gemini 3.1 Flash Lite ($0.2125/$1.275) или DeepSeek V4 Flash ($0.086/$0.173). Если нужен reasoning не в стиле Gemini, DeepSeek V4 Pro ($0.70/$2.10) дешевле и на входе, и на выходе.

Быстрый старт (curl)

curl https://api.quicksilverpro.io/v1/chat/completions \
  -H "Authorization: Bearer $QSP_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-3.1-pro-preview",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

Совместимо с OpenAI. Миграция в одну строку через base_url.

FAQ

Это preview API — так его обозначает сам Google, и семантика может измениться до GA. Форматы вывода, обработка thinkingConfig и rate limits могут меняться без предупреждения. Для прототипирования и evals — запускайте уже сегодня. В критичных для выручки сценариях закрепитесь на GA-модели Gemini (например, Gemini 3.5 Flash), а 3.1 Pro держите как эксперимент за флагом, пока Google не переведёт её в GA.

Gemini 3.1 Pro Preview думает по умолчанию: перед финальным ответом модель выдаёт длинную цепочку рассуждений, а usage.completion_tokens включает и reasoning_tokens, и text_tokens. Простой запрос «what is 7+8?» в нашем smoke-тесте вернул 160 reasoning-токенов + 3 текстовых. Закладывайте max_tokens соответственно: при значении меньше ~200 токенов есть риск, что модель исчерпает бюджет на этапе thinking и вернёт пустой ответ.

В QuickSilver Pro пока нет — `reasoning: { enabled: false }` для Gemini 3.1 Pro молча отбрасывается. Если нужна Gemini без thinking, используйте gemini-3.1-flash-lite ($0.2125/$1.275) — она действительно не думает. Учтите: уровни Flash думают по умолчанию — без reasoning поставляется только Flash Lite.

В QuickSilver Pro Gemini 3.1 Pro Preview стоит $1.70 за входные / $10.20 за выходные токены за 1M токенов — примерно на 15% ниже розничной цены Google Vertex и цены OpenRouter $2/$12. Вы оплачиваете один счёт за 14 моделей по одному OpenAI-совместимому ключу, с учётом `usage.cost` в каждом ответе. Чтобы перейти с другого провайдера, достаточно заменить base_url и ключ в OpenAI SDK и указать `model="gemini-3.1-pro-preview"`.

Попробуйте Gemini 3.1 Pro Preview с удвоенным балансом — до $50 бонусных кредитов

Получить API Key