контекст 1MReasoningResponses API

Qwen3.7 Max в QuickSilver Pro

Qwen 3.7 Max — флагман Alibaba от мая 2026 года, вершина линейки Qwen 3.7, настроенная на сложные многошаговые рассуждения, долгосрочные агентные процессы и задачи с глубоким tool calling, для которых вы иначе взяли бы GPT-4o или Claude Sonnet 4.5. В QuickSilver Pro она стоит $1.25 за вход / $3.75 за выход за 1M токенов — на ~62% дешевле GPT-4o на выходе, с контекстом 1M (в 8× больше, чем у GPT-4o) и одним OpenAI-совместимым ключом на 32 модели. Это собственная цена Alibaba на модель, переданная без наценки.

$1.25 вход · $3.75 выход за 1M токенов
Автор:Raullen Chai·Обновлено

Коротко

Контекст
1M токенов
Вход / 1M
$1.25
Выход / 1M
$3.75
Думает по умолчанию
Нет

Флагманские рассуждения + долгосрочные агенты — качество GPT-4o при выходе на ~62% дешевле и 8× контексте.

Сравнение цен ($/1M токенов)

ПровайдерВходВыходк QSP
QuickSilver Pro$1.25$3.75самая низкая цена
OpenRouter (qwen/qwen3.7-max)$1.475$4.425на 15% ниже
OpenAI (GPT-4o)$2.50$10.00на 63% ниже

Когда использовать

Выбирайте 3.7 Max, когда 3.6 Plus не хватает интеллекта на ваших eval-тестах: multi-hop рассуждения, агентные процессы с планированием на 10+ вызовов инструментов, анализ длинного контекста по корпусу в миллион токенов, агенты для code review или рефакторинга, которым нужно держать в голове весь репозиторий. По характеру нагрузки это тот же класс, что GPT-4o или Claude Sonnet 4.5, — берите 3.7 Max ради экономии на выходных токенах и более широкого контекстного окна.

Когда выбрать другую модель

Для рутинного чата, генерации кода и продакшен-агентов, где DeepSeek V4 Pro по $0.70/$2.10 даёт тот же ответ, V4 Pro в ~6× дешевле на выходе. В чистой математике и рассуждениях в духе теорем DeepSeek V4 Pro — лидер по соотношению цены и качества. 3.7 Max думает по умолчанию; шлюз QuickSilver Pro по умолчанию выключает размышления, чтобы рутинные вызовы не оплачивали скрытую цепочку рассуждений, — передайте `enable_thinking=true`, чтобы включить их обратно.

Быстрый старт (curl)

curl https://api.quicksilverpro.io/v1/chat/completions \
  -H "Authorization: Bearer $QSP_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3.7-max",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

Совместимо с OpenAI. Миграция в одну строку через base_url.

FAQ

На опубликованных бенчмарках Qwen (MMLU-Pro, GPQA Diamond, HumanEval, Tau-bench, BFCL-v3) 3.7 Max почти вплотную подходит к GPT-4o в рассуждениях и работе с инструментами и заметно опережает её в поиске по длинному контексту благодаря окну 1M токенов против 128K у GPT-4o. Прежде чем принимать решение, сверьтесь со своими eval-тестами — для нагрузок, под которые 3.7 Max создана (агентные + длинный контекст), потокенная экономика ($1.25/$3.75 против $2.5/$10 у GPT-4o) и 8-кратное преимущество по контексту обычно оказываются решающими.

3.7 Max думает по умолчанию. Чтобы рутинные вызовы не оплачивали скрытую цепочку рассуждений, шлюз QuickSilver Pro по умолчанию выключает размышления в запросах к 3.7 Max. Если цепочка рассуждений нужна, передайте `enable_thinking=true` в теле запроса и заложите бюджет выходных токенов соответственно (в 3-5× больше типичного вывода в чате).

V4 Pro по $0.70 / $2.10 за 1M в ~6× дешевле на выходе и не уступает 3.7 Max на многих опубликованных бенчмарках рассуждений (MATH, GPQA, AIME). Берите 3.7 Max только тогда, когда V4 Pro заметно проседает на ваших агентных eval-тестах или тестах с длинным контекстом, — на агентных бенчмарках, опубликованных Alibaba, результаты Qwen по работе с инструментами и BFCL-v3 немного выше. Проведите A/B-тест, прежде чем соглашаться на наценку; для большинства продакшен-нагрузок с рассуждениями V4 Pro — лучший выбор по умолчанию.

Попробуйте Qwen3.7 Max с удвоенным балансом — до $50 бонусных кредитов

Получить API Key