Qwen3.7 Max в QuickSilver Pro
Qwen 3.7 Max — флагман Alibaba от мая 2026 года, вершина линейки Qwen 3.7, настроенная на сложные многошаговые рассуждения, долгосрочные агентные процессы и задачи с глубоким tool calling, для которых вы иначе взяли бы GPT-4o или Claude Sonnet 4.5. В QuickSilver Pro она стоит $1.25 за вход / $3.75 за выход за 1M токенов — на ~62% дешевле GPT-4o на выходе, с контекстом 1M (в 8× больше, чем у GPT-4o) и одним OpenAI-совместимым ключом на 32 модели. Это собственная цена Alibaba на модель, переданная без наценки.
Коротко
Флагманские рассуждения + долгосрочные агенты — качество GPT-4o при выходе на ~62% дешевле и 8× контексте.
Сравнение цен ($/1M токенов)
| Провайдер | Вход | Выход | к QSP |
|---|---|---|---|
| QuickSilver Pro | $1.25 | $3.75 | самая низкая цена |
| OpenRouter (qwen/qwen3.7-max) | $1.475 | $4.425 | на 15% ниже |
| OpenAI (GPT-4o) | $2.50 | $10.00 | на 63% ниже |
Когда использовать
Выбирайте 3.7 Max, когда 3.6 Plus не хватает интеллекта на ваших eval-тестах: multi-hop рассуждения, агентные процессы с планированием на 10+ вызовов инструментов, анализ длинного контекста по корпусу в миллион токенов, агенты для code review или рефакторинга, которым нужно держать в голове весь репозиторий. По характеру нагрузки это тот же класс, что GPT-4o или Claude Sonnet 4.5, — берите 3.7 Max ради экономии на выходных токенах и более широкого контекстного окна.
Когда выбрать другую модель
Для рутинного чата, генерации кода и продакшен-агентов, где DeepSeek V4 Pro по $0.70/$2.10 даёт тот же ответ, V4 Pro в ~6× дешевле на выходе. В чистой математике и рассуждениях в духе теорем DeepSeek V4 Pro — лидер по соотношению цены и качества. 3.7 Max думает по умолчанию; шлюз QuickSilver Pro по умолчанию выключает размышления, чтобы рутинные вызовы не оплачивали скрытую цепочку рассуждений, — передайте `enable_thinking=true`, чтобы включить их обратно.
Быстрый старт (curl)
curl https://api.quicksilverpro.io/v1/chat/completions \
-H "Authorization: Bearer $QSP_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3.7-max",
"messages": [{"role": "user", "content": "Hello!"}]
}'Совместимо с OpenAI. Миграция в одну строку через base_url.
FAQ
На опубликованных бенчмарках Qwen (MMLU-Pro, GPQA Diamond, HumanEval, Tau-bench, BFCL-v3) 3.7 Max почти вплотную подходит к GPT-4o в рассуждениях и работе с инструментами и заметно опережает её в поиске по длинному контексту благодаря окну 1M токенов против 128K у GPT-4o. Прежде чем принимать решение, сверьтесь со своими eval-тестами — для нагрузок, под которые 3.7 Max создана (агентные + длинный контекст), потокенная экономика ($1.25/$3.75 против $2.5/$10 у GPT-4o) и 8-кратное преимущество по контексту обычно оказываются решающими.
3.7 Max думает по умолчанию. Чтобы рутинные вызовы не оплачивали скрытую цепочку рассуждений, шлюз QuickSilver Pro по умолчанию выключает размышления в запросах к 3.7 Max. Если цепочка рассуждений нужна, передайте `enable_thinking=true` в теле запроса и заложите бюджет выходных токенов соответственно (в 3-5× больше типичного вывода в чате).
V4 Pro по $0.70 / $2.10 за 1M в ~6× дешевле на выходе и не уступает 3.7 Max на многих опубликованных бенчмарках рассуждений (MATH, GPQA, AIME). Берите 3.7 Max только тогда, когда V4 Pro заметно проседает на ваших агентных eval-тестах или тестах с длинным контекстом, — на агентных бенчмарках, опубликованных Alibaba, результаты Qwen по работе с инструментами и BFCL-v3 немного выше. Проведите A/B-тест, прежде чем соглашаться на наценку; для большинства продакшен-нагрузок с рассуждениями V4 Pro — лучший выбор по умолчанию.