контекст 1MResponses API

Qwen3.6 Plus в QuickSilver Pro

Qwen 3.6 Plus — MoE-флагман Alibaba на 1 триллион параметров: по размеру между 3.6-35B и 3.7 Max, с контекстом 1M. В QuickSilver Pro она стоит $0.26 за вход / $1.56 за выход за 1M токенов — на ~20% ниже OpenRouter и в ~10× дешевле GPT-4o на выходе. Золотая середина для команд, которым нужна ценовая экономика 3.5/3.6-35B, но с большей глубиной рассуждений и контекстом в миллион токенов.

$0.26 вход · $1.56 выход за 1M токенов
Автор:Raullen Chai·Обновлено

Коротко

Контекст
1M токенов
Вход / 1M
$0.26
Выход / 1M
$1.56
Думает по умолчанию
Нет

Продакшен-рассуждения + RAG на длинном контексте при выходе в 10× дешевле, чем у GPT-4o.

Сравнение цен ($/1M токенов)

ПровайдерВходВыходк QSP
QuickSilver Pro$0.26$1.56самая низкая цена
OpenRouter (qwen/qwen3.6-plus)$0.325$1.95на 20% ниже
OpenAI (GPT-4o)$2.50$10.00на 84% ниже

Когда использовать

3.6 Plus занимает место продакшен-варианта по умолчанию: шаг от 3.6-35B слишком мал, чтобы его пропускать, а цена слишком низка, чтобы игнорировать её на нагрузках с интенсивными рассуждениями. Используйте её для RAG по нескольким документам на 100K+ токенов, для клиентского чата, где нужен заметный прирост качества ответов относительно 3.6-35B без цены 3.7 Max, для агентных процессов, где дополнительная задержка на размышления в каждом вызове приемлема, и для задач на китайском языке, где преимущество Qwen в обучающих данных накапливается.

Когда выбрать другую модель

Для детерминированного продакшен-чата без размышлений, где бюджеты токенов должны быть жёсткими, DeepSeek V4 Flash ($0.086/$0.173) с `reasoning.enabled=false` — более дешёвый вариант без размышлений. Для рассуждений передового уровня, с которыми 3.6 Plus заметно не справляется на ваших eval-тестах, переходите на 3.7 Max или V4 Pro. QuickSilver Pro отдаёт 3.6 Plus в режиме без размышлений: ответы прямые, а поле `reasoning` в запросе размышления не включает.

Быстрый старт (curl)

curl https://api.quicksilverpro.io/v1/chat/completions \
  -H "Authorization: Bearer $QSP_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3.6-plus",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

Совместимо с OpenAI. Миграция в одну строку через base_url.

FAQ

3.6-35B — компактный MoE-уровень (35B параметров, 3B активных, контекст 262K, $0.112/$0.80 за 1M токенов). 3.6 Plus — следующая ступень: MoE на 1T параметров, контекст 1M, $0.26/$1.56 за 1M токенов. Разница в цене ощутимая, но прирост качества ответов и более широкий контекст оправдывают её там, где 3.6-35B упирается в потолок.

Да — в семействе Qwen 3.6 Plus служит продакшен-вариантом по умолчанию, а 3.7 Max — флагманом. Соотношение цен — ~7-8× (3.6 Plus $0.26/$1.56 против $2.0/$6.0 у 3.7 Max). Большинству команд стоит начать с 3.6 Plus и проводить A/B-тест 3.7 Max на той части запросов, где ответы 3.6 Plus заметно ухудшаются. У обеих одинаковый контекст 1M и OpenAI-совместимый интерфейс, так что переключение — это просто смена ID модели.

OpenRouter предлагает Qwen 3.6 Plus по $0.325 за вход / $1.95 за выход за 1M токенов. В QuickSilver Pro — $0.26 / $1.56, на ~20% ниже по обеим позициям. Тот же OpenAI-совместимый интерфейс; миграция — это замена base_url и ключа (уберите префикс провайдера `qwen/` из ID модели).

Попробуйте Qwen3.6 Plus с удвоенным балансом — до $50 бонусных кредитов

Получить API Key