Qwen3.6 Plus в QuickSilver Pro
Qwen 3.6 Plus — MoE-флагман Alibaba на 1 триллион параметров: по размеру между 3.6-35B и 3.7 Max, с контекстом 1M. В QuickSilver Pro она стоит $0.26 за вход / $1.56 за выход за 1M токенов — на ~20% ниже OpenRouter и в ~10× дешевле GPT-4o на выходе. Золотая середина для команд, которым нужна ценовая экономика 3.5/3.6-35B, но с большей глубиной рассуждений и контекстом в миллион токенов.
Коротко
Продакшен-рассуждения + RAG на длинном контексте при выходе в 10× дешевле, чем у GPT-4o.
Сравнение цен ($/1M токенов)
| Провайдер | Вход | Выход | к QSP |
|---|---|---|---|
| QuickSilver Pro | $0.26 | $1.56 | самая низкая цена |
| OpenRouter (qwen/qwen3.6-plus) | $0.325 | $1.95 | на 20% ниже |
| OpenAI (GPT-4o) | $2.50 | $10.00 | на 84% ниже |
Когда использовать
3.6 Plus занимает место продакшен-варианта по умолчанию: шаг от 3.6-35B слишком мал, чтобы его пропускать, а цена слишком низка, чтобы игнорировать её на нагрузках с интенсивными рассуждениями. Используйте её для RAG по нескольким документам на 100K+ токенов, для клиентского чата, где нужен заметный прирост качества ответов относительно 3.6-35B без цены 3.7 Max, для агентных процессов, где дополнительная задержка на размышления в каждом вызове приемлема, и для задач на китайском языке, где преимущество Qwen в обучающих данных накапливается.
Когда выбрать другую модель
Для детерминированного продакшен-чата без размышлений, где бюджеты токенов должны быть жёсткими, DeepSeek V4 Flash ($0.086/$0.173) с `reasoning.enabled=false` — более дешёвый вариант без размышлений. Для рассуждений передового уровня, с которыми 3.6 Plus заметно не справляется на ваших eval-тестах, переходите на 3.7 Max или V4 Pro. QuickSilver Pro отдаёт 3.6 Plus в режиме без размышлений: ответы прямые, а поле `reasoning` в запросе размышления не включает.
Быстрый старт (curl)
curl https://api.quicksilverpro.io/v1/chat/completions \
-H "Authorization: Bearer $QSP_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3.6-plus",
"messages": [{"role": "user", "content": "Hello!"}]
}'Совместимо с OpenAI. Миграция в одну строку через base_url.
FAQ
3.6-35B — компактный MoE-уровень (35B параметров, 3B активных, контекст 262K, $0.112/$0.80 за 1M токенов). 3.6 Plus — следующая ступень: MoE на 1T параметров, контекст 1M, $0.26/$1.56 за 1M токенов. Разница в цене ощутимая, но прирост качества ответов и более широкий контекст оправдывают её там, где 3.6-35B упирается в потолок.
Да — в семействе Qwen 3.6 Plus служит продакшен-вариантом по умолчанию, а 3.7 Max — флагманом. Соотношение цен — ~7-8× (3.6 Plus $0.26/$1.56 против $2.0/$6.0 у 3.7 Max). Большинству команд стоит начать с 3.6 Plus и проводить A/B-тест 3.7 Max на той части запросов, где ответы 3.6 Plus заметно ухудшаются. У обеих одинаковый контекст 1M и OpenAI-совместимый интерфейс, так что переключение — это просто смена ID модели.
OpenRouter предлагает Qwen 3.6 Plus по $0.325 за вход / $1.95 за выход за 1M токенов. В QuickSilver Pro — $0.26 / $1.56, на ~20% ниже по обеим позициям. Тот же OpenAI-совместимый интерфейс; миграция — это замена base_url и ключа (уберите префикс провайдера `qwen/` из ID модели).