Qwen3.6-35B-A3B в QuickSilver Pro
Qwen 3.6-35B-A3B — рабочая лошадка Alibaba на MoE: 35B параметров, 3B активных на токен, контекстное окно 262K и сильные рассуждения при крошечной стоимости обслуживания. В QuickSilver Pro она стоит $0.112 за вход / $0.80 за выход за 1M токенов — на ~20% ниже OpenRouter и в ~12–22× дешевле GPT-4o на задачах RAG с длинным контекстом, для которых она на самом деле и создана.
Коротко
RAG на длинном контексте, суммаризация документов, недорогая MoE с рассуждениями.
Сравнение цен ($/1M токенов)
| Провайдер | Вход | Выход | к QSP |
|---|---|---|---|
| QuickSilver Pro | $0.112 | $0.80 | самая низкая цена |
| OpenRouter (qwen/qwen3.6-35b-a3b) | $0.14 | $1.00 | на 20% ниже |
| OpenAI (GPT-4o) | $2.50 | $10.00 | на 92% ниже |
Когда использовать
Qwen 3.6 лучше всего проявляет себя в суммаризации длинных документов, RAG по нескольким документам на корпусах в 100K+ токенов и задачах на китайском языке, где её преимущество в обучающих данных реально. MoE с 3B активных параметров означает дешёвое обслуживание в масштабе; контекст 262K позволяет склеить целое пространство Confluence или техническую спецификацию без разбиения на куски.
Когда выбрать другую модель
На нагрузках кодинг-агентов DeepSeek V4 Flash обходит её на бенчмарках в стиле HumanEval и стоит дешевле. Для рассуждений высшего уровня — V4 Pro. QuickSilver Pro отдаёт Qwen 3.6-35B в режиме без размышлений: ответы прямые, а поле `reasoning` в запросе размышления не включает.
Быстрый старт (curl)
curl https://api.quicksilverpro.io/v1/chat/completions \
-H "Authorization: Bearer $QSP_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3.6-35b",
"messages": [{"role": "user", "content": "Hello!"}]
}'Совместимо с OpenAI. Миграция в одну строку через base_url.
FAQ
Это MoE на 35B параметров, из которых на токен активны только 3B, поэтому она дёшево обслуживается в масштабе и сохраняет сильные рассуждения в математике, кодинге и поиске по длинному контексту. Контекстное окно 262K делает её естественным выбором для RAG по нескольким документам и суммаризации длинных документов. QuickSilver Pro отдаёт её в режиме без размышлений, поэтому ответы прямые, без цепочки рассуждений.
Нет. QuickSilver Pro отдаёт Qwen 3.6-35B в режиме без размышлений, поэтому вы никогда не платите за цепочку размышлений. Поле `reasoning` в запросе размышления не включает; для пошаговых рассуждений используйте модель, которая рассуждает по умолчанию, например DeepSeek V4 Pro.
OpenRouter предлагает Qwen 3.6-35B-A3B по $0.14 за вход / $1.00 за выход за 1M токенов. В QuickSilver Pro — $0.112 / $0.80, на 20% ниже по обеим позициям. Тот же OpenAI-совместимый интерфейс; миграция — это замена base_url и ключа. Уберите префикс провайдера `qwen/` из ID модели.