контекст 262KResponses API

Qwen3.6-35B-A3B в QuickSilver Pro

Qwen 3.6-35B-A3B — рабочая лошадка Alibaba на MoE: 35B параметров, 3B активных на токен, контекстное окно 262K и сильные рассуждения при крошечной стоимости обслуживания. В QuickSilver Pro она стоит $0.112 за вход / $0.80 за выход за 1M токенов — на ~20% ниже OpenRouter и в ~12–22× дешевле GPT-4o на задачах RAG с длинным контекстом, для которых она на самом деле и создана.

$0.112 вход · $0.80 выход за 1M токенов
Автор:Raullen Chai·Обновлено

Коротко

Контекст
262K токенов
Вход / 1M
$0.112
Выход / 1M
$0.80
Думает по умолчанию
Нет

RAG на длинном контексте, суммаризация документов, недорогая MoE с рассуждениями.

Сравнение цен ($/1M токенов)

ПровайдерВходВыходк QSP
QuickSilver Pro$0.112$0.80самая низкая цена
OpenRouter (qwen/qwen3.6-35b-a3b)$0.14$1.00на 20% ниже
OpenAI (GPT-4o)$2.50$10.00на 92% ниже

Когда использовать

Qwen 3.6 лучше всего проявляет себя в суммаризации длинных документов, RAG по нескольким документам на корпусах в 100K+ токенов и задачах на китайском языке, где её преимущество в обучающих данных реально. MoE с 3B активных параметров означает дешёвое обслуживание в масштабе; контекст 262K позволяет склеить целое пространство Confluence или техническую спецификацию без разбиения на куски.

Когда выбрать другую модель

На нагрузках кодинг-агентов DeepSeek V4 Flash обходит её на бенчмарках в стиле HumanEval и стоит дешевле. Для рассуждений высшего уровня — V4 Pro. QuickSilver Pro отдаёт Qwen 3.6-35B в режиме без размышлений: ответы прямые, а поле `reasoning` в запросе размышления не включает.

Быстрый старт (curl)

curl https://api.quicksilverpro.io/v1/chat/completions \
  -H "Authorization: Bearer $QSP_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3.6-35b",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

Совместимо с OpenAI. Миграция в одну строку через base_url.

FAQ

Это MoE на 35B параметров, из которых на токен активны только 3B, поэтому она дёшево обслуживается в масштабе и сохраняет сильные рассуждения в математике, кодинге и поиске по длинному контексту. Контекстное окно 262K делает её естественным выбором для RAG по нескольким документам и суммаризации длинных документов. QuickSilver Pro отдаёт её в режиме без размышлений, поэтому ответы прямые, без цепочки рассуждений.

Нет. QuickSilver Pro отдаёт Qwen 3.6-35B в режиме без размышлений, поэтому вы никогда не платите за цепочку размышлений. Поле `reasoning` в запросе размышления не включает; для пошаговых рассуждений используйте модель, которая рассуждает по умолчанию, например DeepSeek V4 Pro.

OpenRouter предлагает Qwen 3.6-35B-A3B по $0.14 за вход / $1.00 за выход за 1M токенов. В QuickSilver Pro — $0.112 / $0.80, на 20% ниже по обеим позициям. Тот же OpenAI-совместимый интерфейс; миграция — это замена base_url и ключа. Уберите префикс провайдера `qwen/` из ID модели.

Попробуйте Qwen3.6-35B-A3B с удвоенным балансом — до $50 бонусных кредитов

Получить API Key