контекст 1MМультимодальнаяResponses API

Qwen3.7 Plus в QuickSilver Pro

Qwen 3.7 Plus — хостируемый агентный флагман Alibaba для длительных циклов кодинга и агентов, с вводом текста, изображений и видео и контекстом 1M токенов. В QuickSilver Pro она стоит $0.256 за вход / $1.024 за выход за 1M токенов — на 20% ниже $0.32 / $1.28 у OpenRouter и примерно четверть цены выхода Qwen 3.7 Max.

$0.256 вход · $1.024 выход за 1M токенов
Автор:Raullen Chai·Обновлено

Коротко

Контекст
1M токенов
Вход / 1M
$0.256
Выход / 1M
$1.024
Думает по умолчанию
Нет

Длительные циклы кодинга и агентов — рассуждения почти флагманского уровня при выходе в ~6× дешевле, чем у 3.7 Max.

Сравнение цен ($/1M токенов)

ПровайдерВходВыходк QSP
QuickSilver Pro$0.256$1.024самая низкая цена
OpenRouter (qwen/qwen3.7-plus)$0.32$1.28на 20% ниже
OpenAI (GPT-4o)$2.50$10.00на 90% ниже

Когда использовать

Выбирайте 3.7 Plus для агентных и кодинг-нагрузок, которые идут долго: многочасовые агентные сессии, кодинг-агенты с циклами на сотни вызовов инструментов, мультимодальная работа с документами и анализ длинного контекста до 1M токенов. QuickSilver Pro отдаёт её в режиме без размышлений: ответы прямые, а поле `reasoning` в запросе размышления не включает.

Когда выбрать другую модель

Для самых сложных одношаговых рассуждений следующая ступень — Qwen 3.7 Max; обе теперь дают контекст 1M, так что выбирайте Max ради качества, а не размера окна. Для недорогого мультимодального чата и агентов Qwen 3.7 Flash намного дешевле. В чистой математике и рассуждениях в духе теорем DeepSeek V4 Pro остаётся более дешёвым специалистом.

Быстрый старт (curl)

curl https://api.quicksilverpro.io/v1/chat/completions \
  -H "Authorization: Bearer $QSP_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3.7-plus",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

Совместимо с OpenAI. Миграция в одну строку через base_url.

FAQ

Нет. QuickSilver Pro отдаёт 3.7 Plus в режиме без размышлений, поэтому вызовы возвращают прямой ответ и не оплачивают скрытую цепочку рассуждений. Поле `reasoning` в запросе размышления не включает; если задаче нужна цепочка рассуждений, используйте Qwen 3.7 Max с `enable_thinking=true`.

Обе дают контекст 1M токенов. Max — флагман за $1.25/$3.75 для самых сложных рассуждений; Plus — продакшен-модель для агентов за $0.256/$1.024, примерно в 3.7× дешевле на выходе. Начните с Plus для длительных циклов и переходите на Max только там, где ваши eval-тесты показывают прирост качества.

Именно под это она и настроена. Alibaba позиционирует 3.7 Plus для долгосрочных агентных циклов — демо на запуске было 11-часовой автономной сессией кодинга, — и она говорит на OpenAI-совместимом API chat/tools, так что встаёт в opencode, Cline, Aider и любой агент, который ожидает формат tool calling от OpenAI. Направьте агента на base_url=https://api.quicksilverpro.io/v1 с model="qwen3.7-plus". Прогоните её на собственном наборе задач — бенчмарки вендора это отправная точка, а не гарантия.

OpenRouter предлагает Qwen 3.7 Plus по $0.32 за вход / $1.28 за выход за 1M токенов; в QuickSilver Pro — $0.256 / $1.024, на ~20% ниже по обеим позициям. Тот же OpenAI-совместимый интерфейс chat completions; миграция — это замена base_url и ключа, а ID модели меняется с `qwen/qwen3.7-plus` на алиас QSP `qwen3.7-plus`.

Попробуйте Qwen3.7 Plus с удвоенным балансом — до $50 бонусных кредитов

Получить API Key