контекст 1MResponses API

Qwen3.8 27B в QuickSilver Pro

Qwen3.8 27B — быстрая открытая модель новейшего поколения Qwen 3.8: 27B с полным для семейства контекстным окном 1M токенов и максимальным выводом 131K. В QuickSilver Pro она стоит $0.34 за вход / $2.04 за выход за миллион токенов — на ~20% ниже собственной списочной цены Alibaba в $0.425 / $2.55. Она отвечает напрямую — никаких невидимых токенов размышлений в вашем счёте.

$0.34 вход · $2.04 выход за 1M токенов
Автор:Raullen Chai·Обновлено

Коротко

Контекст
1M токенов
Вход / 1M
$0.34
Выход / 1M
$2.04
Думает по умолчанию
Нет

Кодинг-агенты, которым нужен огромный рабочий набор задёшево, — быстрая 27B с контекстным окном 1M токенов.

Сравнение цен ($/1M токенов)

ПровайдерВходВыходк QSP
QuickSilver Pro$0.34$2.04самая низкая цена
Alibaba (qwen/qwen3.8-27b)$0.425$2.55на 20% ниже
OpenAI (GPT-4o mini)$0.15$0.60на 240% дороже

Когда использовать

Выбирайте Qwen3.8 27B, когда ограничением служит рабочий набор, а не сложность как таковая: кодинг-агенты масштаба репозитория, анализ длинных документов и рефакторинг по многим файлам, которым нужно полное окно 1M токенов без флагманских цен. На бенчмарках она стоит рядом с моделями в несколько раз более дорогого ценового класса, и реальный трафик кодинг-агентов уже идёт на неё в продакшене. Прямые ответы сохраняют короткие ходы дешёвыми, а задержку низкой.

Когда выбрать другую модель

Для самых сложных рассуждений при таком размере окна сильнее Qwen3.8 Max и GLM 5.3. Если гигантское окно вам никогда не нужно, GLM 5.3 Flash ($0.06/$0.20) дешевле при таком же свежем обучении 2026 года в своём семействе. Выход тарифицируется по $2.04 за миллион — пайплайнам генерации с большим объёмом вывода стоит сначала сравнить её с DeepSeek V4 Flash.

Быстрый старт (curl)

curl https://api.quicksilverpro.io/v1/chat/completions \
  -H "Authorization: Bearer $QSP_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3.8-27b",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

Совместимо с OpenAI. Миграция в одну строку через base_url.

FAQ

Нет — в QuickSilver Pro Qwen3.8 27B всегда отвечает напрямую, поэтому вы никогда не платите за невидимые токены рассуждений. Этот маршрут обслуживает только профиль прямых ответов; если задаче нужны обдуманные пошаговые рассуждения по схожей цене, используйте GLM 5.3 Flash, где глубокие рассуждения включены всегда.

Да — полное окно в 1,000,000 токенов и до 131K выходных токенов на вызов, причём QuickSilver Pro использует маршрут, на котором эти лимиты действительно соблюдаются. Вызовы с длинным контекстом тарифицируются по тем же фиксированным $0.34 за миллион входных токенов.

Да — Qwen3.8 27B в QuickSilver Pro — это OpenAI-совместимый endpoint chat completions (Responses API тоже работает). Укажите base_url=https://api.quicksilverpro.io/v1, вставьте свой ключ QSP и используйте model="qwen3.8-27b". Streaming, tool calling и учёт usage.cost — всё работает.

Alibaba предлагает Qwen3.8 27B по $0.425 за вход / $2.55 за выход за миллион токенов; в QuickSilver Pro — $0.34 / $2.04, на ~20% ниже по обеим позициям. Тот же OpenAI-совместимый интерфейс; миграция — это замена base_url и ключа, плюс нужно убрать префикс провайдера `qwen/` из ID модели.

Попробуйте Qwen3.8 27B с удвоенным балансом — до $50 бонусных кредитов

Получить API Key