Qwen3.8 27B в QuickSilver Pro
Qwen3.8 27B — быстрая открытая модель новейшего поколения Qwen 3.8: 27B с полным для семейства контекстным окном 1M токенов и максимальным выводом 131K. В QuickSilver Pro она стоит $0.34 за вход / $2.04 за выход за миллион токенов — на ~20% ниже собственной списочной цены Alibaba в $0.425 / $2.55. Она отвечает напрямую — никаких невидимых токенов размышлений в вашем счёте.
Коротко
Кодинг-агенты, которым нужен огромный рабочий набор задёшево, — быстрая 27B с контекстным окном 1M токенов.
Сравнение цен ($/1M токенов)
| Провайдер | Вход | Выход | к QSP |
|---|---|---|---|
| QuickSilver Pro | $0.34 | $2.04 | самая низкая цена |
| Alibaba (qwen/qwen3.8-27b) | $0.425 | $2.55 | на 20% ниже |
| OpenAI (GPT-4o mini) | $0.15 | $0.60 | на 240% дороже |
Когда использовать
Выбирайте Qwen3.8 27B, когда ограничением служит рабочий набор, а не сложность как таковая: кодинг-агенты масштаба репозитория, анализ длинных документов и рефакторинг по многим файлам, которым нужно полное окно 1M токенов без флагманских цен. На бенчмарках она стоит рядом с моделями в несколько раз более дорогого ценового класса, и реальный трафик кодинг-агентов уже идёт на неё в продакшене. Прямые ответы сохраняют короткие ходы дешёвыми, а задержку низкой.
Когда выбрать другую модель
Для самых сложных рассуждений при таком размере окна сильнее Qwen3.8 Max и GLM 5.3. Если гигантское окно вам никогда не нужно, GLM 5.3 Flash ($0.06/$0.20) дешевле при таком же свежем обучении 2026 года в своём семействе. Выход тарифицируется по $2.04 за миллион — пайплайнам генерации с большим объёмом вывода стоит сначала сравнить её с DeepSeek V4 Flash.
Быстрый старт (curl)
curl https://api.quicksilverpro.io/v1/chat/completions \
-H "Authorization: Bearer $QSP_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3.8-27b",
"messages": [{"role": "user", "content": "Hello!"}]
}'Совместимо с OpenAI. Миграция в одну строку через base_url.
FAQ
Нет — в QuickSilver Pro Qwen3.8 27B всегда отвечает напрямую, поэтому вы никогда не платите за невидимые токены рассуждений. Этот маршрут обслуживает только профиль прямых ответов; если задаче нужны обдуманные пошаговые рассуждения по схожей цене, используйте GLM 5.3 Flash, где глубокие рассуждения включены всегда.
Да — полное окно в 1,000,000 токенов и до 131K выходных токенов на вызов, причём QuickSilver Pro использует маршрут, на котором эти лимиты действительно соблюдаются. Вызовы с длинным контекстом тарифицируются по тем же фиксированным $0.34 за миллион входных токенов.
Да — Qwen3.8 27B в QuickSilver Pro — это OpenAI-совместимый endpoint chat completions (Responses API тоже работает). Укажите base_url=https://api.quicksilverpro.io/v1, вставьте свой ключ QSP и используйте model="qwen3.8-27b". Streaming, tool calling и учёт usage.cost — всё работает.
Alibaba предлагает Qwen3.8 27B по $0.425 за вход / $2.55 за выход за миллион токенов; в QuickSilver Pro — $0.34 / $2.04, на ~20% ниже по обеим позициям. Тот же OpenAI-совместимый интерфейс; миграция — это замена base_url и ключа, плюс нужно убрать префикс провайдера `qwen/` из ID модели.