Главная/Модели/Qwen3.8 Omni Flash
контекст 1MМультимодальнаяReasoningResponses API

Qwen3.8 Omni Flash в QuickSilver Pro

Qwen3.8 Omni Flash — первая агентная omni-модель Qwen: один endpoint, который нативно понимает изображения, аудио и видео наряду с текстом, рассуждает над тем, что видит и слышит, и управляет инструментами в длинных рабочих процессах. Она сохраняет полное для семейства контекстное окно 1M токенов и максимальный вывод 131K. В QuickSilver Pro она стоит $0.15 за вход / $0.47 за выход за миллион токенов — единая ставка для всех модальностей, по собственной цене Alibaba, с тем же OpenAI-совместимым ключом и балансом в USD, что и остальной каталог.

$0.15 вход · $0.47 выход за 1M токенов
Автор:Raullen Chai·Обновлено

Коротко

Контекст
1M токенов
Вход / 1M
$0.15
Выход / 1M
$0.47
Думает по умолчанию
Нет

Агентное понимание аудио и видео на одном omni-endpoint — изображения, аудио, видео и инструменты в окне 1M токенов.

Сравнение цен ($/1M токенов)

ПровайдерВходВыходк QSP
QuickSilver Pro$0.15$0.47—
Alibaba (qwen3.8-omni-flash)$0.15$0.47так же
OpenAI (GPT-4o)$2.50$10.00на 95% ниже

Когда использовать

Выбирайте Qwen3.8 Omni Flash, когда один запрос должен рассуждать сразу по нескольким модальностям: расшифровать и резюмировать звонок, вытащить ключевые моменты из длинного видео, подписать изображение или ответить на вопросы по нему, запустить агента, который смотрит на экран и действует через инструменты. Каждая входная модальность — текст, изображение, аудио, видео — тарифицируется по одной и той же низкой потокенной ставке, поэтому пайплайны со смешанными медиа остаются дешёвыми, а окно 1M токенов позволяет держать длинную запись или целый набор документов в контексте, не разбивая на куски. Alibaba настраивает её под агентное выполнение: она планирует задачу и выполняет её с помощью инструментов, а не только описывает содержимое — относитесь к этому как к заявлениям вендора и сверяйте со своими eval-тестами.

Когда выбрать другую модель

Для самых сложных одношаговых текстовых рассуждений переходите на Qwen3.8 Max или GLM 5.3. Если ваша нагрузка — чистый текст без медиа, Qwen3.8 Flash Next дешевле и без omni-механики. Размышления по умолчанию подавлены, чтобы flash-уровень оставался быстрым; если нужна видимая цепочка рассуждений, передайте enable_thinking=true и заложите бюджет на дополнительные выходные токены. Модель только что вышла, и её поведение может меняться с ревизиями апстрима — зафиксируйте свои eval-тесты, если нужна неизменная цель.

Быстрый старт (curl)

curl https://api.quicksilverpro.io/v1/chat/completions \
  -H "Authorization: Bearer $QSP_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3.8-omni-flash",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

Совместимо с OpenAI. Миграция в одну строку через base_url.

FAQ

Текст, изображения, аудио и видео — нативно, в одной модели: она рассуждает совместно над тем, что видит и слышит, а не отправляет каждую модальность в отдельный пайплайн. На выходе — текст. В QuickSilver Pro каждая входная модальность тарифицируется по одним и тем же $0.15 за миллион токенов: Alibaba токенизирует каждую модальность и берёт единую цену за вход, так что отдельной ставки на аудио или видео закладывать не нужно.

$0.15 за вход / $0.47 за выход за миллион токенов, чтение кэшированного входа — $0.016; единая ставка для текста, изображений, аудио и видео. Это совпадает с собственным прайс-листом Alibaba; QuickSilver Pro добавляет один OpenAI-совместимый ключ и один баланс в USD на весь каталог — отдельный аккаунт Alibaba заводить не нужно. Миграция — это замена base_url и ключа.

Да — полное окно 1M токенов и до 131K выходных токенов на вызов, причём оно распространяется и на медиа, а не только на текст: длинный видео- или аудиофайл после токенизации делит то же окно. Вызовы с длинным контекстом тарифицируются по тем же фиксированным $0.15 за миллион входных токенов.

Да — Qwen3.8 Omni Flash в QuickSilver Pro — это OpenAI-совместимый endpoint Chat Completions (Responses API тоже работает). Укажите base_url=https://api.quicksilverpro.io/v1, вставьте свой ключ QSP и используйте model="qwen3.8-omni-flash". Мультимодальные content parts, streaming, tool calling и учёт usage.cost — всё работает. Размышления по умолчанию выключены; передайте enable_thinking=true, чтобы включить видимую цепочку рассуждений.

Попробуйте Qwen3.8 Omni Flash с удвоенным балансом — до $50 бонусных кредитов

Получить API Key