Главная/Модели/Muse Glimmer 30B
контекст 131,072МультимодальнаяReasoningResponses API

Muse Glimmer 30B в QuickSilver Pro

Muse Glimmer 30B — плотная мультимодальная модель Meta на 30B параметров с открытыми весами, дистиллированная из Muse Spark и настроенная под автономных агентов: длительная работа с инструментами и расширенный reasoning в контексте на 131,072 токенов. На QuickSilver Pro она стоит $0.28 за вход / $1.20 за выход за миллион токенов — на 20% ниже каталожной цены OpenRouter $0.35 / $1.50 и на входе, и на выходе.

$0.28 вход · $1.20 выход за 1M токенов
Автор:Raullen Chai·Обновлено

Коротко

Контекст
131,072 токенов
Вход / 1M
$0.28
Выход / 1M
$1.20
Думает по умолчанию
Да

Бюджетные агенты для длинных задач и повседневный кодинг с reasoning в стиле Muse Spark за малую долю цены, в контексте на 131,072 токенов.

Сравнение цен ($/1M токенов)

ПровайдерВходВыходк QSP
QuickSilver Pro$0.28$1.20самая низкая цена
OpenRouter (meta/muse-glimmer-30b)$0.35$1.50на 20% ниже

Когда использовать

Берите Muse Glimmer 30B, когда нужен агентный стиль Muse Spark по цене небольшой модели: повседневные циклы кодинга, агенты с tool calling, которые планируют и итерируют на протяжении многих шагов, и пакетные нагрузки, где основная статья расходов — токены. Модель принимает изображения вместе с текстом, так что агент может итерировать по скриншотам и отрендеренному результату, а контекста на 131,072 токенов хватает на солидный рабочий набор.

Когда выбрать другую модель

Для рабочих наборов масштаба репозитория её потолок — 131,072 токенов: переходите на Muse Spark 1.2 ($1.00/$3.40, контекст 1M) или Kimi K3, когда в контексте должен оставаться весь репозиторий. Reasoning здесь обязателен, поэтому модель тратит выходные токены даже на тривиальных репликах; сдерживайте это через `reasoning_effort: "low"` там, где важна стоимость, или используйте DeepSeek V4 Flash ($0.086/$0.173) для массовых одиночных вызовов, которым размышления не нужны вовсе.

Быстрый старт (curl)

curl https://api.quicksilverpro.io/v1/chat/completions \
  -H "Authorization: Bearer $QSP_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "muse-glimmer-30b",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

Совместимо с OpenAI. Миграция в одну строку через base_url.

FAQ

Glimmer — младшая модель с открытыми весами: плотная 30B-модель, дистиллированная из Muse Spark и настроенная под автономных агентов, примерно за треть потокенной цены Spark и с контекстом на 131,072 токенов против 1M у Spark. Spark остаётся выбором для кодинга в масштабе репозитория и самых сложных длительных задач; Glimmer закрывает повседневные агентные циклы, где стоимость и скорость итераций важнее пиковых возможностей. Обе модели принимают на вход текст и изображения и рассуждают перед ответом.

Reasoning включён всегда — как и у Muse Spark, на этом endpoint он обязателен и не отключается. Используйте `reasoning_effort` (`low`, `medium`, `high` или `xhigh`; по умолчанию `medium`), чтобы выбрать баланс между глубиной, задержкой и стоимостью. Reasoning-токены расходуются из бюджета `max_tokens` до видимого ответа, поэтому задавайте `max_tokens` с запасом — 1024 или больше, — иначе ответ может вернуться пустым: бюджет уйдёт на размышления.

OpenRouter указывает $0.35 за вход / $1.50 за выход за миллион токенов; на QuickSilver Pro — $0.28 / $1.20, на 20% ниже и на входе, и на выходе, а кэшированный вход стоит $0.032. Тот же OpenAI-совместимый интерфейс: направьте base_url на https://api.quicksilverpro.io/v1 и используйте model="muse-glimmer-30b", убрав префикс провайдера `meta/`.

Да — это OpenAI-совместимый endpoint chat completions, доступен и Responses API. Streaming, tool calling и strict-режим json_schema работают, модель принимает изображения на вход. Укажите base_url=https://api.quicksilverpro.io/v1 и model="muse-glimmer-30b" в любом агентном фреймворке на базе OpenAI SDK.

Попробуйте Muse Glimmer 30B с удвоенным балансом — до $50 бонусных кредитов

Получить API Key