Muse Glimmer 30B в QuickSilver Pro
Muse Glimmer 30B — плотная мультимодальная модель Meta на 30B параметров с открытыми весами, дистиллированная из Muse Spark и настроенная под автономных агентов: длительная работа с инструментами и расширенный reasoning в контексте на 131,072 токенов. На QuickSilver Pro она стоит $0.28 за вход / $1.20 за выход за миллион токенов — на 20% ниже каталожной цены OpenRouter $0.35 / $1.50 и на входе, и на выходе.
Коротко
Бюджетные агенты для длинных задач и повседневный кодинг с reasoning в стиле Muse Spark за малую долю цены, в контексте на 131,072 токенов.
Сравнение цен ($/1M токенов)
| Провайдер | Вход | Выход | к QSP |
|---|---|---|---|
| QuickSilver Pro | $0.28 | $1.20 | самая низкая цена |
| OpenRouter (meta/muse-glimmer-30b) | $0.35 | $1.50 | на 20% ниже |
Когда использовать
Берите Muse Glimmer 30B, когда нужен агентный стиль Muse Spark по цене небольшой модели: повседневные циклы кодинга, агенты с tool calling, которые планируют и итерируют на протяжении многих шагов, и пакетные нагрузки, где основная статья расходов — токены. Модель принимает изображения вместе с текстом, так что агент может итерировать по скриншотам и отрендеренному результату, а контекста на 131,072 токенов хватает на солидный рабочий набор.
Когда выбрать другую модель
Для рабочих наборов масштаба репозитория её потолок — 131,072 токенов: переходите на Muse Spark 1.2 ($1.00/$3.40, контекст 1M) или Kimi K3, когда в контексте должен оставаться весь репозиторий. Reasoning здесь обязателен, поэтому модель тратит выходные токены даже на тривиальных репликах; сдерживайте это через `reasoning_effort: "low"` там, где важна стоимость, или используйте DeepSeek V4 Flash ($0.086/$0.173) для массовых одиночных вызовов, которым размышления не нужны вовсе.
Быстрый старт (curl)
curl https://api.quicksilverpro.io/v1/chat/completions \
-H "Authorization: Bearer $QSP_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "muse-glimmer-30b",
"messages": [{"role": "user", "content": "Hello!"}]
}'Совместимо с OpenAI. Миграция в одну строку через base_url.
FAQ
Glimmer — младшая модель с открытыми весами: плотная 30B-модель, дистиллированная из Muse Spark и настроенная под автономных агентов, примерно за треть потокенной цены Spark и с контекстом на 131,072 токенов против 1M у Spark. Spark остаётся выбором для кодинга в масштабе репозитория и самых сложных длительных задач; Glimmer закрывает повседневные агентные циклы, где стоимость и скорость итераций важнее пиковых возможностей. Обе модели принимают на вход текст и изображения и рассуждают перед ответом.
Reasoning включён всегда — как и у Muse Spark, на этом endpoint он обязателен и не отключается. Используйте `reasoning_effort` (`low`, `medium`, `high` или `xhigh`; по умолчанию `medium`), чтобы выбрать баланс между глубиной, задержкой и стоимостью. Reasoning-токены расходуются из бюджета `max_tokens` до видимого ответа, поэтому задавайте `max_tokens` с запасом — 1024 или больше, — иначе ответ может вернуться пустым: бюджет уйдёт на размышления.
OpenRouter указывает $0.35 за вход / $1.50 за выход за миллион токенов; на QuickSilver Pro — $0.28 / $1.20, на 20% ниже и на входе, и на выходе, а кэшированный вход стоит $0.032. Тот же OpenAI-совместимый интерфейс: направьте base_url на https://api.quicksilverpro.io/v1 и используйте model="muse-glimmer-30b", убрав префикс провайдера `meta/`.
Да — это OpenAI-совместимый endpoint chat completions, доступен и Responses API. Streaming, tool calling и strict-режим json_schema работают, модель принимает изображения на вход. Укажите base_url=https://api.quicksilverpro.io/v1 и model="muse-glimmer-30b" в любом агентном фреймворке на базе OpenAI SDK.