контекст 256KМультимодальнаяReasoningResponses API

Kimi K2.6 в QuickSilver Pro

Kimi K2.6 — универсальная агентная модель Moonshot для долгосрочного планирования, кодинга и мультимодальной работы. В QuickSilver Pro она стоит $0.5472 за вход / $2.728 за выход за 1M токенов против $0.95 / $4.00 в собственном API Moonshot. Прямого аналога у OpenAI нет — если ваши eval-тесты выбирают Claude Opus или GPT-5 ради агентной глубины, K2.6 — сопоставимая open-source модель для A/B-теста.

$0.5472 вход · $2.728 выход за 1M токенов
Автор:Raullen Chai·Обновлено

Коротко

Контекст
256K токенов
Вход / 1M
$0.5472
Выход / 1M
$2.728
Думает по умолчанию
Да

Долгосрочные агентные задачи и планирование, где важна глубина уровня Opus.

Сравнение цен ($/1M токенов)

ПровайдерВходВыходк QSP
QuickSilver Pro$0.5472$2.728самая низкая цена
Moonshot AI (moonshotai/kimi-k2.6)$0.95$4.00на 32% ниже

Когда использовать

Агенты многошагового планирования, которым нужно координировать инструменты на длинных горизонтах; исследовательские и аналитические агенты, синтезирующие выводы по множеству документов; сложные агенты для code review или рефакторинга, которые планируют, прежде чем действовать; и любая нагрузка, где чисто математические рассуждения DeepSeek V4 Pro — не то же самое, что агентное планирование на длинном контексте у K2.6. В контекст 256K помещается солидная кодовая база или исследовательский корпус.

Когда выбрать другую модель

Для рутинного чата, кодинга и задач с коротким контекстом K2.6 слишком дорога — используйте V4 Flash. В чисто математических рассуждениях выигрывает V4 Pro. Если нужна нативная экосистема инструментов — Claude или OpenAI; впрочем, Claude мы тоже отдаём, а 35 из наших 68 моделей принимают изображения.

Быстрый старт (curl)

curl https://api.quicksilverpro.io/v1/chat/completions \
  -H "Authorization: Bearer $QSP_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "kimi-k2.6",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

Совместимо с OpenAI. Миграция в одну строку через base_url.

FAQ

На eval-тестах, которые Moonshot опубликовала вместе с релизом в апреле 2026 года, K2.6 почти вплотную подходит к Claude Opus 4 на агентных бенчмарках работы с инструментами (Tau-bench, SWE-bench Verified) и опережает её в поиске по длинному контексту. Прежде чем принимать решение, сверьтесь со своими eval-тестами — Opus дольше дорабатывалась в продакшене и на некоторых задачах всё ещё может выигрывать по субъективному качеству. Если ваш процесс отбора выбирает Opus, K2.6 — open-source альтернатива, которую стоит проверить A/B-тестом.

K2.6 — модель передового уровня, и стоимость её обслуживания у Moonshot это отражает. В QSP — $0.5472 / $2.728 против $0.95 / $4.00 в собственном API Moonshot, но вычисления под ней действительно дороже, чем у V4 Flash. По возможности используйте кэшированные префиксы: QSP тарифицирует чтение из кэша для K2.6 по $0.292/M токенов.

Да — K2.6 в QuickSilver Pro — это OpenAI-совместимый endpoint chat completions. Укажите base_url=https://api.quicksilverpro.io/v1, вставьте свой ключ QSP и используйте model="kimi-k2.6". Streaming, tool calling, strict-режим json_schema и учёт usage.cost — всё работает. K2.6 думает по умолчанию; передайте `reasoning: { enabled: false }` для вывода без размышлений (хотя на нагрузках, под которые K2.6 создана, цепочка размышлений обычно нужна).

Попробуйте Kimi K2.6 с удвоенным балансом — до $50 бонусных кредитов

Получить API Key