контекст 256KReasoningResponses API

Kimi K2.7 Code в QuickSilver Pro

Kimi K2.7 Code — версия K2 от Moonshot, настроенная под кодинг: та же архитектура на триллион параметров (32B активных, контекст 256K), что и у K2.6, перенастроенная под долгосрочный агентный кодинг. В QuickSilver Pro она стоит $0.584 за вход / $2.80 за выход за 1M токенов — на 20% ниже, чем у OpenRouter: $0.73 / $3.50. По данным Moonshot, она тратит на ~30% меньше токенов рассуждений на задачу, чем K2.6, и при этом набирает больше на eval-тестах по кодингу.

$0.584 вход · $2.80 выход за 1M токенов
Автор:Raullen Chai·Обновлено

Коротко

Контекст
256K токенов
Вход / 1M
$0.584
Выход / 1M
$2.80
Думает по умолчанию
Да

Долгосрочный агентный кодинг — настроенная под кодинг K2 от Moonshot с меньшими накладными расходами на токены рассуждений, чем у K2.6.

Сравнение цен ($/1M токенов)

ПровайдерВходВыходк QSP
QuickSilver Pro$0.584$2.80самая низкая цена
OpenRouter (moonshotai/kimi-k2.7-code)$0.73$3.50на 20% ниже

Когда использовать

Выбирайте K2.7 Code как движок кодинг-агента (opencode, Cline, Aider и циклы в стиле Claude Code): многошаговый рефакторинг, изменения по всему репозиторию и агенты формата «сначала план, потом действие», координирующие множество вызовов инструментов на рабочем наборе в 256K токенов. Она настроена именно под ту траекторию долгосрочного агентного кодинга, где многословные рассуждения перечитываются на каждом ходу: по данным Moonshot, результаты на eval-тестах по кодингу выше при ~30% меньшем числе токенов рассуждений, чем у K2.6.

Когда выбрать другую модель

Для рутинного чата, генерации кода на коротком контексте и неагентных одношаговых задач такая потокенная цена избыточна — DeepSeek V4 Flash ($0.086/$0.173) или V4 Pro ($0.70/$2.10) справляются с большинством из них дешевле. Для чисто математических рассуждений — DeepSeek V4 Pro. Для общего (не связанного с кодингом) агентного планирования уровня Opus сравните A/B-тестом с родственной Kimi K2.6.

Быстрый старт (curl)

curl https://api.quicksilverpro.io/v1/chat/completions \
  -H "Authorization: Bearer $QSP_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "kimi-k2.7-code",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

Совместимо с OpenAI. Миграция в одну строку через base_url.

FAQ

Та же архитектура K2 — триллион параметров, 32B активных, контекст 256K, — но K2.7 Code перенастроена именно под долгосрочный агентный кодинг. Опубликованные Moonshot цифры показывают более высокие результаты на eval-тестах по кодингу (Kimi Code Bench v2, Program Bench, MLS Bench Lite) при ~30% меньшем числе токенов рассуждений на задачу, чем у K2.6. В агентных циклах рассуждения каждого хода перечитываются как вход на следующем, поэтому меньше токенов рассуждений — это ниже стоимость завершённой задачи, а не только отдельного вызова. K2.6 остаётся лучшим выбором для общего (не связанного с кодингом) агентного планирования; сравните обе A/B-тестом на своей нагрузке.

Да — K2.7 Code — это OpenAI-совместимый endpoint chat completions. Направьте агента на base_url=https://api.quicksilverpro.io/v1, вставьте свой ключ QSP и укажите model="kimi-k2.7-code". Streaming, tool calling и strict-режим json_schema — всё работает, а `usage.cost` возвращается в каждом ответе, так что стоимость задачи можно отслеживать напрямую.

OpenRouter предлагает K2.7 Code по $0.73 за вход / $3.50 за выход за 1M токенов; в QuickSilver Pro — $0.584 / $2.80, на 20% ниже по обеим позициям. Чтение из кэша — $0.1278/M. Тот же OpenAI-совместимый интерфейс; миграция — это замена base_url и ключа, плюс нужно убрать префикс провайдера `moonshotai/`.

Нет. K2.7 Code думает всегда: `reasoning: { enabled: false }` отклоняется. Не передавайте переопределения параметров сэмплирования, если они не совпадают с фиксированными значениями Moonshot: temperature=1.0, top_p=0.95, n=1, presence_penalty=0 и frequency_penalty=0. tool_choice поддерживает `auto` или `none`.

Попробуйте Kimi K2.7 Code с удвоенным балансом — до $50 бонусных кредитов

Получить API Key