Kimi K2.7 Code в QuickSilver Pro
Kimi K2.7 Code — версия K2 от Moonshot, настроенная под кодинг: та же архитектура на триллион параметров (32B активных, контекст 256K), что и у K2.6, перенастроенная под долгосрочный агентный кодинг. В QuickSilver Pro она стоит $0.584 за вход / $2.80 за выход за 1M токенов — на 20% ниже, чем у OpenRouter: $0.73 / $3.50. По данным Moonshot, она тратит на ~30% меньше токенов рассуждений на задачу, чем K2.6, и при этом набирает больше на eval-тестах по кодингу.
Коротко
Долгосрочный агентный кодинг — настроенная под кодинг K2 от Moonshot с меньшими накладными расходами на токены рассуждений, чем у K2.6.
Сравнение цен ($/1M токенов)
| Провайдер | Вход | Выход | к QSP |
|---|---|---|---|
| QuickSilver Pro | $0.584 | $2.80 | самая низкая цена |
| OpenRouter (moonshotai/kimi-k2.7-code) | $0.73 | $3.50 | на 20% ниже |
Когда использовать
Выбирайте K2.7 Code как движок кодинг-агента (opencode, Cline, Aider и циклы в стиле Claude Code): многошаговый рефакторинг, изменения по всему репозиторию и агенты формата «сначала план, потом действие», координирующие множество вызовов инструментов на рабочем наборе в 256K токенов. Она настроена именно под ту траекторию долгосрочного агентного кодинга, где многословные рассуждения перечитываются на каждом ходу: по данным Moonshot, результаты на eval-тестах по кодингу выше при ~30% меньшем числе токенов рассуждений, чем у K2.6.
Когда выбрать другую модель
Для рутинного чата, генерации кода на коротком контексте и неагентных одношаговых задач такая потокенная цена избыточна — DeepSeek V4 Flash ($0.086/$0.173) или V4 Pro ($0.70/$2.10) справляются с большинством из них дешевле. Для чисто математических рассуждений — DeepSeek V4 Pro. Для общего (не связанного с кодингом) агентного планирования уровня Opus сравните A/B-тестом с родственной Kimi K2.6.
Быстрый старт (curl)
curl https://api.quicksilverpro.io/v1/chat/completions \
-H "Authorization: Bearer $QSP_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "kimi-k2.7-code",
"messages": [{"role": "user", "content": "Hello!"}]
}'Совместимо с OpenAI. Миграция в одну строку через base_url.
FAQ
Та же архитектура K2 — триллион параметров, 32B активных, контекст 256K, — но K2.7 Code перенастроена именно под долгосрочный агентный кодинг. Опубликованные Moonshot цифры показывают более высокие результаты на eval-тестах по кодингу (Kimi Code Bench v2, Program Bench, MLS Bench Lite) при ~30% меньшем числе токенов рассуждений на задачу, чем у K2.6. В агентных циклах рассуждения каждого хода перечитываются как вход на следующем, поэтому меньше токенов рассуждений — это ниже стоимость завершённой задачи, а не только отдельного вызова. K2.6 остаётся лучшим выбором для общего (не связанного с кодингом) агентного планирования; сравните обе A/B-тестом на своей нагрузке.
Да — K2.7 Code — это OpenAI-совместимый endpoint chat completions. Направьте агента на base_url=https://api.quicksilverpro.io/v1, вставьте свой ключ QSP и укажите model="kimi-k2.7-code". Streaming, tool calling и strict-режим json_schema — всё работает, а `usage.cost` возвращается в каждом ответе, так что стоимость задачи можно отслеживать напрямую.
OpenRouter предлагает K2.7 Code по $0.73 за вход / $3.50 за выход за 1M токенов; в QuickSilver Pro — $0.584 / $2.80, на 20% ниже по обеим позициям. Чтение из кэша — $0.1278/M. Тот же OpenAI-совместимый интерфейс; миграция — это замена base_url и ключа, плюс нужно убрать префикс провайдера `moonshotai/`.
Нет. K2.7 Code думает всегда: `reasoning: { enabled: false }` отклоняется. Не передавайте переопределения параметров сэмплирования, если они не совпадают с фиксированными значениями Moonshot: temperature=1.0, top_p=0.95, n=1, presence_penalty=0 и frequency_penalty=0. tool_choice поддерживает `auto` или `none`.