首页/模型/Kimi K2.6
256K 上下文多模态推理Responses API

Kimi K2.6 · QuickSilver Pro

Kimi K2.6 是 Moonshot 的通用 agent 模型,适用于长程规划、编码和多模态工作。在 QuickSilver Pro 上,价格为每 1M token 输入 $0.5472 / 输出 $2.728,而 Moonshot 官方 API 的价格为 $0.95 / $4.00。OpenAI 没有与之完全对应的模型 —— 如果你的评测在 agent 深度上选中的是 Claude Opus 或 GPT-5,K2.6 就是值得拿来做 A/B 测试的开源对标模型。

每 1M token:输入 $0.5472 · 输出 $2.728
作者Raullen Chai·更新于

概览

上下文
256K token
输入 / 1M
$0.5472
输出 / 1M
$2.728
默认思考
是

看重 Opus 级深度的长程 agent / 规划工作负载。

价格对比($/1M token)

服务商输入输出对比 QSP
QuickSilver Pro$0.5472$2.728最低价
Moonshot AI (moonshotai/kimi-k2.6)$0.95$4.00低 32%

适用场景

需要在长程任务中协调工具的多步规划 agent、需要综合大量文档的研究 / 分析 agent、先规划再行动的复杂代码审查或重构 agent,以及任何 DeepSeek V4 Pro 的纯数学推理无法替代 K2.6 的 agent / 长上下文规划能力的工作负载。256K 的上下文可以容纳相当规模的代码库或研究语料。

何时该选其他模型

日常对话、编码或短上下文任务,用 K2.6 太贵 —— 请用 V4 Flash。纯数学推理,V4 Pro 更胜一筹。需要原生工具生态,选 Claude 或 OpenAI —— 不过我们也提供 Claude,而且我们的 68 个模型中有 35 个支持图像输入。

快速开始(curl)

curl https://api.quicksilverpro.io/v1/chat/completions \
  -H "Authorization: Bearer $QSP_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "kimi-k2.6",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

兼容 OpenAI。只需改一行 base_url 即可迁移。

常见问题

在 Moonshot 随 2026 年 4 月版本公布的评测中,K2.6 在 agent 工具使用基准测试(Tau-bench、SWE-bench Verified)上与 Claude Opus 4 相差无几,在长上下文检索上则领先。做决定之前请先用你自己的评测比对 —— Opus 在生产环境中打磨的时间更长,在某些任务的主观质量上可能仍然胜出。如果你的选型流程选中了 Opus,K2.6 就是值得做 A/B 测试的开源替代方案。

K2.6 是前沿档模型,Moonshot 的服务成本也反映了这一点。QSP 的价格为 $0.5472 / $2.728,而 Moonshot 官方价格为 $0.95 / $4.00,但其底层算力确实比 V4 Flash 更贵。请尽可能使用缓存前缀:QSP 对 K2.6 的缓存读取按 $0.292/M token 计费。

可以 —— K2.6 在 QuickSilver Pro 上是一个 OpenAI 兼容的 chat completions endpoint。设置 base_url=https://api.quicksilverpro.io/v1,粘贴你的 QSP key,使用 model="kimi-k2.6"。流式输出、工具调用、json_schema strict mode 和 usage.cost 统计都可以使用。K2.6 默认开启思考;如需不思考的输出,请传入 `reasoning: { enabled: false }`(不过对于 K2.6 所针对的工作负载,你通常会需要思考过程)。

充值翻倍试用 Kimi K2.6 —— 最高赠送 $50 额度

获取 API Key