262K 上下文Responses API

Hy3 · QuickSilver Pro

Hy3 是 Tencent 以 Apache-2.0 协议发布的开放权重 295B Mixture-of-Experts 模型(激活参数 21B),拥有 262K token 的上下文。QuickSilver Pro 固定走 Tencent 的官方路由,每 1M token 收费输入 $0.091 / 输出 $0.363,与 Tencent 自家的 $0.0825 / $0.33 价格相差约 10% 以内。

每 1M token:输入 $0.091 · 输出 $0.363
作者Raullen Chai·更新于

概览

上下文
262K token
输入 / 1M
$0.091
输出 / 1M
$0.363
默认思考
否

Tencent 的 Apache-2.0 295B MoE(激活参数 21B),面向 262K token 上下文内的通用编码和 agent 工作流。

价格对比($/1M token)

服务商输入输出对比 QSP
QuickSilver Pro$0.091$0.363—
OpenRouter (tencent/hy3)$0.0825$0.33贵 10%

适用场景

能放进 262K token 上下文的通用编码和 agent 工作流,选 Hy3:多文件编辑、使用工具的 agent,以及日常代码生成。Tencent 以 Apache-2.0 协议发布它,这是一个 295B 的 Mixture-of-Experts 模型,每个 token 激活 21B 参数,所以你能以中档的每 token 价格获得大模型的知识储备。Tencent 公布的 SWE-Bench Verified 成绩约为 78。

何时该选其他模型

对于需要超过 262K token 上下文的任务,请使用 1M 上下文的模型,例如 Qwen 3.7 Flash、MiniMax M3 或 Kimi K3。追求最低 token 价格的话,Qwen 3.7 Flash 更便宜;需要前沿推理的话,请使用 DeepSeek V4 Pro 或 Kimi K3。

快速开始(curl)

curl https://api.quicksilverpro.io/v1/chat/completions \
  -H "Authorization: Bearer $QSP_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "hy3",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

兼容 OpenAI。只需改一行 base_url 即可迁移。

常见问题

按 Tencent 的介绍,Hy3 是一个以 Apache-2.0 协议发布的开放权重 295B 参数 Mixture-of-Experts 模型,每个 token 激活 21B 参数,拥有 262K token 的上下文窗口。QuickSilver Pro 以非思考模式提供该模型,因此回复直接给出,不带推理轨迹。

可以 —— Hy3 在 QuickSilver Pro 上是一个 OpenAI 兼容的 chat completions endpoint。设置 base_url=https://api.quicksilverpro.io/v1,填入你的 QSP key,并使用 model="hy3"。流式输出、工具调用、json_schema strict mode 和 usage.cost 统计都可用。迁移只需更换 base_url 和 key,并去掉模型 ID 中的 `tencent/` 提供商前缀。

QuickSilver Pro 对 Hy3 的标价是每 1M token 输入 $0.091 / 输出 $0.363,比 Tencent 自家在 OpenRouter 上的价格 $0.0825 / $0.33 高约 10%。QSP 固定走 Tencent 的官方 endpoint,以保证推理行为一致;迁移时去掉 `tencent/` 前缀即可。

充值翻倍试用 Hy3 —— 最高赠送 $50 额度

获取 API Key