首页/模型/Qwen3.6 Plus
1M 上下文Responses API

Qwen3.6 Plus · QuickSilver Pro

Qwen 3.6 Plus 是 Alibaba 的 1 万亿参数 MoE 旗舰 —— 规模介于 3.6-35B 和 3.7 Max 之间,拥有 1M 上下文。在 QuickSilver Pro 上,价格为每 1M token 输入 $0.26 / 输出 $1.56,比 OpenRouter 低约 20%,输出比 GPT-4o 低约 10×。对于既想要 3.5/3.6-35B 的价格水平、又需要更深的推理能力和百万 token 上下文的团队,它是最佳平衡点。

每 1M token:输入 $0.26 · 输出 $1.56
作者Raullen Chai·更新于

概览

上下文
1M token
输入 / 1M
$0.26
输出 / 1M
$1.56
默认思考
否

生产级推理 + 长上下文 RAG,输出价格比 GPT-4o 低 10×。

价格对比($/1M token)

服务商输入输出对比 QSP
QuickSilver Pro$0.26$1.56最低价
OpenRouter (qwen/qwen3.6-plus)$0.325$1.95低 20%
OpenAI (GPT-4o)$2.50$10.00低 84%

适用场景

3.6 Plus 处在生产环境默认选择的位置:相比 3.6-35B 提升不大,却不容跳过;对于重推理的工作负载,成本又低到不容忽视。可以用它做 100K+ token 的多文档 RAG、希望回答质量明显高于 3.6-35B 但又不想付 3.7 Max 价格的面向客户对话、可以接受思考带来的单次调用延迟的 agent 工作流,以及 Qwen 训练数据优势会不断放大的中文任务。

何时该选其他模型

对于 token 预算必须卡紧、要求确定性且不思考的生产环境对话,DeepSeek V4 Flash($0.086/$0.173)配合 `reasoning.enabled=false` 是价格更低的非思考选择。对于 3.6 Plus 在你的评测上明显应付不了的前沿级推理,请升级到 3.7 Max 或 V4 Pro。QuickSilver Pro 以非思考模式提供 3.6 Plus:回复是直接给出的,请求中的 `reasoning` 字段不会开启思考。

快速开始(curl)

curl https://api.quicksilverpro.io/v1/chat/completions \
  -H "Authorization: Bearer $QSP_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3.6-plus",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

兼容 OpenAI。只需改一行 base_url 即可迁移。

常见问题

3.6-35B 是紧凑的 MoE 档(35B 参数,3B 激活,262K 上下文,每 1M token $0.112/$0.80)。3.6 Plus 是往上一档 —— 1T 参数的 MoE,1M 上下文,每 1M token $0.26/$1.56。价格差距不小,但在 3.6-35B 触及上限的地方,回答质量的提升和更宽的上下文值得这个差价。

是的 —— 在 Qwen 系列中,3.6 Plus 是生产环境的默认选择,3.7 Max 是旗舰。两者价格比约为 7-8×(3.6 Plus $0.26/$1.56,3.7 Max $2.0/$6.0)。大多数团队应从 3.6 Plus 起步,再对 3.6 Plus 回答质量明显下降的那部分请求用 3.7 Max 做 A/B 测试。两者共享相同的 1M 上下文和 OpenAI 兼容接口,因此切换只需改一下模型 ID。

OpenRouter 对 Qwen 3.6 Plus 的标价为每 1M token 输入 $0.325 / 输出 $1.95。QuickSilver Pro 为 $0.26 / $1.56 —— 输入输出两端均低约 20%。同样的 OpenAI 兼容接口;迁移只需替换 base_url 和 key(去掉模型 ID 中的 `qwen/` 提供商前缀)。

充值翻倍试用 Qwen3.6 Plus —— 最高赠送 $50 额度

获取 API Key