Qwen3.6 Plus · QuickSilver Pro
Qwen 3.6 Plus 是 Alibaba 的 1 万亿参数 MoE 旗舰 —— 规模介于 3.6-35B 和 3.7 Max 之间,拥有 1M 上下文。在 QuickSilver Pro 上,价格为每 1M token 输入 $0.26 / 输出 $1.56,比 OpenRouter 低约 20%,输出比 GPT-4o 低约 10×。对于既想要 3.5/3.6-35B 的价格水平、又需要更深的推理能力和百万 token 上下文的团队,它是最佳平衡点。
概览
生产级推理 + 长上下文 RAG,输出价格比 GPT-4o 低 10×。
价格对比($/1M token)
| 服务商 | 输入 | 输出 | 对比 QSP |
|---|---|---|---|
| QuickSilver Pro | $0.26 | $1.56 | 最低价 |
| OpenRouter (qwen/qwen3.6-plus) | $0.325 | $1.95 | 低 20% |
| OpenAI (GPT-4o) | $2.50 | $10.00 | 低 84% |
适用场景
3.6 Plus 处在生产环境默认选择的位置:相比 3.6-35B 提升不大,却不容跳过;对于重推理的工作负载,成本又低到不容忽视。可以用它做 100K+ token 的多文档 RAG、希望回答质量明显高于 3.6-35B 但又不想付 3.7 Max 价格的面向客户对话、可以接受思考带来的单次调用延迟的 agent 工作流,以及 Qwen 训练数据优势会不断放大的中文任务。
何时该选其他模型
对于 token 预算必须卡紧、要求确定性且不思考的生产环境对话,DeepSeek V4 Flash($0.086/$0.173)配合 `reasoning.enabled=false` 是价格更低的非思考选择。对于 3.6 Plus 在你的评测上明显应付不了的前沿级推理,请升级到 3.7 Max 或 V4 Pro。QuickSilver Pro 以非思考模式提供 3.6 Plus:回复是直接给出的,请求中的 `reasoning` 字段不会开启思考。
快速开始(curl)
curl https://api.quicksilverpro.io/v1/chat/completions \
-H "Authorization: Bearer $QSP_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3.6-plus",
"messages": [{"role": "user", "content": "Hello!"}]
}'兼容 OpenAI。只需改一行 base_url 即可迁移。
常见问题
3.6-35B 是紧凑的 MoE 档(35B 参数,3B 激活,262K 上下文,每 1M token $0.112/$0.80)。3.6 Plus 是往上一档 —— 1T 参数的 MoE,1M 上下文,每 1M token $0.26/$1.56。价格差距不小,但在 3.6-35B 触及上限的地方,回答质量的提升和更宽的上下文值得这个差价。
是的 —— 在 Qwen 系列中,3.6 Plus 是生产环境的默认选择,3.7 Max 是旗舰。两者价格比约为 7-8×(3.6 Plus $0.26/$1.56,3.7 Max $2.0/$6.0)。大多数团队应从 3.6 Plus 起步,再对 3.6 Plus 回答质量明显下降的那部分请求用 3.7 Max 做 A/B 测试。两者共享相同的 1M 上下文和 OpenAI 兼容接口,因此切换只需改一下模型 ID。
OpenRouter 对 Qwen 3.6 Plus 的标价为每 1M token 输入 $0.325 / 输出 $1.95。QuickSilver Pro 为 $0.26 / $1.56 —— 输入输出两端均低约 20%。同样的 OpenAI 兼容接口;迁移只需替换 base_url 和 key(去掉模型 ID 中的 `qwen/` 提供商前缀)。