首页/模型/Qwen3.6-35B-A3B
262K 上下文Responses API

Qwen3.6-35B-A3B · QuickSilver Pro

Qwen 3.6-35B-A3B 是 Alibaba 的 MoE 主力模型 —— 35B 参数,每个 token 激活 3B,262K 上下文窗口,以极低的服务成本提供强劲的推理能力。在 QuickSilver Pro 上,价格为每 1M token 输入 $0.112 / 输出 $0.80,比 OpenRouter 低约 20%,在它真正擅长的长上下文 RAG 任务上比 GPT-4o 低约 12–22×。

每 1M token:输入 $0.112 · 输出 $0.80
作者Raullen Chai·更新于

概览

上下文
262K token
输入 / 1M
$0.112
输出 / 1M
$0.80
默认思考
否

长上下文 RAG、文档摘要、带推理能力的低成本 MoE。

价格对比($/1M token)

服务商输入输出对比 QSP
QuickSilver Pro$0.112$0.80最低价
OpenRouter (qwen/qwen3.6-35b-a3b)$0.14$1.00低 20%
OpenAI (GPT-4o)$2.50$10.00低 92%

适用场景

Qwen 3.6 在长文档摘要、基于 100K+ token 语料的多文档 RAG,以及中文任务上表现出色,在中文任务上它的训练数据优势是实打实的。3B 激活的 MoE 意味着它在大规模服务时成本很低;262K 的上下文让你可以把一整个 Confluence 空间或技术规格书拼接进去,无需切块。

何时该选其他模型

编码 agent 类工作负载,DeepSeek V4 Flash 在 HumanEval 类基准测试上胜过它,而且更便宜。顶级推理,选 V4 Pro。QuickSilver Pro 以非思考模式提供 Qwen 3.6-35B:回复是直接给出的,请求中的 `reasoning` 字段不会开启思考。

快速开始(curl)

curl https://api.quicksilverpro.io/v1/chat/completions \
  -H "Authorization: Bearer $QSP_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3.6-35b",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

兼容 OpenAI。只需改一行 base_url 即可迁移。

常见问题

它是一个 35B 参数的 MoE,每个 token 只激活 3B,因此在大规模服务时成本很低,同时在数学、编码和长上下文检索上保持强劲的推理能力。262K 的上下文窗口使它天然适合多文档 RAG 和长文档摘要。QuickSilver Pro 以非思考模式提供它,因此回复是直接给出的,不带推理过程。

不会。QuickSilver Pro 以非思考模式提供 Qwen 3.6-35B,因此你永远不用为思考过程付费。请求中的 `reasoning` 字段不会开启思考;如果需要逐步推理,请使用默认开启推理的模型,例如 DeepSeek V4 Pro。

OpenRouter 对 Qwen 3.6-35B-A3B 的标价为每 1M token 输入 $0.14 / 输出 $1.00。QuickSilver Pro 为 $0.112 / $0.80 —— 输入输出两端均低 20%。同样的 OpenAI 兼容接口;迁移只需替换 base_url 和 key。去掉模型 ID 中的 `qwen/` 提供商前缀即可。

充值翻倍试用 Qwen3.6-35B-A3B —— 最高赠送 $50 额度

获取 API Key