Qwen3.8 27B · QuickSilver Pro
Qwen3.8 27B 是 Qwen 最新 3.8 一代中快速的开放成员 —— 一个 27B 模型,拥有该系列完整的 1M token 上下文窗口和 131K 最大输出。在 QuickSilver Pro 上,价格为每百万 token 输入 $0.34 / 输出 $2.04,比 Alibaba 自家的刊例价低约 20%,其刊例价为 $0.425 / $2.55。它直接作答 —— 账单上不会出现看不见的思考 token。
概览
需要以低成本获得超大工作集的编码 agent —— 一个带 1M token 上下文窗口的快速 27B 模型。
价格对比($/1M token)
| 服务商 | 输入 | 输出 | 对比 QSP |
|---|---|---|---|
| QuickSilver Pro | $0.34 | $2.04 | 最低价 |
| Alibaba (qwen/qwen3.8-27b) | $0.425 | $2.55 | 低 20% |
| OpenAI (GPT-4o mini) | $0.15 | $0.60 | 贵 240% |
适用场景
当瓶颈在于工作集大小而不是任务本身的难度时,就选 Qwen3.8 27B:代码仓库规模的编码 agent、长文档分析,以及想用完整 1M token 窗口却不想付旗舰价格的多文件重构。它在基准测试中可与价位高出数倍的模型比肩,生产环境中也已有真实的编码 agent 流量路由到它。直接作答让短轮次保持便宜、延迟保持低。
何时该选其他模型
在这个窗口规模下做最难的推理,Qwen3.8 Max 和 GLM 5.3 是更强的选择。如果你根本用不到超大窗口,GLM 5.3 Flash($0.06/$0.20)价格更低,训练数据同样是 2026 年的最新一代。输出按每百万 $2.04 计费 —— 输出量大的生成流水线在做决定之前应先与 DeepSeek V4 Flash 做对比。
快速开始(curl)
curl https://api.quicksilverpro.io/v1/chat/completions \
-H "Authorization: Bearer $QSP_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3.8-27b",
"messages": [{"role": "user", "content": "Hello!"}]
}'兼容 OpenAI。只需改一行 base_url 即可迁移。
常见问题
不会 —— 在 QuickSilver Pro 上,Qwen3.8 27B 始终直接作答,因此你永远不会为看不见的推理 token 付费。这条线路只提供直接作答模式;如果任务需要在相近价位上进行深思熟虑的逐步推理,请使用 GLM 5.3 Flash,它的深度推理始终开启。
是真的 —— 完整的 1,000,000 token 窗口,每次调用最多 131K 输出 token,而且 QuickSilver Pro 提供的正是真正落实这些上限的线路。长上下文调用同样按每百万输入 token $0.34 的统一价格计费。
可以 —— Qwen3.8 27B 在 QuickSilver Pro 上是一个 OpenAI 兼容的 chat completions endpoint(Responses API 也可以用)。设置 base_url=https://api.quicksilverpro.io/v1,粘贴你的 QSP key,并使用 model="qwen3.8-27b"。流式输出、工具调用和 usage.cost 统计都可以使用。
Alibaba 对 Qwen3.8 27B 的标价为每百万 token 输入 $0.425 / 输出 $2.55;QuickSilver Pro 为 $0.34 / $2.04,输入输出两端均低约 20%。同样的 OpenAI 兼容接口;迁移只需替换 base_url 和 key,并去掉模型 ID 中的 `qwen/` 提供商前缀。