首页/模型/Qwen3.8 27B
1M 上下文Responses API

Qwen3.8 27B · QuickSilver Pro

Qwen3.8 27B 是 Qwen 最新 3.8 一代中快速的开放成员 —— 一个 27B 模型,拥有该系列完整的 1M token 上下文窗口和 131K 最大输出。在 QuickSilver Pro 上,价格为每百万 token 输入 $0.34 / 输出 $2.04,比 Alibaba 自家的刊例价低约 20%,其刊例价为 $0.425 / $2.55。它直接作答 —— 账单上不会出现看不见的思考 token。

每 1M token:输入 $0.34 · 输出 $2.04
作者Raullen Chai·更新于

概览

上下文
1M token
输入 / 1M
$0.34
输出 / 1M
$2.04
默认思考
否

需要以低成本获得超大工作集的编码 agent —— 一个带 1M token 上下文窗口的快速 27B 模型。

价格对比($/1M token)

服务商输入输出对比 QSP
QuickSilver Pro$0.34$2.04最低价
Alibaba (qwen/qwen3.8-27b)$0.425$2.55低 20%
OpenAI (GPT-4o mini)$0.15$0.60贵 240%

适用场景

当瓶颈在于工作集大小而不是任务本身的难度时,就选 Qwen3.8 27B:代码仓库规模的编码 agent、长文档分析,以及想用完整 1M token 窗口却不想付旗舰价格的多文件重构。它在基准测试中可与价位高出数倍的模型比肩,生产环境中也已有真实的编码 agent 流量路由到它。直接作答让短轮次保持便宜、延迟保持低。

何时该选其他模型

在这个窗口规模下做最难的推理,Qwen3.8 Max 和 GLM 5.3 是更强的选择。如果你根本用不到超大窗口,GLM 5.3 Flash($0.06/$0.20)价格更低,训练数据同样是 2026 年的最新一代。输出按每百万 $2.04 计费 —— 输出量大的生成流水线在做决定之前应先与 DeepSeek V4 Flash 做对比。

快速开始(curl)

curl https://api.quicksilverpro.io/v1/chat/completions \
  -H "Authorization: Bearer $QSP_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3.8-27b",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

兼容 OpenAI。只需改一行 base_url 即可迁移。

常见问题

不会 —— 在 QuickSilver Pro 上,Qwen3.8 27B 始终直接作答,因此你永远不会为看不见的推理 token 付费。这条线路只提供直接作答模式;如果任务需要在相近价位上进行深思熟虑的逐步推理,请使用 GLM 5.3 Flash,它的深度推理始终开启。

是真的 —— 完整的 1,000,000 token 窗口,每次调用最多 131K 输出 token,而且 QuickSilver Pro 提供的正是真正落实这些上限的线路。长上下文调用同样按每百万输入 token $0.34 的统一价格计费。

可以 —— Qwen3.8 27B 在 QuickSilver Pro 上是一个 OpenAI 兼容的 chat completions endpoint(Responses API 也可以用)。设置 base_url=https://api.quicksilverpro.io/v1,粘贴你的 QSP key,并使用 model="qwen3.8-27b"。流式输出、工具调用和 usage.cost 统计都可以使用。

Alibaba 对 Qwen3.8 27B 的标价为每百万 token 输入 $0.425 / 输出 $2.55;QuickSilver Pro 为 $0.34 / $2.04,输入输出两端均低约 20%。同样的 OpenAI 兼容接口;迁移只需替换 base_url 和 key,并去掉模型 ID 中的 `qwen/` 提供商前缀。

充值翻倍试用 Qwen3.8 27B —— 最高赠送 $50 额度

获取 API Key