DeepSeek V4.1 Flash · QuickSilver Pro
DeepSeek V4.1 Flash 是 DeepSeek 的 V4.1 Flash:全新的模型架构,比 V4 Flash 更快、更强,拥有 1M token 上下文和面向 Codex 的原生 Responses API。QuickSilver Pro 以 FP8 精度提供,价格为每百万 token $0.125 / $0.55 —— 不到 DeepSeek 自家高峰时段刊例价的一半。
概览
最新的 DeepSeek Flash 架构,适合 Codex、agent 式编码和长上下文自动化。
价格对比($/1M token)
| 服务商 | 输入 | 输出 | 对比 QSP |
|---|---|---|---|
| QuickSilver Pro | $0.125 | $0.55 | 最低价 |
| DeepSeek 刊例价 (DeepSeek API) | $0.30 | $1.20 | 低 54% |
| OpenAI (GPT-4o-mini) | $0.15 | $0.60 | 低 8% |
适用场景
如果你想用最新的 DeepSeek Flash 架构 —— 响应比 V4 Flash 更快,编码和工具使用更强 —— 来跑 Codex、agent 式编码、多步工具使用和长上下文自动化,就选 V4.1 Flash。官方版本同时支持 OpenAI Chat Completions 和 Responses API 客户端,并使用稳定的 QSP 模型 ID。
何时该选其他模型
如果要的是一个成熟稳定、成本最低的主力模型,V4 Flash($0.086/$0.173)更便宜。遇到真正困难的推理,请升级到 V4 Pro。V4.1 Flash 在这里仅支持文本 —— 如果需要图像输入,我们的 68 个模型中有 35 个支持。
快速开始(curl)
curl https://api.quicksilverpro.io/v1/chat/completions \
-H "Authorization: Bearer $QSP_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4.1-flash",
"messages": [{"role": "user", "content": "Hello!"}]
}'兼容 OpenAI。只需改一行 base_url 即可迁移。
常见问题
V4.1 Flash 是 DeepSeek 更新的 Flash 架构 —— 更快,编码和工具使用也更强。V4 Flash($0.086/$0.173)仍然是成熟稳定、成本最低的选择。两者都默认开启思考,并且都提供 OpenAI Chat Completions 和 Responses API。
V4.1 Flash 默认开启推理。如果想通过 Chat Completions 直接进行不思考的对话,请传入 `reasoning: { enabled: false }`;Responses API 客户端可以通过设置 `reasoning.effort` 来控制思考深度。
可以。使用 base_url=https://api.quicksilverpro.io/v1,并设置 model="deepseek-v4.1-flash"。QSP 同时提供 `/v1/chat/completions` 和 `/v1/responses`;Codex 应使用 `wire_api = "responses"`。