首页/模型/DeepSeek V4.1 Flash
1M 上下文推理Responses API

DeepSeek V4.1 Flash · QuickSilver Pro

DeepSeek V4.1 Flash 是 DeepSeek 的 V4.1 Flash:全新的模型架构,比 V4 Flash 更快、更强,拥有 1M token 上下文和面向 Codex 的原生 Responses API。QuickSilver Pro 以 FP8 精度提供,价格为每百万 token $0.125 / $0.55 —— 不到 DeepSeek 自家高峰时段刊例价的一半。

每 1M token:输入 $0.125 · 输出 $0.55
作者Raullen Chai·更新于

概览

上下文
1M token
输入 / 1M
$0.125
输出 / 1M
$0.55
默认思考
是

最新的 DeepSeek Flash 架构,适合 Codex、agent 式编码和长上下文自动化。

价格对比($/1M token)

服务商输入输出对比 QSP
QuickSilver Pro$0.125$0.55最低价
DeepSeek 刊例价 (DeepSeek API)$0.30$1.20低 54%
OpenAI (GPT-4o-mini)$0.15$0.60低 8%

适用场景

如果你想用最新的 DeepSeek Flash 架构 —— 响应比 V4 Flash 更快,编码和工具使用更强 —— 来跑 Codex、agent 式编码、多步工具使用和长上下文自动化,就选 V4.1 Flash。官方版本同时支持 OpenAI Chat Completions 和 Responses API 客户端,并使用稳定的 QSP 模型 ID。

何时该选其他模型

如果要的是一个成熟稳定、成本最低的主力模型,V4 Flash($0.086/$0.173)更便宜。遇到真正困难的推理,请升级到 V4 Pro。V4.1 Flash 在这里仅支持文本 —— 如果需要图像输入,我们的 68 个模型中有 35 个支持。

快速开始(curl)

curl https://api.quicksilverpro.io/v1/chat/completions \
  -H "Authorization: Bearer $QSP_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4.1-flash",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

兼容 OpenAI。只需改一行 base_url 即可迁移。

常见问题

V4.1 Flash 是 DeepSeek 更新的 Flash 架构 —— 更快,编码和工具使用也更强。V4 Flash($0.086/$0.173)仍然是成熟稳定、成本最低的选择。两者都默认开启思考,并且都提供 OpenAI Chat Completions 和 Responses API。

V4.1 Flash 默认开启推理。如果想通过 Chat Completions 直接进行不思考的对话,请传入 `reasoning: { enabled: false }`;Responses API 客户端可以通过设置 `reasoning.effort` 来控制思考深度。

可以。使用 base_url=https://api.quicksilverpro.io/v1,并设置 model="deepseek-v4.1-flash"。QSP 同时提供 `/v1/chat/completions` 和 `/v1/responses`;Codex 应使用 `wire_api = "responses"`。

充值翻倍试用 DeepSeek V4.1 Flash —— 最高赠送 $50 额度

获取 API Key