首页/模型/DeepSeek V4 Flash
1M 上下文推理Responses API

DeepSeek V4 Flash · QuickSilver Pro

DeepSeek V4 Flash 0731 是官方公测版 agent 模型:1M token 上下文,更强的编码与工具使用能力,并带有为 Codex 适配的原生 Responses API。QuickSilver Pro 以 FP8 或更高精度提供 DeepSeek 官方版本,价格为每百万 token $0.086 / $0.173。

每 1M token:输入 $0.086 · 输出 $0.173
作者Raullen Chai·更新于

概览

上下文
1M token
输入 / 1M
$0.086
输出 / 1M
$0.173
默认思考
是

Codex、agent 式编码、工具使用和长上下文自动化。

价格对比($/1M token)

服务商输入输出对比 QSP
QuickSilver Pro$0.086$0.173—
OpenRouter (deepseek/deepseek-v4-flash-0731)$0.0785$0.1571贵 10%
OpenAI (GPT-4o-mini)$0.15$0.60低 71%

适用场景

Codex 与 agent 式编码、多步工具使用、代码生成、结构化输出和长上下文自动化,默认选 V4 Flash 即可。官方 0731 版本同时支持 OpenAI Chat Completions 和 Responses API 客户端,QSP 模型 ID 保持稳定不变。

何时该选其他模型

遇到真正困难的推理(竞赛编程、多步证明、复杂数学),请升级到 V4 Pro。需要 Opus 级的 agent 能力或长程规划时,Kimi K2.6 更合适。音频或 GPT-4 级别的创意写作,继续用 OpenAI。V4 Flash 本身仅支持文本 —— 如果需要图像输入,我们的 68 个模型中有 35 个支持。

快速开始(curl)

curl https://api.quicksilverpro.io/v1/chat/completions \
  -H "Authorization: Bearer $QSP_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4-flash",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

兼容 OpenAI。只需改一行 base_url 即可迁移。

常见问题

会 —— V4 Flash 默认开启思考。如果想通过 Chat Completions 直接进行不思考的对话,请传入 `reasoning: { enabled: false }`;Responses API 客户端可以通过设置 `reasoning.effort` 来控制思考深度。

QuickSilver Pro 对官方 0731 版本的标价为每 1M token 输入 $0.086 / 输出 $0.173,比 OpenRouter 的主流价格 $0.0785 / $0.1571 高约 10%。OpenRouter 上该版本最便宜的那些报价往往是 FP4 量化的;QuickSilver Pro 只以 FP8 或更高精度提供。

可以。使用 base_url=https://api.quicksilverpro.io/v1,并设置 model="deepseek-v4-flash"。QSP 同时提供 `/v1/chat/completions` 和 `/v1/responses`;Codex 应使用 `wire_api = "responses"`。

充值翻倍试用 DeepSeek V4 Flash —— 最高赠送 $50 额度

获取 API Key