首页/模型/DeepSeek V4 Pro
1M 上下文推理Responses API

DeepSeek V4 Pro · QuickSilver Pro

DeepSeek V4 Pro 是 V4 这一代面向高端推理的旗舰 —— 1M token 上下文,默认开启推理,并提供 OpenAI 兼容的 Chat Completions 和 Responses API。QuickSilver Pro 提供的 V4 Pro 价格为每百万 token 输入 $0.70 / 输出 $2.10 —— 比 DeepSeek 自家公布的 API 价格低约 47%,其官方价格为 $1.32 / $3.96。对于长上下文的高端推理工作负载,它是 o3-mini 的高性价比替代方案。

每 1M token:输入 $0.70 · 输出 $2.10
作者Raullen Chai·更新于

概览

上下文
1M token
输入 / 1M
$0.70
输出 / 1M
$2.10
默认思考
是

高端推理 + 1M 上下文,比 DeepSeek 自家公布的 API 价格低约 47%。

价格对比($/1M token)

服务商输入输出对比 QSP
QuickSilver Pro$0.70$2.10最低价
DeepSeek 官方刊例价 (DeepSeek official API)$1.32$3.96低 47%
OpenAI (o3-mini)$1.10$4.40低 52%

适用场景

当 V4 Flash 不够聪明、而前沿档模型的单 token 成本又开始累积时,V4 Pro 正是合适之选。适用于多步编码 agent、重构规划器、带推理的大文档摘要、竞赛数学 / 定理类问题,以及任何你会考虑 o3-mini 但卡在价格上的工作负载。1M 的上下文窗口也比 o3-mini 的 200K 能容纳更多内容。

何时该选其他模型

日常对话、代码生成或非 agent 式的单次任务,V4 Flash($0.086/$0.173)能以更低的价格搞定其中大部分。需要闭源模型的能力,继续用 OpenAI 的 o 系列。需要 Opus 级的 agent / 规划能力,选 Kimi K2.6。

快速开始(curl)

curl https://api.quicksilverpro.io/v1/chat/completions \
  -H "Authorization: Bearer $QSP_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4-pro",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

兼容 OpenAI。只需改一行 base_url 即可迁移。

常见问题

在长上下文的高端推理工作负载上,可以。V4 Pro 默认开启推理,支持 1M 上下文(o3-mini 为 200K),每百万 token 标价为输入 $0.70 / 输出 $2.10,而 o3-mini 为 $1.10 / $4.40。请在你自己的评测集上对比两者;V4 Pro 仅支持文本,而我们的 68 个模型中有 35 个支持图像输入。

V4 Pro 是 V4 这一代的高端推理档 —— 在难题(竞赛数学、定理证明、多步规划)上有更深的思维链,价格为每 1M $0.70 / $2.10。V4 Flash($0.086/$0.173)是用于日常对话和代码生成的低成本主力模型。两者的上下文上限均取自模型目录,并且都默认开启思考。当困难推理上的回答质量比单 token 成本更重要时,就选 V4 Pro。

大致可以 —— 1M token 约相当于 250 万到 300 万个单词的现代语言代码,足以容纳大多数 monorepo。请记住,成本随输入 token 线性增长(每 1M 输入约 $0.70),因此塞满一个 1M token 的上下文,在开始推理之前光输入就要花 $0.70。对于频繁重复的上下文,可以考虑 RAG,或等我们上线部分提示词缓存后使用它。

QuickSilver Pro 的收费为每百万输入 token $0.70、每百万输出 token $2.10,缓存输入每百万 token $0.10 —— 比 DeepSeek 自家公布的 API 刊例价(每百万 token $1.32 / $3.96)低约 47%。

充值翻倍试用 DeepSeek V4 Pro —— 最高赠送 $50 额度

获取 API Key