DeepSeek V4 Pro · QuickSilver Pro
DeepSeek V4 Pro 是 V4 这一代面向高端推理的旗舰 —— 1M token 上下文,默认开启推理,并提供 OpenAI 兼容的 Chat Completions 和 Responses API。QuickSilver Pro 提供的 V4 Pro 价格为每百万 token 输入 $0.70 / 输出 $2.10 —— 比 DeepSeek 自家公布的 API 价格低约 47%,其官方价格为 $1.32 / $3.96。对于长上下文的高端推理工作负载,它是 o3-mini 的高性价比替代方案。
概览
高端推理 + 1M 上下文,比 DeepSeek 自家公布的 API 价格低约 47%。
价格对比($/1M token)
| 服务商 | 输入 | 输出 | 对比 QSP |
|---|---|---|---|
| QuickSilver Pro | $0.70 | $2.10 | 最低价 |
| DeepSeek 官方刊例价 (DeepSeek official API) | $1.32 | $3.96 | 低 47% |
| OpenAI (o3-mini) | $1.10 | $4.40 | 低 52% |
适用场景
当 V4 Flash 不够聪明、而前沿档模型的单 token 成本又开始累积时,V4 Pro 正是合适之选。适用于多步编码 agent、重构规划器、带推理的大文档摘要、竞赛数学 / 定理类问题,以及任何你会考虑 o3-mini 但卡在价格上的工作负载。1M 的上下文窗口也比 o3-mini 的 200K 能容纳更多内容。
何时该选其他模型
日常对话、代码生成或非 agent 式的单次任务,V4 Flash($0.086/$0.173)能以更低的价格搞定其中大部分。需要闭源模型的能力,继续用 OpenAI 的 o 系列。需要 Opus 级的 agent / 规划能力,选 Kimi K2.6。
快速开始(curl)
curl https://api.quicksilverpro.io/v1/chat/completions \
-H "Authorization: Bearer $QSP_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4-pro",
"messages": [{"role": "user", "content": "Hello!"}]
}'兼容 OpenAI。只需改一行 base_url 即可迁移。
常见问题
在长上下文的高端推理工作负载上,可以。V4 Pro 默认开启推理,支持 1M 上下文(o3-mini 为 200K),每百万 token 标价为输入 $0.70 / 输出 $2.10,而 o3-mini 为 $1.10 / $4.40。请在你自己的评测集上对比两者;V4 Pro 仅支持文本,而我们的 68 个模型中有 35 个支持图像输入。
V4 Pro 是 V4 这一代的高端推理档 —— 在难题(竞赛数学、定理证明、多步规划)上有更深的思维链,价格为每 1M $0.70 / $2.10。V4 Flash($0.086/$0.173)是用于日常对话和代码生成的低成本主力模型。两者的上下文上限均取自模型目录,并且都默认开启思考。当困难推理上的回答质量比单 token 成本更重要时,就选 V4 Pro。
大致可以 —— 1M token 约相当于 250 万到 300 万个单词的现代语言代码,足以容纳大多数 monorepo。请记住,成本随输入 token 线性增长(每 1M 输入约 $0.70),因此塞满一个 1M token 的上下文,在开始推理之前光输入就要花 $0.70。对于频繁重复的上下文,可以考虑 RAG,或等我们上线部分提示词缓存后使用它。
QuickSilver Pro 的收费为每百万输入 token $0.70、每百万输出 token $2.10,缓存输入每百万 token $0.10 —— 比 DeepSeek 自家公布的 API 刊例价(每百万 token $1.32 / $3.96)低约 47%。