DeepSeek V4 Flash · QuickSilver Pro
DeepSeek V4 Flash 0731 是官方公测版 agent 模型:1M token 上下文,更强的编码与工具使用能力,并带有为 Codex 适配的原生 Responses API。QuickSilver Pro 以 FP8 或更高精度提供 DeepSeek 官方版本,价格为每百万 token $0.086 / $0.173。
概览
Codex、agent 式编码、工具使用和长上下文自动化。
价格对比($/1M token)
| 服务商 | 输入 | 输出 | 对比 QSP |
|---|---|---|---|
| QuickSilver Pro | $0.086 | $0.173 | — |
| OpenRouter (deepseek/deepseek-v4-flash-0731) | $0.0785 | $0.1571 | 贵 10% |
| OpenAI (GPT-4o-mini) | $0.15 | $0.60 | 低 71% |
适用场景
Codex 与 agent 式编码、多步工具使用、代码生成、结构化输出和长上下文自动化,默认选 V4 Flash 即可。官方 0731 版本同时支持 OpenAI Chat Completions 和 Responses API 客户端,QSP 模型 ID 保持稳定不变。
何时该选其他模型
遇到真正困难的推理(竞赛编程、多步证明、复杂数学),请升级到 V4 Pro。需要 Opus 级的 agent 能力或长程规划时,Kimi K2.6 更合适。音频或 GPT-4 级别的创意写作,继续用 OpenAI。V4 Flash 本身仅支持文本 —— 如果需要图像输入,我们的 68 个模型中有 35 个支持。
快速开始(curl)
curl https://api.quicksilverpro.io/v1/chat/completions \
-H "Authorization: Bearer $QSP_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4-flash",
"messages": [{"role": "user", "content": "Hello!"}]
}'兼容 OpenAI。只需改一行 base_url 即可迁移。
常见问题
会 —— V4 Flash 默认开启思考。如果想通过 Chat Completions 直接进行不思考的对话,请传入 `reasoning: { enabled: false }`;Responses API 客户端可以通过设置 `reasoning.effort` 来控制思考深度。
QuickSilver Pro 对官方 0731 版本的标价为每 1M token 输入 $0.086 / 输出 $0.173,比 OpenRouter 的主流价格 $0.0785 / $0.1571 高约 10%。OpenRouter 上该版本最便宜的那些报价往往是 FP4 量化的;QuickSilver Pro 只以 FP8 或更高精度提供。
可以。使用 base_url=https://api.quicksilverpro.io/v1,并设置 model="deepseek-v4-flash"。QSP 同时提供 `/v1/chat/completions` 和 `/v1/responses`;Codex 应使用 `wire_api = "responses"`。