Gemini 3.8 Flash · QuickSilver Pro
Gemini 3.8 Flash 是 Google 能力最强的 Flash 模型,面向生产级 agent、编程、多模态分析和长上下文任务。在高推理强度下,它在 Artificial Analysis Intelligence Index 上得分 59;它接受文本和图像输入,上下文为 1M token,支持流式输出、工具和结构化输出。截至 2026 年 12 月 31 日,QuickSilver Pro 的价格为每百万 token 输入 $0.6375 / 输出 $3.1875 —— 比 Google 的 API 促销价低 15%。
概览
最聪明的 Flash,适合 agent 和编程 —— 1M 上下文,比 Google 2026 年 API 促销价低 15%。
价格对比($/1M token)
| 服务商 | 输入 | 输出 | 对比 QSP |
|---|---|---|---|
| QuickSilver Pro | $0.6375 | $3.1875 | 最低价 |
| Google 促销价 (Gemini API promotional rate) | $0.75 | $3.75 | 低 15% |
| OpenAI (GPT-4o) | $2.50 | $10.00 | 低 68% |
适用场景
Gemini 3.8 Flash 适用于生产级 agent、编程助手、图像理解、文档分析、工具调用工作流,以及能从 1M token 上下文中受益的长提示词。它通过同一个 OpenAI 兼容的 QSP endpoint 同时支持 Chat Completions 和 Responses。
何时该选其他模型
对于成本比推理质量更重要的简单分类或抽取任务,Gemini 3.5 Flash-Lite 更便宜。如果想以更低的 token 价格获得纯文本的高端推理,可以评估 DeepSeek V4 Pro。Gemini 3.8 Flash 当前的价格是促销价,有效期至 2026 年 12 月 31 日,因此对预算敏感的生产负载应在 2027 年之前重新核对定价。
快速开始(curl)
curl https://api.quicksilverpro.io/v1/chat/completions \
-H "Authorization: Bearer $QSP_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3.8-flash",
"messages": [{"role": "user", "content": "Hello!"}]
}'兼容 OpenAI。只需改一行 base_url 即可迁移。
常见问题
截至 2026 年 12 月 31 日,价格为每百万输入 token $0.6375,每百万输出 token $3.1875。缓存输入为每百万 token $0.06375。这些价格比 Google 的 API 促销价低 15%;促销结束前我们会重新评估定价。
在高推理强度下,它在 Artificial Analysis Intelligence Index 上得分 59 —— 比 Gemini 3.7 Flash 高 3 分,处于智能与成本的 Pareto 前沿 —— 在 agentic 工具使用和编程评测上的提升尤为明显。
支持。它接受文本和图像输入,支持流式输出、推理、function calling 和 JSON Schema 结构化输出。最大上下文为 1M token,最大输出为 65,536 token。
设置 base_url=https://api.quicksilverpro.io/v1,使用你的 QSP API key,并设置 model="gemini-3.8-flash"。`/v1/chat/completions` 和 `/v1/responses` 均受支持,包括流式输出和工具调用。