首页/模型/Gemini 3.7 Flash
1M 上下文多模态推理Responses API

Gemini 3.7 Flash · QuickSilver Pro

Gemini 3.7 Flash 是 Google 最新的 Flash 模型,面向生产级 agent、编程、多模态分析和长上下文任务。它接受文本和图像输入,上下文为 1M token,支持推理、流式输出、工具和结构化输出。截至 2026 年 12 月 31 日,QuickSilver Pro 的价格为每百万 token 输入 $0.6375 / 输出 $3.1875 —— 比 Google 的 API 促销价低 15%。

每 1M token:输入 $0.6375 · 输出 $3.1875
作者Raullen Chai·更新于

概览

上下文
1M token
输入 / 1M
$0.6375
输出 / 1M
$3.1875
默认思考
是

快速的多模态 agent 与编程,1M 上下文,比 Google 2026 年 API 促销价低 15%。

价格对比($/1M token)

服务商输入输出对比 QSP
QuickSilver Pro$0.6375$3.1875最低价
Google 促销价 (Gemini API promotional rate)$0.75$3.75低 15%
OpenAI (GPT-4o)$2.50$10.00低 68%

适用场景

Gemini 3.7 Flash 适用于生产级 agent、编程助手、图像理解、文档分析、工具调用工作流,以及能从 1M token 上下文中受益的长提示词。它通过同一个 OpenAI 兼容的 QSP endpoint 同时支持 Chat Completions 和 Responses。

何时该选其他模型

对于成本比推理质量更重要的简单分类或抽取任务,Gemini 3.5 Flash-Lite 更便宜。如果想以更低的 token 价格获得纯文本的高端推理,可以评估 DeepSeek V4 Pro。Gemini 3.7 Flash 当前的价格是促销价,有效期至 2026 年 12 月 31 日,因此对预算敏感的生产负载应在 2027 年之前重新核对定价。

快速开始(curl)

curl https://api.quicksilverpro.io/v1/chat/completions \
  -H "Authorization: Bearer $QSP_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-3.7-flash",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

兼容 OpenAI。只需改一行 base_url 即可迁移。

常见问题

截至 2026 年 12 月 31 日,价格为每百万输入 token $0.6375,每百万输出 token $3.1875。缓存输入为每百万 token $0.06375。这些价格比 Google 的 API 促销价低 15%;促销结束前我们会重新评估定价。

支持。它接受文本和图像输入,支持流式输出、推理、function calling 和 JSON Schema 结构化输出。最大上下文为 1M token,最大输出为 65,536 token。

设置 base_url=https://api.quicksilverpro.io/v1,使用你的 QSP API key,并设置 model="gemini-3.7-flash"。`/v1/chat/completions` 和 `/v1/responses` 均受支持,包括流式输出和工具调用。

可用。QuickSilver Pro 持续监控该模型,并在上线时针对生产 endpoint 验证了非流式 Chat Completions、流式 Chat Completions、Responses API、流式 Responses 以及强制 function calling。

充值翻倍试用 Gemini 3.7 Flash —— 最高赠送 $50 额度

获取 API Key