1M 上下文多模态推理Responses API
Gemini 3.6 Flash · QuickSilver Pro
Gemini 3.6 Flash 是 Google 当前的通用 Flash GA 模型,上下文窗口为 1M token。QuickSilver Pro 通过同一个 OpenAI 兼容 endpoint 提供该模型,价格为每百万 token 输入 $0.6375 / 输出 $3.1875,比 Google $0.75/$3.75 的刊例价低 15%。
每 1M token:输入 $0.6375 · 输出 $3.1875
概览
上下文
1M token
输入 / 1M
$0.6375
输出 / 1M
$3.1875
默认思考
是
新的生产集成推荐使用的 Gemini Flash。
价格对比($/1M token)
| 服务商 | 输入 | 输出 | 对比 QSP |
|---|---|---|---|
| QuickSilver Pro | $0.6375 | $3.1875 | 最低价 |
| Google 刊例价 (google/gemini-3.6-flash) | $0.75 | $3.75 | 低 15% |
| OpenAI (GPT-4o) | $2.50 | $10.00 | 低 68% |
适用场景
对于需要当前 Flash 质量和 GA 稳定性的生产对话、多模态分析、编程、agent 轮次和长上下文负载,默认选 Gemini 3.6 Flash。
何时该选其他模型
对于价格比推理深度更重要的高并发分类和抽取任务,请用 Gemini 3.5 Flash-Lite。对于更难的旗舰级推理,请在评估预览版稳定性之后使用 Gemini 3.1 Pro Preview。
快速开始(curl)
shell获取 API key →
curl https://api.quicksilverpro.io/v1/chat/completions \
-H "Authorization: Bearer $QSP_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3.6-flash",
"messages": [{"role": "user", "content": "Hello!"}]
}'兼容 OpenAI。只需改一行 base_url 即可迁移。
常见问题
应该。预览版 ID 只在迁移现有集成期间保留使用。新的负载应使用 gemini-3.6-flash,即 Google 当前的 GA Flash 模型。
价格为每 1M token 输入 $0.6375、输出 $3.1875,比 Google $0.75/$3.75 的刊例价低 15%。
可以。把 OpenAI SDK 指向 https://api.quicksilverpro.io/v1,并将 model 设为 gemini-3.6-flash。