1M 上下文多模态Responses API
Gemini 3.5 Flash-Lite · QuickSilver Pro
Gemini 3.5 Flash-Lite 是 Google 当前面向高吞吐负载的低成本 GA 模型。QuickSilver Pro 提供该模型,上下文窗口为 1M token,价格为每百万 token 输入 $0.255 / 输出 $2.125,比 Google $0.30/$2.50 的刊例价低 15%。
每 1M token:输入 $0.255 · 输出 $2.125
概览
上下文
1M token
输入 / 1M
$0.255
输出 / 1M
$2.125
默认思考
否
兼具 GA 稳定性和可预期成本的高并发 Gemini 负载。
价格对比($/1M token)
| 服务商 | 输入 | 输出 | 对比 QSP |
|---|---|---|---|
| QuickSilver Pro | $0.255 | $2.125 | 最低价 |
| Google 刊例价 (google/gemini-3.5-flash-lite) | $0.30 | $2.50 | 低 15% |
| OpenAI (GPT-4o mini) | $0.15 | $0.60 | 贵 254% |
适用场景
Gemini 3.5 Flash-Lite 适用于分类、抽取、路由、摘要、简单对话,以及最看重吞吐量和价格的 agent 子任务。
何时该选其他模型
对于重推理的编程或多模态分析,请用 Gemini 3.6 Flash。对于最难的长上下文推理任务,可以评估 Gemini 3.1 Pro Preview。
快速开始(curl)
shell获取 API key →
curl https://api.quicksilverpro.io/v1/chat/completions \
-H "Authorization: Bearer $QSP_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3.5-flash-lite",
"messages": [{"role": "user", "content": "Hello!"}]
}'兼容 OpenAI。只需改一行 base_url 即可迁移。
常见问题
应该。现有集成在迁移期间可以继续使用旧 ID,但新的负载应使用 gemini-3.5-flash-lite。
QuickSilver Pro 的价格为每 1M token 输入 $0.255、输出 $2.125,比 Google $0.30/$2.50 的刊例价低 15%。
可以。将 base URL 设为 https://api.quicksilverpro.io/v1,model ID 设为 gemini-3.5-flash-lite。