Gemini 3.1 Flash Lite · QuickSilver Pro
Gemini 3.1 Flash Lite 仅为兼容现有集成而继续提供。请将生产负载和新负载迁移到 gemini-3.5-flash-lite,即 Google 当前的低成本 Flash-Lite GA 模型。
概览
为正在迁移到 Gemini 3.5 Flash-Lite 的集成提供临时兼容。
价格对比($/1M token)
| 服务商 | 输入 | 输出 | 对比 QSP |
|---|---|---|---|
| QuickSilver Pro | $0.2125 | $1.275 | 最低价 |
| OpenRouter (google/gemini-3.1-flash-lite) | $0.25 | $1.50 | 低 15% |
| OpenAI (GPT-4o mini) | $0.15 | $0.60 | 贵 112% |
适用场景
3.1 Flash Lite 适用于不需要推理过程的高并发、成本敏感型任务:路由和分类、抽取、摘要、简单对话,以及延迟和价格比纯推理深度更重要的 agent 子任务。默认不思考意味着输出 token 可预期 —— 大规模使用时便于做预算。
何时该选其他模型
对于多步骤推理、高难度编程或分析,请升级到 3.5 Flash($1.275/$7.65)或 Pro 档 —— Flash Lite 是用深度换成本。如果你明确想要一个低成本且会思考的 Gemini,3 Flash Preview($0.425/$2.55)默认会推理。图像生成请用 Gemini 图像模型或 FLUX。
快速开始(curl)
curl https://api.quicksilverpro.io/v1/chat/completions \
-H "Authorization: Bearer $QSP_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3.1-flash-lite",
"messages": [{"role": "user", "content": "Hello!"}]
}'兼容 OpenAI。只需改一行 base_url 即可迁移。
常见问题
不会 —— Flash Lite 是不思考的档位,所以它直接作答,不带推理过程。这让输出 token 数(以及成本)保持可预期,正是高并发负载想要的。如果需要推理,3 Flash Preview 或 3.5 Flash 默认开启思考。
是的 —— 每 1M token 输入 $0.2125 / 输出 $1.275,它是目录中成本最低的 Gemini,也是高并发路由、分类和抽取的自然之选。如果要非 Gemini 的低成本对话,DeepSeek V4 Flash($0.086/$0.173)在输入和输出两端都还要更便宜。
QuickSilver Pro 上 3.1 Flash Lite 的标价为每 1M token 输入 $0.2125 / 输出 $1.275 —— 比 Vertex 零售价低约 15%,对应价格为 $0.25/$1.50。一把 OpenAI 兼容的 key 覆盖 18 个模型,一张账单,每次响应都带 `usage.cost` 字段,方便你逐个请求核对支出。