首页/模型/Gemini 3.1 Flash Lite
旧版1M 上下文多模态Responses API

Gemini 3.1 Flash Lite · QuickSilver Pro

Gemini 3.1 Flash Lite 仅为兼容现有集成而继续提供。请将生产负载和新负载迁移到 gemini-3.5-flash-lite,即 Google 当前的低成本 Flash-Lite GA 模型。

每 1M token:输入 $0.2125 · 输出 $1.275
作者Raullen Chai·更新于

概览

上下文
1M token
输入 / 1M
$0.2125
输出 / 1M
$1.275
默认思考
否

为正在迁移到 Gemini 3.5 Flash-Lite 的集成提供临时兼容。

价格对比($/1M token)

服务商输入输出对比 QSP
QuickSilver Pro$0.2125$1.275最低价
OpenRouter (google/gemini-3.1-flash-lite)$0.25$1.50低 15%
OpenAI (GPT-4o mini)$0.15$0.60贵 112%

适用场景

3.1 Flash Lite 适用于不需要推理过程的高并发、成本敏感型任务:路由和分类、抽取、摘要、简单对话,以及延迟和价格比纯推理深度更重要的 agent 子任务。默认不思考意味着输出 token 可预期 —— 大规模使用时便于做预算。

何时该选其他模型

对于多步骤推理、高难度编程或分析,请升级到 3.5 Flash($1.275/$7.65)或 Pro 档 —— Flash Lite 是用深度换成本。如果你明确想要一个低成本且会思考的 Gemini,3 Flash Preview($0.425/$2.55)默认会推理。图像生成请用 Gemini 图像模型或 FLUX。

快速开始(curl)

curl https://api.quicksilverpro.io/v1/chat/completions \
  -H "Authorization: Bearer $QSP_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-3.1-flash-lite",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

兼容 OpenAI。只需改一行 base_url 即可迁移。

常见问题

不会 —— Flash Lite 是不思考的档位,所以它直接作答,不带推理过程。这让输出 token 数(以及成本)保持可预期,正是高并发负载想要的。如果需要推理,3 Flash Preview 或 3.5 Flash 默认开启思考。

是的 —— 每 1M token 输入 $0.2125 / 输出 $1.275,它是目录中成本最低的 Gemini,也是高并发路由、分类和抽取的自然之选。如果要非 Gemini 的低成本对话,DeepSeek V4 Flash($0.086/$0.173)在输入和输出两端都还要更便宜。

QuickSilver Pro 上 3.1 Flash Lite 的标价为每 1M token 输入 $0.2125 / 输出 $1.275 —— 比 Vertex 零售价低约 15%,对应价格为 $0.25/$1.50。一把 OpenAI 兼容的 key 覆盖 18 个模型,一张账单,每次响应都带 `usage.cost` 字段,方便你逐个请求核对支出。

充值翻倍试用 Gemini 3.1 Flash Lite —— 最高赠送 $50 额度

获取 API Key