首页/模型/Gemini 3.5 Flash-Lite
1M 上下文多模态Responses API

Gemini 3.5 Flash-Lite · QuickSilver Pro

Gemini 3.5 Flash-Lite 是 Google 当前面向高吞吐负载的低成本 GA 模型。QuickSilver Pro 提供该模型,上下文窗口为 1M token,价格为每百万 token 输入 $0.255 / 输出 $2.125,比 Google $0.30/$2.50 的刊例价低 15%。

每 1M token:输入 $0.255 · 输出 $2.125
作者Raullen Chai·更新于

概览

上下文
1M token
输入 / 1M
$0.255
输出 / 1M
$2.125
默认思考
否

兼具 GA 稳定性和可预期成本的高并发 Gemini 负载。

价格对比($/1M token)

服务商输入输出对比 QSP
QuickSilver Pro$0.255$2.125最低价
Google 刊例价 (google/gemini-3.5-flash-lite)$0.30$2.50低 15%
OpenAI (GPT-4o mini)$0.15$0.60贵 254%

适用场景

Gemini 3.5 Flash-Lite 适用于分类、抽取、路由、摘要、简单对话,以及最看重吞吐量和价格的 agent 子任务。

何时该选其他模型

对于重推理的编程或多模态分析,请用 Gemini 3.6 Flash。对于最难的长上下文推理任务,可以评估 Gemini 3.1 Pro Preview。

快速开始(curl)

curl https://api.quicksilverpro.io/v1/chat/completions \
  -H "Authorization: Bearer $QSP_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-3.5-flash-lite",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

兼容 OpenAI。只需改一行 base_url 即可迁移。

常见问题

应该。现有集成在迁移期间可以继续使用旧 ID,但新的负载应使用 gemini-3.5-flash-lite。

QuickSilver Pro 的价格为每 1M token 输入 $0.255、输出 $2.125,比 Google $0.30/$2.50 的刊例价低 15%。

可以。将 base URL 设为 https://api.quicksilverpro.io/v1,model ID 设为 gemini-3.5-flash-lite。

充值翻倍试用 Gemini 3.5 Flash-Lite —— 最高赠送 $50 额度

获取 API Key