Gemini 3 Flash Preview · QuickSilver Pro
Gemini 3 Flash Preview 仅为兼容现有集成而继续提供。请将生产负载和新负载迁移到 gemini-3.6-flash,即 Google 当前的 GA Flash 模型。
概览
为正在迁移到 Gemini 3.6 Flash 的集成提供临时兼容。
价格对比($/1M token)
| 服务商 | 输入 | 输出 | 对比 QSP |
|---|---|---|---|
| QuickSilver Pro | $0.425 | $2.55 | 最低价 |
| OpenRouter (google/gemini-3-flash-preview) | $0.50 | $3.00 | 低 15% |
| OpenAI (GPT-4o-mini) | $0.15 | $0.60 | 贵 325% |
适用场景
当 Flash Lite 不够聪明、而 3.1 Pro 又大材小用时,选 3 Flash Preview:agentic 循环中较难的编程轮次、多步骤分析,以及需要较复杂跨文档推理的长上下文摘要。它的输出价格仍比 3.1 Pro Preview 低约 4×。
何时该选其他模型
对于营收关键的生产路径,在 3 Flash 转正之前请优先使用 Gemini GA 模型(3.5 Flash)—— 预览版的语义可能变化。对于低成本的高并发对话,3.1 Flash Lite 的价格为 $0.2125/$1.275,要便宜得多。对于顶级推理,请升级到 3.1 Pro Preview($1.70/$10.20)或 DeepSeek V4 Pro($0.70/$2.10)。
快速开始(curl)
curl https://api.quicksilverpro.io/v1/chat/completions \
-H "Authorization: Bearer $QSP_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3-flash-preview",
"messages": [{"role": "user", "content": "Hello!"}]
}'兼容 OpenAI。只需改一行 base_url 即可迁移。
常见问题
预览版意味着 Google 可以在不事先通知的情况下更改输出格式、思考行为或定价。做原型和 A/B 评测,现在就可以用。对于行为变化会影响客户的路径,请用 feature flag 加以控制,并在 Google 将 3 Flash 标为 GA 之前,固定以 3.5 Flash GA 作为回退。
3 Flash Preview 是价格更低的预览档 Flash(每 1M token $0.425/$2.55);3.5 Flash 是更高一档的 GA 版本($1.275/$7.65),推理更强,且承诺行为稳定。对成本敏感的原型和评测用 3 Flash Preview;需要生产稳定性时换到 3.5 Flash GA。做决定之前,请先在你自己的流量上做一次并排评测。
QuickSilver Pro 上 Gemini 3 Flash Preview 的标价为每 1M token 输入 $0.425 / 输出 $2.55 —— 比 Vertex 零售价和 OpenRouter 低约 15%,对应价格为 $0.50/$3.00。OpenAI 兼容 API;从其他提供商切换过来,只需在 OpenAI SDK 上替换 base_url 和 key。