Mistral Large 4 · QuickSilver Pro
Mistral Large 4 是 Mistral AI 的前沿多模态模型,2026 年 10 月 6 日以预览版发布:支持文本和图像输入,上下文 524,288 token,面向编码、推理和 agent 类工作。QuickSilver Pro 接入 Mistral 自己的 endpoint,每百万 token 输入 $0.68 / 输出 $2.09 —— 与该模型在 OpenRouter 上的标价持平,不加价。
概览
Mistral 面向编码和 agent 的旗舰模型 —— 文本和图像输入,524,288 上下文,推理可按请求开启。
价格对比($/1M token)
| 服务商 | 输入 | 输出 | 对比 QSP |
|---|---|---|---|
| QuickSilver Pro | $0.68 | $2.09 | — |
| OpenRouter list price (mistralai/mistral-large-4-0) | $0.68 | $2.09 | 相同 |
适用场景
当你想用一款最新的欧洲旗舰模型来跑 agent 循环、多文件编码和长文档任务时,使用 Mistral Large 4:524,288 token 的上下文装得下一个大型代码仓库或一摞报告,它能在文本之外读取截图和图表,并支持函数调用(包括强制指定工具)和 JSON Schema 结构化输出。默认直接作答;遇到更难的问题,传入 `reasoning: {"enabled": true}`,模型会先思考再回答。缓存输入价格为每百万 token $0.07。
何时该选其他模型
推理模式很细致,可能在开始作答前就消耗数千个输出 token,所以日常对话请保持关闭,开启时请把 `max_tokens` 设得宽裕一些。对于大批量的简单抽取,DeepSeek V4 Flash($0.086/$0.173)这类 flash 档模型便宜得多。单次回复的输出上限为 131,072 token。这是一个预览版,由 Mistral 自己的 endpoint 提供服务,该 endpoint 不提供零数据保留,正式发布前行为可能发生变化。
快速开始(curl)
curl https://api.quicksilverpro.io/v1/chat/completions \
-H "Authorization: Bearer $QSP_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "mistral-large-4",
"messages": [{"role": "user", "content": "Hello!"}]
}'兼容 OpenAI。只需改一行 base_url 即可迁移。
常见问题
每百万输入 token $0.68,每百万输出 token $2.09,每百万缓存输入 token $0.07 —— 与该模型在 OpenRouter 上的标价持平,不加价。推理 token 按输出 token 计费。
不会。默认情况下它直接作答,不产生推理 token 费用。在请求中传入 `reasoning: {"enabled": true}` 即可为该次调用开启思考;推理轨迹会在单独的字段中返回,其 token 计入 `max_tokens`,并按输出价格计费。
支持。它接受文本和图像输入,返回文本。它支持流式输出、函数调用(包括强制指定工具)和 JSON Schema 结构化输出。图像可以用 URL 发送,也可以用 base64 data URL 内联发送。
设置 base_url=https://api.quicksilverpro.io/v1,使用你的 QSP key,并设置 model="mistral-large-4"。Chat Completions 和 Responses API 客户端使用同一个公开模型 ID。