Mistral Large 4 в QuickSilver Pro
Mistral Large 4 — передовая мультимодальная модель Mistral AI, выпущенная в preview 6 октября 2026 года: текст и изображения на входе, контекст на 524,288 токенов и ориентация на код, рассуждения и агентные задачи. QuickSilver Pro работает через собственный endpoint Mistral по цене $0.68 за вход / $2.09 за выход за миллион токенов — столько же, сколько по прайс-листу этой модели на OpenRouter, без наценки.
Коротко
Флагман Mistral для кода и агентов — текст и изображения на входе, контекст 524,288 и reasoning, который включается для отдельного запроса.
Сравнение цен ($/1M токенов)
| Провайдер | Вход | Выход | к QSP |
|---|---|---|---|
| QuickSilver Pro | $0.68 | $2.09 | — |
| OpenRouter list price (mistralai/mistral-large-4-0) | $0.68 | $2.09 | так же |
Когда использовать
Используйте Mistral Large 4 для агентных циклов, работы с кодом в нескольких файлах и длинных документов, когда нужен актуальный европейский флагман: контекст на 524,288 токенов вмещает большой репозиторий или стопку отчётов, модель читает скриншоты и диаграммы вместе с текстом и поддерживает function calling (включая принудительный выбор инструмента) и структурированный вывод по JSON Schema. По умолчанию ответы прямые; для более сложных задач передайте `reasoning: {"enabled": true}`, и модель будет думать перед ответом. Кэшированный вход стоит $0.07 за миллион токенов.
Когда выбрать другую модель
Режим reasoning работает основательно и может потратить тысячи выходных токенов до начала ответа, поэтому для обычного чата оставляйте его выключенным, а при включении задавайте `max_tokens` с запасом. Для массового простого извлечения данных модель flash-уровня, например DeepSeek V4 Flash ($0.086/$0.173), обходится намного дешевле. Один ответ ограничен 131,072 выходными токенами. Это preview-релиз, который обслуживается собственным endpoint Mistral; он не предлагает нулевого хранения данных, а поведение может измениться до общего релиза.
Быстрый старт (curl)
curl https://api.quicksilverpro.io/v1/chat/completions \
-H "Authorization: Bearer $QSP_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "mistral-large-4",
"messages": [{"role": "user", "content": "Hello!"}]
}'Совместимо с OpenAI. Миграция в одну строку через base_url.
FAQ
$0.68 за миллион входных токенов, $2.09 за миллион выходных токенов и $0.07 за миллион кэшированных входных токенов — столько же, сколько по прайс-листу этой модели на OpenRouter, без наценки. Токены reasoning оплачиваются как выходные.
Нет. По умолчанию она отвечает напрямую, и токены reasoning не начисляются. Передайте в запросе `reasoning: {"enabled": true}`, чтобы включить размышление для этого вызова; ход рассуждений возвращается в отдельном поле, а его токены учитываются в `max_tokens` и оплачиваются по выходной ставке.
Да. Она принимает текст и изображения на входе и возвращает текст. Поддерживаются streaming, function calling (включая принудительный выбор инструмента) и структурированный вывод по JSON Schema. Изображения можно отправлять по URL или встроенными, в виде base64 data URL.
Укажите base_url=https://api.quicksilverpro.io/v1, используйте свой ключ QSP и задайте model="mistral-large-4". Клиенты Chat Completions и Responses API используют один и тот же публичный ID модели.