контекст 524,288МультимодальнаяReasoningResponses API

Mistral Large 4 в QuickSilver Pro

Mistral Large 4 — передовая мультимодальная модель Mistral AI, выпущенная в preview 6 октября 2026 года: текст и изображения на входе, контекст на 524,288 токенов и ориентация на код, рассуждения и агентные задачи. QuickSilver Pro работает через собственный endpoint Mistral по цене $0.68 за вход / $2.09 за выход за миллион токенов — столько же, сколько по прайс-листу этой модели на OpenRouter, без наценки.

$0.68 вход · $2.09 выход за 1M токенов
Автор:Raullen Chai·Обновлено

Коротко

Контекст
524,288 токенов
Вход / 1M
$0.68
Выход / 1M
$2.09
Думает по умолчанию
Нет

Флагман Mistral для кода и агентов — текст и изображения на входе, контекст 524,288 и reasoning, который включается для отдельного запроса.

Сравнение цен ($/1M токенов)

ПровайдерВходВыходк QSP
QuickSilver Pro$0.68$2.09—
OpenRouter list price (mistralai/mistral-large-4-0)$0.68$2.09так же

Когда использовать

Используйте Mistral Large 4 для агентных циклов, работы с кодом в нескольких файлах и длинных документов, когда нужен актуальный европейский флагман: контекст на 524,288 токенов вмещает большой репозиторий или стопку отчётов, модель читает скриншоты и диаграммы вместе с текстом и поддерживает function calling (включая принудительный выбор инструмента) и структурированный вывод по JSON Schema. По умолчанию ответы прямые; для более сложных задач передайте `reasoning: {"enabled": true}`, и модель будет думать перед ответом. Кэшированный вход стоит $0.07 за миллион токенов.

Когда выбрать другую модель

Режим reasoning работает основательно и может потратить тысячи выходных токенов до начала ответа, поэтому для обычного чата оставляйте его выключенным, а при включении задавайте `max_tokens` с запасом. Для массового простого извлечения данных модель flash-уровня, например DeepSeek V4 Flash ($0.086/$0.173), обходится намного дешевле. Один ответ ограничен 131,072 выходными токенами. Это preview-релиз, который обслуживается собственным endpoint Mistral; он не предлагает нулевого хранения данных, а поведение может измениться до общего релиза.

Быстрый старт (curl)

curl https://api.quicksilverpro.io/v1/chat/completions \
  -H "Authorization: Bearer $QSP_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "mistral-large-4",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

Совместимо с OpenAI. Миграция в одну строку через base_url.

FAQ

$0.68 за миллион входных токенов, $2.09 за миллион выходных токенов и $0.07 за миллион кэшированных входных токенов — столько же, сколько по прайс-листу этой модели на OpenRouter, без наценки. Токены reasoning оплачиваются как выходные.

Нет. По умолчанию она отвечает напрямую, и токены reasoning не начисляются. Передайте в запросе `reasoning: {"enabled": true}`, чтобы включить размышление для этого вызова; ход рассуждений возвращается в отдельном поле, а его токены учитываются в `max_tokens` и оплачиваются по выходной ставке.

Да. Она принимает текст и изображения на входе и возвращает текст. Поддерживаются streaming, function calling (включая принудительный выбор инструмента) и структурированный вывод по JSON Schema. Изображения можно отправлять по URL или встроенными, в виде base64 data URL.

Укажите base_url=https://api.quicksilverpro.io/v1, используйте свой ключ QSP и задайте model="mistral-large-4". Клиенты Chat Completions и Responses API используют один и тот же публичный ID модели.

Попробуйте Mistral Large 4 с удвоенным балансом — до $50 бонусных кредитов

Получить API Key