контекст 1MReasoningResponses API

DeepSeek V4 Pro в QuickSilver Pro

DeepSeek V4 Pro — флагман волны V4 для рассуждений премиум-класса: контекст 1M токенов, рассуждения по умолчанию и OpenAI-совместимые Chat Completions и Responses API. QuickSilver Pro отдаёт V4 Pro по $0.70 за вход / $2.10 за выход за миллион токенов — примерно на 47% ниже опубликованной цены API самой DeepSeek в $1.32 / $3.96. Это экономичная альтернатива o3-mini для задач с премиальными рассуждениями на длинном контексте.

$0.70 вход · $2.10 выход за 1M токенов
Автор:Raullen Chai·Обновлено

Коротко

Контекст
1M токенов
Вход / 1M
$0.70
Выход / 1M
$2.10
Думает по умолчанию
Да

Премиальные рассуждения + контекст 1M, на ~47% ниже опубликованной цены API самой DeepSeek.

Сравнение цен ($/1M токенов)

ПровайдерВходВыходк QSP
QuickSilver Pro$0.70$2.10самая низкая цена
Официальный прайс DeepSeek (DeepSeek official API)$1.32$3.96на 47% ниже
OpenAI (o3-mini)$1.10$4.40на 52% ниже

Когда использовать

V4 Pro — правильный выбор, когда V4 Flash не хватает интеллекта, а потокенная стоимость моделей передового уровня начинает накапливаться. Многошаговые кодинг-агенты, планировщики рефакторинга, суммаризация больших документов с рассуждениями, задачи в духе олимпиадной математики и теорем, а также любая нагрузка, где вы рассматривали бы o3-mini, но останавливает цена. Контекстное окно 1M масштабируется дальше, чем 200K у o3-mini.

Когда выбрать другую модель

Для рутинного чата, генерации кода и неагентных одношаговых задач V4 Flash ($0.086/$0.173) справляется с большинством из них дешевле. Если нужны возможности закрытых моделей, оставайтесь на o-серии OpenAI. Для агентных задач и планирования уровня Opus — Kimi K2.6.

Быстрый старт (curl)

curl https://api.quicksilverpro.io/v1/chat/completions \
  -H "Authorization: Bearer $QSP_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4-pro",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

Совместимо с OpenAI. Миграция в одну строку через base_url.

FAQ

На задачах с премиальными рассуждениями и длинным контекстом — может быть. V4 Pro рассуждает по умолчанию, поддерживает контекст 1M против 200K у o3-mini и стоит $0.70 за вход / $2.10 за выход против $1.10 / $4.40 за миллион токенов у o3-mini. Сравните обе на собственном eval-наборе; V4 Pro работает только с текстом, тогда как 35 из наших 68 моделей принимают изображения.

V4 Pro — премиальный уровень рассуждений в волне V4: более глубокий chain-of-thought на сложных задачах (олимпиадная математика, доказательство теорем, многошаговое планирование) по $0.70 / $2.10 за 1M. V4 Flash ($0.086/$0.173) — недорогая рабочая лошадка для рутинного чата и генерации кода. У обеих лимиты контекста берутся из каталога, и обе думают по умолчанию. Выбирайте V4 Pro, когда качество ответа на сложных рассуждениях важнее потокенной стоимости.

В целом да — 1M токенов это примерно 2.5–3 миллиона слов кода на современных языках. Этого хватает для большинства монорепозиториев. Учтите, что стоимость растёт линейно с числом входных токенов (~$0.70 за 1M на входе), так что загрузка контекста в 1M токенов обойдётся в $0.70 только за вход, ещё до рассуждений. Для часто повторяющегося контекста рассмотрите RAG или частичное кэширование промпта, когда мы его выпустим.

QuickSilver Pro берёт $0.70 за миллион входных токенов, $2.10 за миллион выходных токенов и $0.10 за миллион кэшированных входных токенов — примерно на 47% ниже опубликованного прайс-листа API самой DeepSeek в $1.32 / $3.96 за миллион токенов.

Попробуйте DeepSeek V4 Pro с удвоенным балансом — до $50 бонусных кредитов

Получить API Key