DeepSeek V4 Pro в QuickSilver Pro
DeepSeek V4 Pro — флагман волны V4 для рассуждений премиум-класса: контекст 1M токенов, рассуждения по умолчанию и OpenAI-совместимые Chat Completions и Responses API. QuickSilver Pro отдаёт V4 Pro по $0.70 за вход / $2.10 за выход за миллион токенов — примерно на 47% ниже опубликованной цены API самой DeepSeek в $1.32 / $3.96. Это экономичная альтернатива o3-mini для задач с премиальными рассуждениями на длинном контексте.
Коротко
Премиальные рассуждения + контекст 1M, на ~47% ниже опубликованной цены API самой DeepSeek.
Сравнение цен ($/1M токенов)
| Провайдер | Вход | Выход | к QSP |
|---|---|---|---|
| QuickSilver Pro | $0.70 | $2.10 | самая низкая цена |
| Официальный прайс DeepSeek (DeepSeek official API) | $1.32 | $3.96 | на 47% ниже |
| OpenAI (o3-mini) | $1.10 | $4.40 | на 52% ниже |
Когда использовать
V4 Pro — правильный выбор, когда V4 Flash не хватает интеллекта, а потокенная стоимость моделей передового уровня начинает накапливаться. Многошаговые кодинг-агенты, планировщики рефакторинга, суммаризация больших документов с рассуждениями, задачи в духе олимпиадной математики и теорем, а также любая нагрузка, где вы рассматривали бы o3-mini, но останавливает цена. Контекстное окно 1M масштабируется дальше, чем 200K у o3-mini.
Когда выбрать другую модель
Для рутинного чата, генерации кода и неагентных одношаговых задач V4 Flash ($0.086/$0.173) справляется с большинством из них дешевле. Если нужны возможности закрытых моделей, оставайтесь на o-серии OpenAI. Для агентных задач и планирования уровня Opus — Kimi K2.6.
Быстрый старт (curl)
curl https://api.quicksilverpro.io/v1/chat/completions \
-H "Authorization: Bearer $QSP_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4-pro",
"messages": [{"role": "user", "content": "Hello!"}]
}'Совместимо с OpenAI. Миграция в одну строку через base_url.
FAQ
На задачах с премиальными рассуждениями и длинным контекстом — может быть. V4 Pro рассуждает по умолчанию, поддерживает контекст 1M против 200K у o3-mini и стоит $0.70 за вход / $2.10 за выход против $1.10 / $4.40 за миллион токенов у o3-mini. Сравните обе на собственном eval-наборе; V4 Pro работает только с текстом, тогда как 35 из наших 68 моделей принимают изображения.
V4 Pro — премиальный уровень рассуждений в волне V4: более глубокий chain-of-thought на сложных задачах (олимпиадная математика, доказательство теорем, многошаговое планирование) по $0.70 / $2.10 за 1M. V4 Flash ($0.086/$0.173) — недорогая рабочая лошадка для рутинного чата и генерации кода. У обеих лимиты контекста берутся из каталога, и обе думают по умолчанию. Выбирайте V4 Pro, когда качество ответа на сложных рассуждениях важнее потокенной стоимости.
В целом да — 1M токенов это примерно 2.5–3 миллиона слов кода на современных языках. Этого хватает для большинства монорепозиториев. Учтите, что стоимость растёт линейно с числом входных токенов (~$0.70 за 1M на входе), так что загрузка контекста в 1M токенов обойдётся в $0.70 только за вход, ещё до рассуждений. Для часто повторяющегося контекста рассмотрите RAG или частичное кэширование промпта, когда мы его выпустим.
QuickSilver Pro берёт $0.70 за миллион входных токенов, $2.10 за миллион выходных токенов и $0.10 за миллион кэшированных входных токенов — примерно на 47% ниже опубликованного прайс-листа API самой DeepSeek в $1.32 / $3.96 за миллион токенов.