DeepSeek V4.1 Flash в QuickSilver Pro
DeepSeek V4.1 Flash — это V4.1 Flash от DeepSeek: новая архитектура модели, быстрее и сильнее V4 Flash, с контекстом 1M токенов и нативным Responses API для Codex. QuickSilver Pro отдаёт её с точностью FP8 по цене $0.125 / $0.55 за миллион токенов — меньше половины списочной ставки самой DeepSeek в часы пик.
Коротко
Новейшая архитектура DeepSeek Flash для Codex, агентного кодинга и автоматизации на длинном контексте.
Сравнение цен ($/1M токенов)
| Провайдер | Вход | Выход | к QSP |
|---|---|---|---|
| QuickSilver Pro | $0.125 | $0.55 | самая низкая цена |
| Списочная цена DeepSeek (DeepSeek API) | $0.30 | $1.20 | на 54% ниже |
| OpenAI (GPT-4o-mini) | $0.15 | $0.60 | на 8% ниже |
Когда использовать
Выбирайте V4.1 Flash, когда нужна новейшая архитектура DeepSeek Flash — более быстрые ответы и более сильные кодинг и работа с инструментами, чем у V4 Flash, — для Codex, агентного кодинга, многошагового использования инструментов и автоматизации на длинном контексте. Официальная сборка поддерживает клиентов и OpenAI Chat Completions, и Responses API под стабильным ID модели в QSP.
Когда выбрать другую модель
Если нужна устоявшаяся рабочая лошадка с минимальной ценой, V4 Flash ($0.086/$0.173) дешевле. Для по-настоящему сложных рассуждений переходите на V4 Pro. V4.1 Flash здесь работает только с текстом — если нужен ввод изображений, его принимают 35 из наших 68 моделей.
Быстрый старт (curl)
curl https://api.quicksilverpro.io/v1/chat/completions \
-H "Authorization: Bearer $QSP_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4.1-flash",
"messages": [{"role": "user", "content": "Hello!"}]
}'Совместимо с OpenAI. Миграция в одну строку через base_url.
FAQ
V4.1 Flash — более новая архитектура Flash от DeepSeek: быстрее и сильнее в кодинге и работе с инструментами. V4 Flash ($0.086/$0.173) остаётся устоявшимся вариантом с минимальной ценой. Обе думают по умолчанию и доступны через OpenAI Chat Completions и Responses API.
V4.1 Flash рассуждает по умолчанию. Чтобы получать прямые ответы без размышлений через Chat Completions, передайте `reasoning: { enabled: false }`; клиенты Responses API могут управлять глубиной через `reasoning.effort`.
Да. Используйте base_url=https://api.quicksilverpro.io/v1 и model="deepseek-v4.1-flash". QSP предоставляет и `/v1/chat/completions`, и `/v1/responses`; для Codex укажите `wire_api = "responses"`.