Главная/Модели/DeepSeek V4.1 Flash
контекст 1MReasoningResponses API

DeepSeek V4.1 Flash в QuickSilver Pro

DeepSeek V4.1 Flash — это V4.1 Flash от DeepSeek: новая архитектура модели, быстрее и сильнее V4 Flash, с контекстом 1M токенов и нативным Responses API для Codex. QuickSilver Pro отдаёт её с точностью FP8 по цене $0.125 / $0.55 за миллион токенов — меньше половины списочной ставки самой DeepSeek в часы пик.

$0.125 вход · $0.55 выход за 1M токенов
Автор:Raullen Chai·Обновлено

Коротко

Контекст
1M токенов
Вход / 1M
$0.125
Выход / 1M
$0.55
Думает по умолчанию
Да

Новейшая архитектура DeepSeek Flash для Codex, агентного кодинга и автоматизации на длинном контексте.

Сравнение цен ($/1M токенов)

ПровайдерВходВыходк QSP
QuickSilver Pro$0.125$0.55самая низкая цена
Списочная цена DeepSeek (DeepSeek API)$0.30$1.20на 54% ниже
OpenAI (GPT-4o-mini)$0.15$0.60на 8% ниже

Когда использовать

Выбирайте V4.1 Flash, когда нужна новейшая архитектура DeepSeek Flash — более быстрые ответы и более сильные кодинг и работа с инструментами, чем у V4 Flash, — для Codex, агентного кодинга, многошагового использования инструментов и автоматизации на длинном контексте. Официальная сборка поддерживает клиентов и OpenAI Chat Completions, и Responses API под стабильным ID модели в QSP.

Когда выбрать другую модель

Если нужна устоявшаяся рабочая лошадка с минимальной ценой, V4 Flash ($0.086/$0.173) дешевле. Для по-настоящему сложных рассуждений переходите на V4 Pro. V4.1 Flash здесь работает только с текстом — если нужен ввод изображений, его принимают 35 из наших 68 моделей.

Быстрый старт (curl)

curl https://api.quicksilverpro.io/v1/chat/completions \
  -H "Authorization: Bearer $QSP_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4.1-flash",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

Совместимо с OpenAI. Миграция в одну строку через base_url.

FAQ

V4.1 Flash — более новая архитектура Flash от DeepSeek: быстрее и сильнее в кодинге и работе с инструментами. V4 Flash ($0.086/$0.173) остаётся устоявшимся вариантом с минимальной ценой. Обе думают по умолчанию и доступны через OpenAI Chat Completions и Responses API.

V4.1 Flash рассуждает по умолчанию. Чтобы получать прямые ответы без размышлений через Chat Completions, передайте `reasoning: { enabled: false }`; клиенты Responses API могут управлять глубиной через `reasoning.effort`.

Да. Используйте base_url=https://api.quicksilverpro.io/v1 и model="deepseek-v4.1-flash". QSP предоставляет и `/v1/chat/completions`, и `/v1/responses`; для Codex укажите `wire_api = "responses"`.

Попробуйте DeepSeek V4.1 Flash с удвоенным балансом — до $50 бонусных кредитов

Получить API Key