контекст 1MResponses API

GLM 5.2 в QuickSilver Pro

GLM 5.2 — крупномасштабный reasoning-флагман Z.ai: контекстное окно на 1M токенов, настроенное под длительные агентные сценарии и программную инженерию на уровне проекта. На QuickSilver Pro он стоит $1.12 за вход / $3.52 за выход за 1M токенов, примерно на 20% ниже собственной списочной цены Z.ai $1.40 / $4.40 (ставка, которую берёт большинство провайдеров). QuickSilver Pro обслуживает модель в режиме без размышлений, поэтому ответы прямые, без reasoning-трассы.

$1.12 вход · $3.52 выход за 1M токенов
Автор:Raullen Chai·Обновлено

Коротко

Контекст
1M токенов
Вход / 1M
$1.12
Выход / 1M
$3.52
Думает по умолчанию
Нет

Длительные агентные задачи и кодинг на уровне проекта — reasoning-флагман Z.ai с контекстным окном на 1M токенов.

Сравнение цен ($/1M токенов)

ПровайдерВходВыходк QSP
QuickSilver Pro$1.12$3.52самая низкая цена
Z.ai (z-ai/glm-5.2)$1.40$4.40на 20% ниже
OpenAI (GPT-4o)$2.50$10.00на 65% ниже

Когда использовать

Берите GLM 5.2 для длительных агентных циклов и программной инженерии в масштабе репозитория: многошаговый рефакторинг, агенты «сначала план, потом действие», координирующие множество вызовов инструментов, и задачи, где нужно удерживать большой рабочий набор в контексте на 1M токенов.

Когда выбрать другую модель

Для рутинного чата, кодогенерации на коротком контексте или одиночных задач потокенная цена и накладные расходы на reasoning избыточны — DeepSeek V4 Flash ($0.086/$0.173) или V4 Pro ($0.70/$2.10) решают большинство таких задач дешевле. Для чисто математических рассуждений — DeepSeek V4 Pro. Именно для агентного кодинга проведите A/B-сравнение с Kimi K2.7 Code.

Быстрый старт (curl)

curl https://api.quicksilverpro.io/v1/chat/completions \
  -H "Authorization: Bearer $QSP_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "glm-5.2",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

Совместимо с OpenAI. Миграция в одну строку через base_url.

FAQ

GLM 5.2 умеет рассуждать, но QuickSilver Pro обслуживает модель в режиме без размышлений: вы получаете прямой ответ и никогда не платите за скрытую reasoning-трассу. Поле `reasoning` в запросе её не включает. Если задаче нужны пошаговые рассуждения в том же семействе, используйте GLM 5.3, где reasoning включён всегда.

Да — GLM 5.2 на QuickSilver Pro представляет собой OpenAI-совместимый endpoint chat completions. Укажите base_url=https://api.quicksilverpro.io/v1, вставьте свой ключ QSP и используйте model="glm-5.2". Streaming, tool calling, strict-режим json_schema и учёт usage.cost работают.

Z.ai указывает для GLM 5.2 $1.40 за вход / $4.40 за выход за 1M токенов — ставка, которую берёт большинство провайдеров; на QuickSilver Pro — $1.12 / $3.52, примерно на 20% ниже и на входе, и на выходе. Тот же OpenAI-совместимый интерфейс; миграция — это замена base_url и ключа, а из ID модели нужно убрать префикс провайдера `z-ai/`.

Попробуйте GLM 5.2 с удвоенным балансом — до $50 бонусных кредитов

Получить API Key