GLM 5.2 в QuickSilver Pro
GLM 5.2 — крупномасштабный reasoning-флагман Z.ai: контекстное окно на 1M токенов, настроенное под длительные агентные сценарии и программную инженерию на уровне проекта. На QuickSilver Pro он стоит $1.12 за вход / $3.52 за выход за 1M токенов, примерно на 20% ниже собственной списочной цены Z.ai $1.40 / $4.40 (ставка, которую берёт большинство провайдеров). QuickSilver Pro обслуживает модель в режиме без размышлений, поэтому ответы прямые, без reasoning-трассы.
Коротко
Длительные агентные задачи и кодинг на уровне проекта — reasoning-флагман Z.ai с контекстным окном на 1M токенов.
Сравнение цен ($/1M токенов)
| Провайдер | Вход | Выход | к QSP |
|---|---|---|---|
| QuickSilver Pro | $1.12 | $3.52 | самая низкая цена |
| Z.ai (z-ai/glm-5.2) | $1.40 | $4.40 | на 20% ниже |
| OpenAI (GPT-4o) | $2.50 | $10.00 | на 65% ниже |
Когда использовать
Берите GLM 5.2 для длительных агентных циклов и программной инженерии в масштабе репозитория: многошаговый рефакторинг, агенты «сначала план, потом действие», координирующие множество вызовов инструментов, и задачи, где нужно удерживать большой рабочий набор в контексте на 1M токенов.
Когда выбрать другую модель
Для рутинного чата, кодогенерации на коротком контексте или одиночных задач потокенная цена и накладные расходы на reasoning избыточны — DeepSeek V4 Flash ($0.086/$0.173) или V4 Pro ($0.70/$2.10) решают большинство таких задач дешевле. Для чисто математических рассуждений — DeepSeek V4 Pro. Именно для агентного кодинга проведите A/B-сравнение с Kimi K2.7 Code.
Быстрый старт (curl)
curl https://api.quicksilverpro.io/v1/chat/completions \
-H "Authorization: Bearer $QSP_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.2",
"messages": [{"role": "user", "content": "Hello!"}]
}'Совместимо с OpenAI. Миграция в одну строку через base_url.
FAQ
GLM 5.2 умеет рассуждать, но QuickSilver Pro обслуживает модель в режиме без размышлений: вы получаете прямой ответ и никогда не платите за скрытую reasoning-трассу. Поле `reasoning` в запросе её не включает. Если задаче нужны пошаговые рассуждения в том же семействе, используйте GLM 5.3, где reasoning включён всегда.
Да — GLM 5.2 на QuickSilver Pro представляет собой OpenAI-совместимый endpoint chat completions. Укажите base_url=https://api.quicksilverpro.io/v1, вставьте свой ключ QSP и используйте model="glm-5.2". Streaming, tool calling, strict-режим json_schema и учёт usage.cost работают.
Z.ai указывает для GLM 5.2 $1.40 за вход / $4.40 за выход за 1M токенов — ставка, которую берёт большинство провайдеров; на QuickSilver Pro — $1.12 / $3.52, примерно на 20% ниже и на входе, и на выходе. Тот же OpenAI-совместимый интерфейс; миграция — это замена base_url и ключа, а из ID модели нужно убрать префикс провайдера `z-ai/`.