GLM 5.3 в QuickSilver Pro
GLM 5.3 — новейший reasoning-флагман Z.ai, настроенный под сложную программную инженерию и длительные агентные задачи, с контекстным окном на 1M токенов и максимальным выводом 131K. На QuickSilver Pro он стоит $1.12 за вход / $3.52 за выход за миллион токенов, примерно на 20% ниже собственной списочной цены Z.ai: $1.40 / $4.40. В отличие от GLM 5.2, reasoning на этом endpoint включён всегда и не отключается — глубиной управляет `reasoning_effort`.
Коротко
Сложная программная инженерия и длительные агентные задачи — новейший reasoning-флагман Z.ai с контекстным окном на 1M токенов.
Сравнение цен ($/1M токенов)
| Провайдер | Вход | Выход | к QSP |
|---|---|---|---|
| QuickSilver Pro | $1.12 | $3.52 | самая низкая цена |
| Z.ai (z-ai/glm-5.3) | $1.40 | $4.40 | на 20% ниже |
| OpenAI (GPT-4o) | $2.50 | $10.00 | на 65% ниже |
Когда использовать
Берите GLM 5.3 для самых тяжёлых нагрузок в семействе Z.ai: рефакторинг в масштабе репозитория, агенты «сначала план, потом действие», координирующие множество вызовов инструментов на длинной дистанции, и задачи, которым нужны и большой рабочий набор в контексте на 1M токенов, и до 131K токенов вывода за один вызов. Модель приходит на смену GLM 5.2 по той же потокенной цене, так что для новых проектов, которым нужен вдумчивый reasoning, это выбор по умолчанию в семействе. Reasoning включён всегда; используйте `reasoning_effort`, чтобы выбрать баланс между глубиной, задержкой и стоимостью.
Когда выбрать другую модель
Reasoning здесь обязателен, поэтому модель тратит токены на размышления даже на тривиальных репликах — если нужен GLM, который отвечает сразу, в семействе лучше подойдёт GLM 5.2 по той же цене. Для рутинного чата, кодогенерации на коротком контексте или одиночных задач потокенная цена и накладные расходы на reasoning избыточны — DeepSeek V4 Flash ($0.086/$0.173) или V4 Pro ($0.70/$2.10) решают большинство таких задач дешевле. Если у вас есть набор промптов, настроенный на GLM 5.2, перед переходом проведите A/B-тест — цена та же, но трассы и ритм вызовов инструментов отличаются. Именно для агентного кодинга стоит также сравнить в A/B с Kimi K2.7 Code.
Быстрый старт (curl)
curl https://api.quicksilverpro.io/v1/chat/completions \
-H "Authorization: Bearer $QSP_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.3",
"messages": [{"role": "user", "content": "Hello!"}]
}'Совместимо с OpenAI. Миграция в одну строку через base_url.
FAQ
Reasoning включён всегда — на этом endpoint он обязателен и не отключается (запрос, который пытается его выключить, отклоняется на стороне апстрима). Используйте `reasoning_effort`, чтобы выбрать баланс между глубиной, задержкой и стоимостью. Reasoning-токены тарифицируются как выходные и расходуются из бюджета `max_tokens` до видимого ответа, поэтому задавайте `max_tokens` с запасом, иначе ответ может вернуться обрезанным. Если нужен GLM без постоянно включённых размышлений, используйте GLM 5.2 — та же цена, по умолчанию прямые ответы.
GLM 5.3 — следующий релиз Z.ai (2026-08-18) с улучшенными результатами в сложной программной инженерии и длительных агентных задачах, тем же контекстным окном на 1M токенов и явным лимитом вывода 131K. Важно одно отличие в поведении: у GLM 5.3 reasoning обязателен и не отключается, а GLM 5.2 по умолчанию отвечает напрямую. Цены одинаковые — $1.12 за вход / $3.52 за выход за миллион токенов, так что апгрейд сводится к замене ID модели; заложите дополнительные выходные токены на постоянно включённые размышления.
Да — GLM 5.3 на QuickSilver Pro представляет собой OpenAI-совместимый endpoint chat completions (Responses API тоже работает). Укажите base_url=https://api.quicksilverpro.io/v1, вставьте свой ключ QSP и используйте model="glm-5.3". Streaming, tool calling (`tool_choice: "auto"` — этот endpoint отклоняет принудительный выбор конкретной функции) и учёт usage.cost работают. `response_format: json_schema` на этом endpoint пока не обеспечивается принудительно; если нужен строгий структурированный вывод, используйте GLM 5.2.
Z.ai указывает для GLM 5.3 $1.40 за вход / $4.40 за выход за миллион токенов; на QuickSilver Pro — $1.12 / $3.52, примерно на 20% ниже и на входе, и на выходе. Тот же OpenAI-совместимый интерфейс; миграция — это замена base_url и ключа, а из ID модели нужно убрать префикс провайдера `z-ai/`.