14 августа 2026 Z.ai выложил GLM-5.3. К 22 августа это уже не слух из ленты: модель раскатали на все тарифы GLM Coding Plan, таблица бенчмарков висит в официальном посте, а публичных весов всё ещё нет. Главный факт не «ещё одна гигантская сеть». База та же, что у GLM-5.2. Весь заявленный рост Z.ai списывает на постобучение. Ниже сверка с постом лаборатории и документацией подписки: что умеет GLM-5.3, как устроен GLM Coding Plan и кому сейчас нужен Zhipu GLM для кода.

Что такое GLM-5.3: та же база, другой посттренинг

Zhipu AI (бренд платформы Z.ai) не собирала под 5.3 новый претрейн. Формулировка в релизе прямая: Scaling post-training is all we did. Стек, который уже крутился на 5.2, просто масштабировали ещё месяц: больше сред, больше длинных задач, больше RL. Названия внутренние: IndexShare для длинного контекста, SAO для обучения на длинном горизонте, slime как открытый каркас посттренинга. Для практики это важнее маркетингового «флагман».

Число параметров в посте 5.3 не печатают именно потому, что база не менялась. На карточке zai-org/GLM-5.2 стоит 753B. В обзорах провайдеров и в русскоязычных анонсах 14 августа гуляло 743B. Это одна Mixture-of-Experts база GLM-5.2, не новая модель «на сто миллиардов больше». Смысл релиза: политика и среды, не размер чекпоинта. Локальная 27B на игровой карте это другой класс, его мы разбирали отдельно в статье про Qwen 3.8 на RTX 3090. GLM-5.3 туда не ставится.

Ещё три технических ограничения, которые ломают старые клиенты.

Terminal Bench и DeepSWE: какие цифры есть в таблице Z.ai

Цифры ниже самоотчёт лаборатории. Независимой полной репликации на 22 августа нет. Смотрите их как верхнюю оценку в harness Claude Code, не как паспорт вашей сессии.

Два скачка, из-за которых 5.3 вообще обсуждают.

Соседние агентные цифры из той же таблицы: AutomationBench 26,2 → 48,2, Agents' Last Exam (CLI) 23,8 → 28,5, HLE с инструментами 54,7 → 62,5. На внутреннем Z.ai Code Bench лаборатория пишет про плюс 50% к 5.2. При High 5.3 даёт 31,4% точности при примерно 50 тысячах выходных токенов на задачу. Opus 4.8 в той же постановке 29,5% при 120 тысячах. При Max 5.3: 34,5% и около 75 тысяч токенов против 23,4% и 96 тысяч у 5.2. Смысл не только «стала умнее», но и «меньше болтает на тот же результат».

Фронтир закрытых моделей таблица не переписывает. На Terminal Bench 3.0 GPT-5.6 Sol стоит 34,6, Claude Fable 5 стоит 33,7. На DeepSWE те же двое: 72,7 и 69,7. Kimi K3 на DeepSWE 67,5, чуть выше 5.3. Честный слоган Z.ai: сильнейшая открытая кодовая модель в их замере. Слово «открытая» пока про обещание весов, не про файл, который вы скачали сегодня.

Zhipu GLM для кода: это агент, не чат

Запрос «Zhipu GLM код» в 2026 чаще маскирует другое: нужен не ещё один чат с подсветкой синтаксиса, а модель, которая живёт в Claude Code, Cline, OpenCode или ZCode и тащит длинный цикл. GLM-5.3 заточена под этот контур. Среды постобучения Z.ai описывает как куски настоящей работы инженера: кластер, репозиторий, внутренние доки, прогон, проверка. Не «напиши функцию по юнит-тесту».

Практический вывод для вайб-цикла тот же, что в гайде по сборке сайта через AI: модель без harness это болтливый ассистент. Модель внутри агента это другой продукт. GLM-5.3 имеет смысл пробовать там, где у вас уже стоит CLI-агент и болит длинный горизонт: терминал на часы, многофайловый рефактор, задача, которую 5.2 бросала на середине. Не там, где нужен локальный эндпоинт без ключа. Схема «маленький режиссёр поверх сильного кодера» из разбора Faraday 27B сюда не ложится: GLM-5.3 сама претендует на роль сильного кодера в облаке, а не на роль 27B-надзирателя.

Кибер-блок релиза для кода вторичен, но объясняет, почему веса задержали. На CyberGym (поиск и валидация уязвимостей по исходному коду) Z.ai ставит 84,5% и называет это лучшим результатом, выше Mythos 5 и GPT-5.6 Sol. На более «высоких» ступенях цепочки 5.3 растёт сильнее относительно 5.2, но закрытый фронтир всё ещё впереди. Лаборатория прямо пишет: capability растёт быстрее всего там, где отставание самое большое. Для студии это сигнал про аудит своего репозитория и про то, что открытый чекпоинт выйдет не в день анонса. Это не инструкция «как эксплуатировать чужой сервис».

Что такое GLM Coding Plan

GLM Coding Plan это подписка Z.ai под кодовых агентов, не безлимитный чат и не публичный per-token прайс 5.3. Официальный обзор: docs.z.ai/devpack/overview. Оплата: z.ai/subscribe. На 22 августа 2026 все тарифы плана уже отдают GLM-5.3 плюс GLM-5-Turbo и GLM-4.7. Отдельной строки «5.3 только на Max» нет.

Квоты считают в кредитах, не в «промптах как в рекламе». Два потолка сразу: скользящее окно 5 часов и недельный лимит. Это рифмуется с Claude Code, только формула другая. Как у Anthropic устроены weekly и окно, мы разбирали в статье про лимиты Claude Code.

Живой ценник проверяйте на странице подписки: Z.ai уже переписывал прайс и систему квот в июле и августе 2026. Год даёт скидку порядка 30%, квартал около 20%. Формула кредита для модели: (вход × множитель входа + кэш × множитель кэша + выход × множитель выхода) / 10 000. У GLM-5.3 множители 6,9 / 1,7 / 24. Выход жрёт квоту заметно сильнее входа. Кэш наоборот дешёвый, поэтому клиент с высоким cache hit (Z.ai для ZCode пишет про 98%+) растягивает неделю.

Пиковые часы: будни с 14:00 до 18:00 UTC+8. Остальное время, включая все выходные, модель списывает 50% кредитов. По Москве пик это примерно с 9:00 до 13:00 в будни. Ночной прогон и уикенд для плана выгоднее дневного созвона в Азии. На оценке токенов в неделю Z.ai рисует вилку: Lite порядка 43-105 млн при разном кэше и пике, Pro 263-627 млн, Max 613-1 463 млн. Это оценка лаборатории, не ваш репозиторий с auto-accept.

Per-token API для 5.3 на 22 августа не опубликован. У 5.2 на платформе Z.ai было 1,40 USD за миллион входа и 4,40 USD за миллион выхода. Не переносите эти цифры на 5.3, пока строки нет. Почему цена за миллион врёт, если смотреть на успешный шаг, а не на токен: стоимость токенов Claude и GPT.

Кому брать Coding Plan сейчас, кому ждать веса

План имеет смысл, если вы уже живёте в агенте и хотите более дешёвый фронтир-кодер, чем Claude Max, с понятным потолком на месяц. Lite это разведка на одном репозитории. Pro это ежедневная работа. Max это несколько параллельных проектов: документация прямо пишет, что concurrency динамический, Max выше Pro, Pro выше Lite, и советует один проект на Lite, один-два на Pro, два и больше на Max.

Не берите план как замену локальной модели. Весов нет, 743B/753B вы на 3090 не поднимете, лицензию 5.3 ещё не показали. У 5.2 была MIT, на 5.3 это прецедент, не договор. Не берите план, если вам нужен SLA западного API, счёт в долларах без китайского кабинета или гарантия, что бенчмарк 28,3 на Terminal Bench 3.0 повторится на вашем легаси. Самоотчёт плюс отсутствие независимой репликации это нормальный стоп-кран для прод-контура с аудитом.

Гибрид, который сходится на 22 августа:

  1. План и спорная архитектура: тот агент, которому вы уже доверяете (часто Claude Code на сильной модели).
  2. Длинный терминальный цикл и многофайловая рутина: GLM-5.3 через Coding Plan в том же Claude Code / Cline / OpenCode, reasoning_effort=max, кэш включён, тяжёлые прогоны вне пика UTC+8.
  3. Код, который нельзя отдавать третьей стороне: ждать веса или оставаться на локальной модели меньшего размера. 5.3 этот слой сегодня не закрывает.

Миграция клиента: выключите disabled-thinking до смены model id. Иначе получите ошибку, а не «модель стала глупее». Для кода не ставьте low «чтобы сэкономить», если задача как раз из корзины Terminal Bench 3.0. Экономия здесь это кэш, оффпик и узкий контекст, не выключенные размышления.

Чего релиз не обещает

GLM-5.3 не доказал, что открытые веса китайской лаборатории обошли GPT-5.6 Sol. В собственной таблице они ниже на ключевых кодовых тестах. Не доказал, что постобучение без нового претрейна всегда даёт шестикратный рост: это результат одного стека сред и одного месяца compute. Не обещает публичный API в день, когда вы это читаете. Не обещает, что лицензия будет MIT. Кибер-цифры не делают модель вашим пентестером: Z.ai сам режет доступ и сначала отдаёт модель партнёрам по безопасности.

Если вы сравниваете «какую одну подписку купить», смотрите не заголовок «SOTA open-weights». Смотрите, где крутится агент, как списывается квота и куда уезжает репозиторий. GLM-5.3 сильный аргумент в пользу того, что посттренинг сейчас двигает кодовый фронтир быстрее, чем новый претрейн. Это наблюдение Z.ai, не закон физики. Полка, где этот слой разбирают как науку, а не как прайс: курс по LLM Georgia Tech, с чего начать.

Коротко

22 августа 2026 GLM-5.3 это не новая база, а постобучение поверх GLM-5.2. В таблице Z.ai Terminal Bench 3.0 прыгает с 4,6 до 28,3, DeepSWE v1.1 с 46,2 до 66,9. Закрытый фронтир всё ещё выше. Живой доступ: GLM Coding Plan и ZCode, вход от 18 USD, кредиты, пик с 14:00 до 18:00 UTC+8. Веса и публичный API ещё в очереди на safety. Zhipu GLM для кода имеет смысл как агентный кодер в уже привычном CLI, не как локальная замена 3090 и не как безлимитный чат. Перед оплатой откройте z.ai/subscribe и docs.z.ai: квота и прайс в этом семействе уже успели смениться один раз за лето.