Вышла GLM-5.3-Flash — модель близка к Opus 4.8 в кодинге и агентских задачах, но стоит примерно в 10 раз дешевле GLM-5.2.

320 млрд параметров, из которых одновременно активны только 18 млрд. Контекст до 1 млн токенов.

Тест бесплатный: chat.z.ai