Anthropic против китайской GLM-5.3
Не скрываю, что я - фанат китайских ИИ-моделей. И моя любовь к GLM зародилась еще на модели 4.7. И дальше "зайцы" делают всё круче и круче, а фронтир-лидеры стали чаще упоминать их в своих инфоповодах.
Anthropic (та самая, что делает Claude) опубликовала необычное предупреждение. Она назвала открытую китайскую модель GLM-5.3 от Zhipu AI самой «киберспособной» среди всех нейросетей с открытыми весами — и призвала такие модели больше не выкладывать в свободный доступ.
Спор получился показательный. Разберёмся, что именно намеряли американцы, что ответили китайцы и что с этим делать нам.
Что случилось
По данным Anthropic, на тесте ExploitBench — это проверка, умеет ли нейросеть находить и использовать уязвимости в программах — GLM-5.3 провела 50 успешных атак из 410. В 4% случаев модель получала полный контроль над потоком выполнения программы там, где американская Claude Opus 4.6 и прошлая китайская GLM-5.2 не справились вообще. А обходить защитные ограничения GLM-5.3 научилась в 64–100% попыток — смотря как атаковать.
Звучит тревожно, но тут есть вторая сторона. В Zhipu ответили, что их сервис OpenVuln, работающий на этой же модели, уже нашёл 4249 потенциальных уязвимостей в 389 опенсорс-проектах — и сообщил о них разработчикам. То есть та же способность, что пугает Anthropic, у китайцев работает на защиту: сначала находишь дыру, потом её закрывают.
Из технических деталей (разбор опубликовал SemiAnalysis): GLM-5.3 — это 744 млрд параметров по схеме «смесь экспертов». Проще: внутри модели много специализированных блоков, и на каждый запрос активируется лишь часть — около 40 млрд параметров. Поэтому большая модель работает экономно. Отдельный трюк — выгрузка памяти в обычную DRAM вместо дорогой видеопамяти, что снижает требования к железу.
По оценке американского института NIST CAISI, GLM-5.3 отстаёт от лучших закрытых моделей США примерно на четыре месяца развития. Четыре месяца — это и есть тот зазор, который сейчас делит две ИИ-сверхдержавы.
Что всё это значит для нас, практиков?
Первое. Попробовать GLM можно бесплатно и без обходов: чат на chat.z.ai открывается из России напрямую. А младшая версия GLM-5.3 Flash выложена с открытыми весами под лицензией MIT — её можно скачать и развернуть на своих серверах. Для компаний, которые обязаны хранить персональные данные в РФ (152-ФЗ), это принципиально: данные никуда не уходят, модель работает внутри вашего контура.
Второе. Цены. GLM-5.2 — самая сильная из полностью открытых версий — обходится по API примерно вшестеро дешевле GPT-5.5. Для пилотных проектов и малого бизнеса это разница между «попробуем» и «не потянем».
Третье. Честности ради: для работы с русским языком и российскими реалиями наши модели — GigaChat от Сбера и YandexGPT от Яндекса — пока понимают контекст лучше. Китайские модели сильны в коде, аналитике и англоязычных задачах, но российское законодательство и локальные сервисы знают слабо. Разумная связка: российская модель для текстов и регламентов, китайская — для кода и тяжёлой аналитики.
Предупреждение Anthropic стоит читать вдвойне внимательно: это и искренняя тревога специалистов по безопасности, и интерес компании, которая продаёт закрытые модели. Обе мотивации настоящие. И эта инфогонка только ускоряет приход новых моделей на рынок, от чего мы только выигрываем