AI И НЕЙРОСЕТИ

Z.ai открыла веса GLM-5.3, но добавила фильтр для гиперскейлеров

Модель с 753 млрд параметров Z.ai выпустила веса GLM-5.3, но для хостинга компаниями с выручкой свыше $10 млрд ввела отдельную проверку.

✍️ Редакция iTech News | 29.08.2026 | ⏱ 5 мин | Источник: The New Stack
🎓

Z.ai выложила веса GLM-5.3 на Hugging Face, но вместе с открытием доступа изменила правила игры: компании с совокупной выручкой выше $10 млрд за любые 12 подряд идущих месяцев теперь должны пройти проверку безопасности у самой Z.ai, прежде чем коммерчески хостить модель или ее производные. Для разработчиков это выглядит как очередной релиз open weight, а для крупных облаков и инфраструктурных платформ — как напоминание, что «открыто» в 2026 году все чаще означает «открыто, но не для всех одинаково».

Как пишет The New Stack, речь идет о флагманской модели Z.ai, которую компания анонсировала в середине августа 2026 года, а теперь перевела в формат открытых весов. До этого широкую известность получил анонимный ox-alpha, позже оказавшийся GLM-5.3-Flash. На этом фоне полноценный релиз GLM-5.3 выглядит не просто как выкладка очередного чекпойнта, а как попытка китайской лаборатории зафиксировать статус одного из главных поставщиков сильных open-weight-моделей для кода, агентных задач и длинного контекста.

Главная новость здесь даже не сама публикация модели, а новая лицензия. Если GLM-5.2 выходила под MIT, то теперь действует собственная лицензия GLM-5.3. Ее ключевое условие бьет не по обычным командам, стартапам или интеграторам, а по тем, кто хочет именно хостить модель, а не просто маршрутизировать вызовы через маркетплейс или встроить ее в продукт. Для компаний с выручкой свыше $10 млрд появляется обязательная security review. Для индивидуальных разработчиков, по сути, мало что меняется: права на запуск, деплой, дообучение и коммерческое использование заявлены. Но для гиперскейлеров и будущих «неооблаков» это уже не permissive-лицензия в стиле «берите и ставьте куда хотите», а модель распространения с контролем на входе.

У Z.ai есть аргумент, почему она вообще решила притормозить открытие весов и одновременно ужесточить условия. Компания утверждает, что продержала релиз две дополнительные недели ради проверки безопасности и hardening. Причина понятна: GLM-5.3, по словам разработчиков, показала 84,5% на CyberGym — бенчмарке для поиска уязвимостей, и это якобы лучший опубликованный результат. Тут, конечно, нужен здоровый скепсис: цифра self-reported, внешнего воспроизведения на момент публикации не было. Z.ai также заявляет, что модель нашла 2436 уязвимостей в 269 open-source-проектах, включая Linux kernel, но публично проверить можно пока лишь небольшую часть этих находок. Для новостной ленты это звучит громко; для инженерной аудитории важнее другое: компания сама признает, что ее сильная модель внезапно стала слишком сильной в кибербезе, и именно это подтолкнуло к более аккуратной схеме релиза.

Технически GLM-5.3 не пытается впечатлить новой архитектурой ради красивого пресс-релиза. Под капотом остается та же mixture-of-experts-схема на 753 млрд параметров, что и у GLM-5.2, с контекстным окном в 1 млн токенов и максимумом вывода в 128 тыс. токенов. Z.ai отдельно подчеркивает, что прирост пришел из посттренинга, а не из перестройки базы. Веса доступны в BF16 и FP8; заявлена совместимость с vLLM, SGLang, KTransformers и библиотекой Transformers от Hugging Face. На бумаге все выглядит удобно, но локальный запуск — удовольствие не для всех. Даже 2-битные кванты, по данным Unsloth, требуют 245 ГБ памяти, то есть это уже территория очень специфических машин. 8-битный вариант просит 810 ГБ. Так что «можно скачать» и «можно реально использовать локально» — все еще две большие разницы.

Есть и еще один важный слой — экономика. The New Stack приводит цены API: $1,40 за миллион входных токенов и $4,40 за миллион выходных для GLM-5.3, а для GLM-5.3-Flash — $0,15 и $0,47 соответственно. Это делает старшую модель заметно дешевле многих прямых конкурентов, а Flash-версию — почти неприлично выгодной по соотношению цены и возможностей. Для российских команд, которые давно привыкли считать не только качество модели, но и стоимость инференса, это, пожалуй, не менее важный сигнал, чем сама история с лицензией. Если модель хороша в коде и агентных сценариях, то вопрос «качать ли веса» быстро превращается в более прагматичный «а не дешевле ли просто потреблять ее как сервис».

Контекст тоже любопытный. Z.ai оставила MIT-лицензию для Flash-версии, то есть полностью от открытого и мягкого режима не отказалась. Но для лучшей модели компания уже выбрала более жесткий формат. На той же неделе рынок обсуждал возможную покупку Hugging Face компанией Nvidia за $12,9 млрд и сделку Stripe по OpenRouter. Если обе истории действительно доведут до конца, получится занятная конструкция: крупнейшие точки доступа к open-weight-моделям контролируют американские компании, а сами модели все чаще приезжают из китайских лабораторий. В такой конфигурации лицензия становится не скучным юридическим хвостом к релизу, а инструментом геоэкономики и переговорной силы.

Для разработчиков вывод довольно трезвый. Веса GLM-5.3 — это полезный ресурс для экспериментов, дообучения и независимого деплоя, если у вас есть железо, задачи и терпимость к быстро меняющимся правилам. Для бизнеса новость важнее в другом месте: эпоха, когда «open weight» автоматически означало беспрепятственное встраивание в крупную инфраструктуру, похоже, заканчивается. Следующий вопрос теперь не только в том, насколько модель сильна на бенчмарках, но и в том, кто именно получает право быть ее дистрибьютором на своих условиях. Подробности первоисточника — в публикации The New Stack.

Поделиться: Telegram X LinkedIn