AI И НЕЙРОСЕТИ

GLM-5.2 вышла в лидеры open-weight AI после блокировки Fable 5

GLM-5.2 за неделю поднялась на вершину открытых AI-рейтингов после отключения Fable 5 и показала, что Huawei-чипов уже хватает для крупных моделей.

✍️ Редакция iTech News | 01.07.2026 | ⏱ 5 мин | Источник: Tom's Hardware
🧠

За неделю после отключения Anthropic Fable 5 модель GLM-5.2 от китайской Z.ai успела занять верхние строчки в рейтингах открытых AI-моделей. Для русскоязычной IT-аудитории здесь важны сразу две вещи: лидер внезапно оказался не у американского API-провайдера, а у open-weight-модели под лицензией MIT, и обучали ее, по заявлению разработчика, без Nvidia — на чипах Huawei Ascend.

Историю подробно разбирает Tom's Hardware: 12 июня Минторг США выпустил экспортную директиву, которая запретила Anthropic поставлять модели Fable 5 и Mythos 5 любым иностранным гражданам. Из-за формулировки запрета компания не смогла оставить сервис хотя бы для части аудитории и отключила модели глобально. Уже на следующий день пекинская Z.ai, ранее известная как Zhipu AI, начала разворачивать модель GLM-5.2 с открытыми весами. Через несколько дней она оказалась на вершине ряда публичных бенчмарков, а пользователи за пределами США получили вполне рабочую альтернативу — не по подписке, а в виде скачиваемых весов и API.

Что именно произошло

Если смотреть на цифры, картина получилась не декоративная, а вполне прикладная. На Design Arena, где оценивают качество кода по человеческим предпочтениям, GLM-5.2 вышла на первое место и опередила Fable примерно на 10 Elo. В индексе Artificial Analysis Intelligence Index v4.1 модель набрала 51 балл и стала лучшей среди открыто доступных решений, обойдя MiniMax-M3, DeepSeek V4 Pro и Gemini 3.1 Pro Preview. На SWE-bench Pro результат составил 62,1 против 58,6 у GPT-5.5. Для разработчиков это не просто красивые строчки в таблице: речь о модели, которая неплохо справляется с инженерными задачами и при этом не завязана на западный SaaS, который могут выключить одним письмом регулятора.

Но история не про безоговорочное первое место во всем подряд. На Code Arena в задачах фронтенд-разработки GLM-5.2 осталась второй, уступив Fable 5. На AA-Briefcase, где проверяют длинные многошаговые задачи с большим числом разрозненных входов, расклад тоже не в ее пользу: до блокировки Fable 5 лидировала с 1587 Elo, далее шла Opus 4.8 с 1356, а GLM-5.2 занимала третью строчку с 1266. На Terminal-Bench 2.1 китайская модель получила 81,0, тогда как Opus 4.8 набрала 85,0, GPT-5.5 — 84,0, а Gemini 3.1 Pro — 74,0. Иными словами, модель GLM-5.2 не стала абсолютным чемпионом по всем дисциплинам. Она стала самым сильным из реально доступных вариантов в момент, когда один из главных конкурентов просто исчез из меню.

Отдельный слой сюжета — железо. Z.ai находится в американском Entity List с января 2025 года, то есть доступа к H100, H200 и B200 у нее быть не должно. Компания утверждает, что семейство GLM-5 обучалось примерно на 100 тысячах процессоров Huawei Ascend 910B с использованием фреймворка MindSpore и без участия Nvidia на всех этапах. Для Вашингтона это плохая новость: экспортные ограничения задумывались как раз затем, чтобы китайские компании не могли собрать модель фронтирного уровня на собственной базе. Не получилось. Получилось дорого, сложно и, вероятно, не так эффективно, как на актуальном стеке Nvidia, но получилось.

Почему это важно не только Китаю

Здесь, впрочем, полезно не путать паритет моделей с паритетом железа. По декабрьской оценке Council on Foreign Relations, Ascend 910C дает около 60% производительности H100 на инференсе, а по эффективности и масштабу кластера отставание заметнее. Тот же источник допускал, что уже в следующем году лучшие американские ускорители могут быть более чем в 17 раз мощнее топовых решений Huawei. То есть GLM-5.2 не доказывает, что Huawei догнала Nvidia. Она доказывает другое: если очень надо, крупную модель можно довести до конкурентного состояния и на домашнем китайском стеке. Для бизнеса и техдиректоров это неприятный, но важный урок о том, что санкции замедляют рынок, а не выключают его.

Есть и чисто продуктовый момент. Формально GLM-5.2 бесплатна: веса открыты по лицензии MIT, их можно скачивать, дообучать и разворачивать у себя. На практике это не тот случай, когда инженер вечером скачал архив и утром поднял все на рабочей станции под столом. У модели около 744 млрд параметров, из которых 40 млрд активны на токен, плюс окно контекста до 1 млн токенов. Такой набор просит либо серьезный GPU-кластер, либо очень дорогую high-memory-конфигурацию, а производительность заметно падает, когда контекст уходит далеко за десятки тысяч токенов. Поэтому для большинства компаний реальный путь — не self-hosting, а API. И вот здесь у Z.ai появляется еще один аргумент: около $1,40 за миллион входных токенов и $4,40 за миллион выходных против $5 и $25 у Claude Opus 4.8 и против $10 и $50 у Fable 5. На задачах AA-Briefcase Fable в среднем стоила $31 на запуск против $2,40 у GLM-5.2. Разрыв примерно в 13 раз выглядит достаточно убедительно даже без идеологических разговоров про open source.

Рынок, как обычно, среагировал без сантиментов. Акции Knowledge Atlas Technology, под которой Z.ai торгуется в Гонконге, 22 июня подскакивали внутри дня на 42%, а капитализация компании превысила HK$1 трлн, то есть около $128 млрд. На таком фоне публичные заявления основателя Тана Цзе о том, что китайская модель класса Fable 5 появится раньше сроков, которые обсуждал Илон Маск, уже звучат не как бравада для инвесторов, а как часть новой гонки поставщиков. Хотя у этой эйфории есть дата проверки на прочность: 8 июля истекает локап у первых cornerstone-инвесторов, и тогда станет понятнее, насколько ралли держится на фундаменте, а насколько — на эффекте редкого окна возможностей после отключения конкурента.

Для разработчиков, продактов и IT-руководителей главный вывод довольно прозаичный. Рынок генеративного ИИ все сильнее зависит не только от качества модели, но и от политической доступности модели, цены токена и возможности развернуть ее вне чужого облака. Модель GLM-5.2 стала важным кейсом именно на этом пересечении: она не лучшая во всем, но оказалась достаточно сильной, достаточно дешевой и, что особенно ценно в 2026 году, достаточно доступной. Вопрос теперь не в том, сможет ли Китай собрать еще одну большую модель без Nvidia. Вопрос в том, сколько таких моделей появится до того, как регуляторы и вендоры снова перепишут правила игры. Источник деталей — Tom's Hardware.

Поделиться: Telegram X LinkedIn