Z.ai выпустила GLM 5.3 Flash — первую мультимодальную модель в серии GLM-5, доступную с открытыми весами на платформе Hugging Face под лицензией MIT. Эта модель уже доступна для пользователей KodaCode, что позволяет более широкому кругу разработчиков испытать новые возможности искусственного интеллекта.
Особенности GLM 5.3 Flash
GLM 5.3 Flash включает в себя 320 миллиардов параметров и использует архитектуру «смесь экспертов». При обработке каждого токена активируются только 18 миллиардов параметров, что значительно снижает вычислительные затраты. Для обучения модели использовали 30 триллионов текстовых и мультимодальных токенов, что обеспечивает её высокую эффективность в различных задачах.
На платформе OpenRouter модель тестировалась под названием Ox Alpha и быстро возглавила рейтинг по использованию. Исходя из результатов бенчмарков, GLM 5.3 Flash достигла показателей — Terminal-Bench 2.1 на уровне 84.3 и DeepSWE 63.4, что подчеркивает её конкурентоспособность по сравнению с предыдущими версиями и аналогами, такими как Claude Opus 4.8.
Эффективность и доступность
Стоимость использования GLM 5.3 Flash через API в десять раз ниже, чем у предшественника GLM 5.2. Это делает её более доступной для стартапов и разработчиков, работающих с ограниченным бюджетом. На сегодняшний день модель добавлена в ассортимент KodaCode, что позволит её интеграцию в инструменты, такие как VS Code, JetBrains IDE и другие.
Значение для разработчиков
Для российской аудитории GLM 5.3 Flash представляет интерес, так как она обеспечивает доступ к передовым технологиям ИИ без значительных финансовых затрат. Это открывает новые горизонты для разработчиков и стартапов, позволяя создавать более сложные и функциональные приложения на базе мультимодального ИИ.
Для локального развёртывания GLM 5.3 Flash уже поддерживает SGLang, vLLM и TokenSpeed; поддержку других фреймворков Z.ai обещает добавить позже.