Cerebras добилась значительного прорыва, разогнав модель Google Gemma 4 до скорости 1500 токенов в секунду. Это новшество не только значительно увеличивает производительность, но и вводит поддержку мультимодальных данных, позволяя модели обрабатывать как текст, так и изображения.
Развитие технологии
Скорость обработки токенов Gemma 4 более чем в 15 раз превосходит её ближайшего конкурента, Claude Haiku, который способен выдавать около 100 токенов в секунду. При этом качество остаётся на уровне: по индексу Artificial Analysis Intelligence Index Gemma 4 продемонстрировала 29 баллов, а Claude Haiku — 30. Это говорит о том, что пользователи смогут быстрее получать результаты, что важно для бизнеса, где время на принятие решений имеет критическое значение.
Новые возможности для пользователей
Среди примеров использования новой модели Cerebras — автоматический анализ плотных дашбордов или документов, позволяющий быстро выделять ключевые моменты и предоставлять структурированные ответы. Это улучшает качество взаимодействия с данными, когда пользователи могут оперативно реагировать на выводимую информацию.
Кроме того, модель может обрабатывать изображения: например, анализировать скриншоты и предоставлять исправления для интерфейсов, что открывает новые горизонты для разработчиков. Все эти функции могут сократить время разработки и внедрения новых решений до минимума.
Влияние на рынок
Для разработчиков на российском и СНГ-рынке это означает, что необходимо следить за переходами на новые архитектуры. Здесь Cerebras позиционирует себя как альтернативу существующим решениям, таким как Llama или GPT-OSS, что может привести к росту конкуренции на рынке AI-платформ. Важно адаптироваться и выбирать инструменты, которые будут давать конкурентные преимущества.
Следующий шаг для Cerebras — открытие общего доступа к новой модели Gemma 4, что может произойти до конца месяца. Это обещает привести к еще большему распространению мультимодальных ИИ-решений в бизнесе.