Google запустил новые модели Gemma 4, которые значительно улучшены по сравнению с Gemma 3 и теперь доступны под лицензией Apache 2.0. Это важно для разработчиков, поскольку предоставляет больше возможностей для интеграции и использования на локальных машинах.
Что такое Gemma 4?
Gemma 4 включает четыре модели, каждая из которых оптимизирована для различного объема задач. В частности, модели 26B Mixture of Experts и 31B Dense предназначены для работы на одном 80 ГБ GPU Nvidia H100. Разработчики могут использовать их с разумной производительностью и значительно меньшей задержкой.
Кроме того, созданы две другие модели — Effective 2B и Effective 4B, специально для мобильных устройств. Эти версия имеют низкое потребление памяти и обеспечивают работу с минимальной задержкой, что позволяет использовать их на смартфонах и устройствах типа Raspberry Pi и Jetson Nano.
Что нового в Gemma 4?
Gemma 4 демонстрирует значительное развитие в области обработки информации. Модели теперь поддерживают высококачественное генерирование кода и обработку визуальных данных, таких как OCR. Google утверждает, что эти модели могут обеспечить «практически нулевую задержку», что делает их особенно ценными для разработчиков, использующих их в локальных условиях.
Кроме того, Gemma 4 имеет укороченные контекстные окна — до 256 тыс. токенов для некоторых моделей. Это важное обновление, позволяющее работать с большими объемами текста, что, в свою очередь, полезно для создания более сложных AI-приложений.
Практическое значение для разработчиков
Для разработчиков в СНГ это означает больше свободы при создании решений на основе AI. Gemma 4 с лицензией Apache 2.0 позволит программистам безопаснее и проще интегрировать AI в собственные проекты, без лишних ограничений. А учитывая мощность моделей и гибкость, они могут значительно улучшить производительность многих приложений.
С этим релизом Google не только делает шаг вперёд в тактическом плане, но и потенциально меняет правила игры для всех, кто работает с AI в локальных условиях.