AI И НЕЙРОСЕТИ

Microsoft вывела в превью свои ИИ-модели и снизила затраты до 89%

Microsoft представила новые AI-модели, которые позволяют сократить затраты на вычисления до 89% по сравнению с решениями OpenAI.

✍️ Редакция iTech News | 02.10.2025 | ⏱ 3 мин | Источник: VentureBeat

Microsoft открыла публичное превью двух собственных моделей: графической MAI-Image-2.5-Pro и голосовой MAI-Voice-2-Flash. Для компании это не просто пополнение каталога: в рабочих сценариях внутри Bing, PowerPoint, OneDrive и Dynamics 365 новые модели уже снижают затраты на GPU до 84-89% и уменьшают зависимость от внешних поставщиков вроде OpenAI.

Microsoft ускоряет переход на собственный стек ИИ

Microsoft AI пишет, что занялась такими моделями около года назад: цель была простой и вполне приземлённой — обучать модели на отслеживаемых корпоративных данных и точнее подгонять их под свои продукты. Речь не о лабораторной демонстрации, а о моделях, которые уже работают в продакшене на миллионах запросов.

Это укладывается в более широкую стратегию Microsoft: не отказываться от партнёрства с OpenAI, а снижать цену каждого полезного ответа, изображения или голосового действия внутри собственных сервисов. Для крупной платформы разница в несколько десятков процентов быстро превращается в очень заметную строку в бюджете.

Цены, скорость и реальные цифры внедрения

MAI-Image-2.5-Pro Microsoft называет своей самой качественной моделью для генерации и редактирования изображений. Она доступна в публичном превью по цене $5 за 1 млн входных текстовых токенов, $8 за 1 млн входных визуальных токенов и $106 за 1 млн выходных визуальных токенов.

MAI-Voice-2-Flash тоже вышла в публичное превью. По данным Microsoft, она работает в 2 раза быстрее базовой MAI-Voice-2 и стоит на 32% дешевле: $15 за 1 млн символов. Модель рассчитана на сценарии, где важны низкая задержка и большой объём голосовых взаимодействий, например для контакт-центров.

Самое интересное — не прайс, а внедрение в собственные продукты. В PowerPoint модель MAI-Image-2.5 снизила затраты на GPU до 84% по сравнению с GPT-Image-2. В OneDrive она стала моделью по умолчанию для части сценариев редактирования изображений, после чего показатель успешных сохранений вырос на 26%, а задержка P95 сократилась примерно на 25%. В Dynamics 365 Contact Center модель MAI-Voice-2-Flash снизила затраты на GPU до 89%.

Где Microsoft уже обходит роль витрины для чужих моделей

Microsoft отдельно подчёркивает, что Bing Image Creator теперь по умолчанию работает полностью на внутренней модели MAI-Image-2.5. Это важный сигнал: компания постепенно перестаёт быть просто витриной для чужих моделей и всё активнее закрывает ключевые сценарии собственными решениями.

На рынке это выглядит логично. OpenAI, Google и Anthropic продают универсальные модели, а Microsoft делает ставку на прикладные, более узкие версии под конкретные продукты. Проще говоря: не самый громкий бенчмарк, а лучший счёт за инфраструктуру в конце месяца.

Значение для рынка

Для русскоязычной ИТ-аудитории здесь главный вывод не в названиях моделей, а в подходе. Крупные вендоры всё активнее считают не только качество генерации, но и стоимость результата в продакшене. Для корпораций это аргумент в пользу специализированных моделей под конкретные процессы, для стартапов и интеграторов — напоминание, что универсальная модель не всегда экономически оправдана. Если у Microsoft цифры 84-89% подтверждаются на масштабе, рынок корпоративного ИИ станет ещё более прагматичным и менее лояльным к дорогим универсальным API.

Следующий логичный шаг — расширение таких моделей на Copilot, Outlook и другие сервисы Microsoft, где экономия на каждом запросе быстро превращается в преимущество для всей платформы.

Источник: Microsoft AI, Microsoft Foundry Blog.

Поделиться: Telegram X LinkedIn