Mistral AI представила Forge — новую платформу, предназначенную для полного цикла обучения корпоративных языковых моделей (LLM). Forge позволяет обучать модели с нуля на данных компании, используя внутреннюю инфраструктуру клиента, что исключает необходимость в RAG и дообучении готовых моделей. Это означает, что компании смогут разрабатывать кастомизированные решения без зависимости от сторонних API.
В качестве основы для обучения можно использовать открытые модели Mistral, лицензированные под Apache 2.0. Бизнес-модель платформы включает лицензию на использование Forge, опциональные конвейеры данных и услуги встроенных AI-ученых, работающих непосредственно с клиентами. Клиентами платформы стали такие компании, как Ericsson, хедж-фонды, общественные институты, ASML, ESA и DSO Singapore.
Кроме того, Forge поддерживает архитектуры dense и mixture-of-experts, а также мультимодальность, что расширяет возможности применения платформы. Она будет конкурировать с решениями от Amazon Bedrock, Azure AI Foundry и Google Vertex AI, однако Forge разработана для работы on-premises, что является значительным преимуществом для клиентов, стремящихся к повышенной безопасности данных.
На этой неделе Mistral также анонсировала Mistral Small 4 с 119 миллиардами параметров и 6 миллиардами активных, Leanstral — код-агент, а также вступление в Nvidia Nemotron Coalition.