Китайская компания SenseTime представила свою новую модель SenseNova U1, которая генерирует и интерпретирует изображения значительно быстрее, чем конкуренты из США. Это важный шаг для компании, которая стремится вернуть позиции на рынке AI после потери позиций в последнем году.
Контекст: китайский рынок AI и конкуренты
С 2014 года SenseTime занимает лидирующие позиции в области компьютерного зрения, включая технологии распознавания лиц. Однако с появлением мощных систем на базе обработки естественного языка, таких как ChatGPT, компания начала испытывать трудности и потеряла прибыль в условиях растущей конкуренции от стартапов вроде DeepSeek и MiniMax.
Детали модели SenseNova U1
Модель SenseNova U1 уникальна тем, что обрабатывает изображения напрямую, избегая предварительного перевода их в текст. Это позволяет значительно ускорить процесс и уменьшить затраты на вычислительные ресурсы. Как отметил ДаХуа Лин, сооснователь и главный научный сотрудник SenseTime: "Полный процесс рассуждения модели больше не ограничен текстом; она может вести аргументацию с изображениями".
В день релиза 10 китайских производителей чипов, включая Cambricon и Biren Technology, подтвердили поддержку нового поколения модели U1. Это важно, поскольку ввешенные США ограничения мешают китайским фирмам получать доступ к самым современным чипам для обучения, производимым в основном западными компаниями, такими как Nvidia.
Значение для рынка
Публикация модели U1 в открытом доступе на платформах Hugging Face и GitHub демонстрирует активность китайских компаний в области open source AI. Это позволяет получить обратную связь от исследователей и упростить международное сотрудничество, несмотря на геополитические ограничения. SenseTime стремится вернуть свои утраченные позиции на рынке и конкурировать как с внутренними, так и с международными игроками.»
В следующем шаге компания сосредоточится на улучшении модификаций модели, что сделает ее еще более конкурентоспособной на фоне новых инноваций в области генерации изображений.