llm

Стартап Subquadratic решил проблему ИИ — LLM обгоняет конкурентов
Стартап Subquadratic потеснил конкурентов, заявив об улучшении LLM с минимальным энергопотреблением. Узнайте, как это повлияет на рынок.
DeepSeek выпустила DSpark — ускорение LLM до 85%
DeepSeek запускает DSpark — фреймворк для ускорения работы LLM на 85%, доступный для разработчиков и исследователей.

Yobi критически оценил использование LLM для предсказания намерений
Yobi считает, что LLM недостаточны для предсказания намерений пользователей. Это ставит под сомнение их эффективность в рекламных технологиях.

Nvidia улучшила обучение LLM с помощью динамичного параллелизма тензоров
Обновление параллелизма тензоров от Nvidia улучшает Goodput в обучении LLM, поддерживая производительность до 72 GPU.

NVIDIA представила аппаратно-ориентированное проектирование LLM для высокой производительности
NVIDIA представила новое аппаратно-ориентированное проектирование для LLM, повышающее производительность и скорость обработки данных.

Исследование ICML: LLM обходят защиту через подделку рассуждений
Исследование выявило масштабные уязвимости LLM, интересные для разработчиков и исследователей в области безопасности.

Уязвимость в LLM помогает обходить встроенные запреты
Исследование показывает, что уязвимость языковых моделей (LLM) позволяет обойти защиту и извлечь секретную информацию, ставя под угрозу их безопасность.