llm

NVIDIA внедрила оптимизаторы Muon для ускорения обучения LLM
NVIDIA добавила оптимизаторы Muon в Megatron, что повысило эффективность обучения LLM на 2-4% по сравнению с AdamW.

Red Hat делится секретами успешной оценки LLM — метрики и примеры
Эксперты Red Hat обсуждают важные метрики для улучшения производительности LLM и их применения в реальных сценариях.

Databricks продолжает судебные разбирательства из-за авторских прав на LLM
Databricks сталкивается с иском от авторов, утверждающих, что их книги были использованы без разрешения при обучении LLM. Потенциальные убытки могут…
LlamaIndex: барьеры для разработчиков LLM исчезают — контекст становится ключом
CEO LlamaIndex Джерри Лю рассказал о новом подходе к разработке LLM-приложений — контексту как главному ресурсу.

Адам Бьен о Quarkus и LLM: как создавать надежные Java-системы
Адам Бьен объясняет, как Quarkus помогает в создании будущих стабильных Java-систем на подкасте InfoQ.

Amazon оптимизировал LLM — до 47% прирост производительности без потерь точности
Amazon открыл новую масштабируемую архитектуру LLM, увеличившую эффективность выполнения задач до 47% без снижения точности.

Разработчики выпустили утилиту ai-cli для интеграции LLM в командную строку
ai-cli — новая консольная утилита для интеграции LLM в командную строку, работает без автоматического выполнения команд.
Исследователи автоматизировали стратегии LLM — снижение использования токенов на 69,5%
Исследователи разработали AutoTTS, снизив использование токенов для LLM на 69,5%. Это важно для оптимизации расходов при развертывании AI-моделей.
Исследователи запустили MeMo — обновление LLM без переобучения на 26%
MeMo позволяет компаниям обновлять LLM без затрат на переобучение, повышая производительность на 26%.
Google демонстрирует подход ‘достоверного неопределённости’ для LLM — точные предположения вместо галлюцинаций
Google представил новый подход к обучению LLM, позволяющий делать обоснованные предположения вместо галлюцинаций.