длинный контекст
🔬
Refiant заявила о модели с контекстом в 10 млн токенов
10 млн токенов контекста заявила Refiant для модели Protea. Компания делает ставку на swarm optimization вместо лобовой гонки за всё…
🔮
Стартап Subquadratic замахнулся на жизнь после attention
Окно контекста в 12 млн токенов стало главным аргументом стартапа Subquadratic, который предлагает смотреть дальше sparse attention.

Nvidia объяснила, как ускорить вывод LLM с длинным контекстом
Nvidia представила новые методы для повышения эффективности вывода ИИ-моделей с длинными контекстами, увеличивая производительность на 85%.