Новая архитектура LCLM обеспечивает 16x сжатие контекста для LLM без потери точности. Как это повлияет на разработки в сфере AI?