llm
Андрей Карпаты представил LLM Knowledge Base без RAG — новая эволюция AI
Карпаты анонсировал LLM Knowledge Base, позволяющий управлять данными без сложной архитектуры RAG. Это упрощает доступ к знаниям AI.

Четыре шлюза LLM с семантическим кэшированием на 2026 год
Обзор четырех шлюзов LLM с поддержкой семантического кэширования. Как это сэкономит вам средства и время.

Bifrost и OpenRouter: пять лучших AI-шлюзов для оптимизации LLM
Обзор пяти AI-шлюзов, помогающих сократить затраты и задержки при работе с LLM.

Bifrost: как отслеживать расходы на LLM в реальном времени
Bifrost — решение для контроля затрат на LLM с мгновенными расчетами и 11 мкс задержки.

Google представил TurboQuant — алгоритм, который снижает память LLM в 6 раз
Google анонсировал TurboQuant, алгоритм для сокращения памяти LLM до 6 раз без ущерба для качества.

NVIDIA оптимизировала работу с LLM на Kubernetes — повысила производительность
NVIDIA представила раздельные архитектуры для LLM на Kubernetes, увеличив эффективность использования GPU и снизив затраты.

ExoChat упрощает разработку чатов с помощью парсимонии контекста
ExoChat предлагает новый инструмент для проектирования чат-ботов, оптимизируя затраты и улучшая взаимодействие с пользователями.

Создан клон Perplexity для локальных LLM всего на 50 строках Python
Исследуйте, как создать клон Perplexity на 50 строках кода для локальных LLM без API ключей.
Mistral запустила Forge — платформу для обучения корпоративных языковых моделей
Mistral AI представила Forge — платформу для обучения корпоративных LLM с нуля на данных компании.
ICML отклонил заявки рецензентов, использующих ИИ для рецензий
Конференция ICML отклонила рецензии от экспертов, использующих LLM, несмотря на первоначальные соглашения. Это прецедент в мире AI.