llm
OpenAI и Broadcom показали Jalapeño — свой первый AI-чип
OpenAI и Broadcom 24 июня 2026 года раскрыли дизайн Jalapeño — первого совместного AI-чипа для LLM-инференса с запуском в ЦОДах…
Исчезновение Fable усилило спрос на open-weight модели
После исчезновения Fable из доступа рынок снова заговорил про open-weight модели: их можно запускать локально и не зависеть от вендора.
In the Weights превратил AI-память о людях в рейтинг тщеславия
Сервис In the Weights считает, насколько ваше имя «зашито» в ИИ-моделях. Почему новый vanity-поиск важен для бренда, найма и видимости…
Subquadratic заявила о прорыве в узком месте LLM
56-кратное ускорение в тесте Appen и окно контекста до 12 млн токенов: Subquadratic заявила, что нашла способ сделать LLM дешевле…
Почему RAG ломается раньше, чем это замечают ваши дашборды
RAG-пайплайн у корпоративного клиента начал путать финансовые числа без единого алерта. Проблема оказалась не в uptime, а в слепой зоне…
Локальный ИИ на мини-ПК начал отъедать рынок облачных API
20–50 млн токенов в день на одном мини-ПК: локальный ИИ становится реальной альтернативой облачным API для задач анализа и контента.
Запрет Fable 5 показал, как быстро open-weight ИИ закрывает дыру
12 июня власти США остановили доступ к Fable 5, но рынок почти сразу переключился на открытые ИИ-модели Qwen, Kimi, GLM…
Лишний AGENTS.md: как инструкции ломают работу ИИ-агентов
91 из 100 файлов AGENTS.md содержат хотя бы один дефект конфигурации, из-за которого ИИ-агенты тратят больше токенов и хуже пишут…
БХВ выпустило курс по LangChain и ИИ-агентам на Python
БХВ представило практический курс по LangChain: книга Владимира Дронова учит собирать ИИ-агентов на Python для Telegram, FastAPI и локальных LLM.
Новый бенчмарк AI-агентов проверяет не чат, а реальную работу
2,6% — средний полный pass rate в Agents’ Last Exam, бенчмарке AI-агентов на 1000+ рабочих задач. Почему рынок уходит от…