llm
Google ускорила AlloyDB: LLM-запросы заменяют локальной моделью
Google заявила до 100 тысяч строк в секунду: в AlloyDB появились proxy-модели, которые переносят часть LLM-логики внутрь базы.
Зелёный дашборд, сломанный RAG: как LLM отравила векторную базу
Задержка ниже 100 мс не спасла: The New Stack описал сбой, при котором автономный LLM-конвейер незаметно отравил векторную базу.
Refiant заявила о модели с контекстом в 10 млн токенов
10 млн токенов контекста заявила Refiant для модели Protea. Компания делает ставку на swarm optimization вместо лобовой гонки за всё…
OpenAI выводит GPT-5.6, но в safety card уже есть тревожный пункт
OpenAI подтвердила публичный запуск GPT-5.6 Sol, Terra и Luna в четверг, но safety card модели уже указывает на проблему с…
Meta заявила, что Watermelon догнала OpenAI. Но без главного
Meta заявила, что модель Watermelon догнала GPT-5.5 OpenAI, но не раскрыла ключевые бенчмарки. Для рынка ИИ это важнее самого заявления.
NVIDIA показала рецепт надежных AI-платформ без магии агентов
53-минутный доклад NVIDIA на QCon San Francisco объяснил, как строить надежные AI-платформы: меньше магии, больше детерминированных инструментов.
Anthropic на пять дней продлила доступ к Fable 5 для подписчиков
Anthropic 7 июля не отключила модель Fable 5 у подписчиков Claude и продлила включённый доступ ещё на пять дней.
Reddit пустил LLM на борьбу со спамом, который они же и разгоняют
Reddit блокирует 23 млн просмотров спама в день и ловит 25 тыс. новых постов и комментариев, используя LLM против AI-спама.
JadePuffer показал, как ИИ уже собирает атаки-вымогатели
6 июля 2026 года описан первый полный ransomware-атакующий сценарий, который LLM провел почти без человека — от взлома до шантажа.
«Пещерные» промпты не спасают: где на самом деле горят токены
Восемь моделей на пяти датасетах показали: сжатие пользовательских промптов не экономит токены, а часто повышает итоговую стоимость работы ИИ.