llm

Netflix открыл код Headroom для сокращения расходов на ИИ
Headroom уже помог сэкономить около $700 тысяч и освободить 200 млрд токенов. Netflix показал, как сжатие токенов режет счета за…
Почему GPT, Claude и Gemini спорят о базовых фактах
67% из 1000 проверок дали расхождение между frontier-моделями: GPT, Claude и Gemini по-разному оценивают базовые факты мира

GitHub сократил расходы на токены ИИ-агентов до 62%
GitHub снизил расходы на токены в agentic CI до 62% за счет аудита, pruning MCP и замены части вызовов на…

Атакующие применили LLM-агент после взлома уязвимого Marimo
Восемь SSH-сессий и полная выгрузка PostgreSQL за две минуты: злоумышленники использовали LLM-агент после эксплуатации CVE-2026-39987 в Marimo.

TechCrunch собрал словарь ИИ: что пора перестать путать
29 мая 2026 года TechCrunch выпустил словарь терминов ИИ: от AGI и LLM до hallucination, чтобы разработчики и бизнес говорили…
The New Stack: ИИ-сервисы пора дебажить через наблюдаемость
28 мая 2026 года The New Stack показал, почему наблюдаемость ИИ стала базовой практикой для отладки LLM-сервисов, агентных пайплайнов и…

LLM игнорируют пометку «ложь» и запоминают фейки как факты
В 88,6% случаев LLM усваивали ложные утверждения даже с явной пометкой об ошибке. Новое исследование бьет по практике обучения моделей.

Исследование: LLM избегают религии и хуже всего относятся к свидетелям Иеговы
27 LLM в тесте на 150 этических вопросов почти не ссылались на религию и стабильно негативно оценивали свидетелей Иеговы.
Борьба за токены: как компании режут расходы на корпоративный ИИ
4,2% AI-leverage hours при 0,7% токенов: новый класс AI FinOps-инструментов обещает остановить tokenmaxxing и вернуть контроль над бюджетами.

Как выжать больше из GPU в частном облаке: опыт SS&C
38-минутный доклад архитектора SS&C показывает, как повышать загрузку GPU в частном облаке без хаоса в очередях, безопасности и batch-пайплайнах.