llm
ИИ сделал людей увереннее и одновременно менее точными
Доступ к советам ИИ снизил точность ответов с 27% до 9%, а уверенность поднял до 76%. Что это значит для…
Бутылочное горлышко ИИ-агентов сместилось в контекстный слой
Два года команды повторяют один и тот же цикл: чинят ИИ-агентов апгрейдом модели, хотя сбоит уже не она, а контекстный…
Kimi K3 вышла в лидеры AI-кодинга и ударила по закрытым моделям
Kimi K3 за несколько часов возглавила Arena по фронтенд-кодингу, обойдя закрытые модели OpenAI и Anthropic и усилив спрос на open-weight…
Open-source AI почти догнал закрытые модели и стал в 10 раз дешевле
Разрыв между open-source AI и закрытыми frontier-моделями сократился до 4 месяцев, а стоимость использования открытых моделей может быть в 10…
DeepSeek готовит раунд на $1,5 млрд и присматривается к IPO
DeepSeek хочет привлечь $1,5 млрд при оценке $71 млрд и готовится к IPO. Китайский ИИ-разработчик ускоряет гонку с американскими lab.
Anthropic: Claude меняет тон и ценности в разных языках
Anthropic нашла четыре оси различий в ответах Claude на разных языках. Для бизнеса и разработки это значит разный тон, глубину…
Яндекс: разработка с ИИ начинается уже не с промпта
Яндекс меняет акцент в работе с LLM: вместо охоты за идеальным промптом разработчикам предлагают проектировать процесс и проверку результата.
Дешевые токены не спасают: считать нужно цену AI-задачи
Sonnet 5 оказался дороже Opus 4.8 на задачу: $2,09 против $1,94. Databricks показала, почему цена токена больше не годится для…
Для AI-агентов главной проблемой стало качество поиска
У AI-агента обычно две задачи: собрать контекст и выполнить действие. Именно качество поиска все чаще решает, будет результат полезным или…
Anthropic заглянула во внутреннее пространство J-space Claude
Anthropic показала внутреннее пространство J-space у Claude: исследование обещает новые способы проверки честности и защиты LLM.