Anthropic запустила новую функциональность /goals для своего решения Claude Code, что позволяет программным агентам более эффективно выполнять задачи, разделяя процесс выполнения и их оценку. Это изменение позволит избежать ошибок, связанных с преждевременным завершением работы алгоритмов.
Современные проблемы в работе AI-агентов
Несколько крупных компаний сталкиваются с проблемами, когда их AI-агенты завершают работу, не проверив все исходные данные. Например, в последние месяцы принятые решения о завершении задач часто не соответствуют фактическому статусу выполнения, что приводит к недоработкам и убыткам в несколько дней. Танец на грани фола — это распространенный случай в практике AI, когда модели работают хорошо, но механизм принятия решения о завершении их работы требует доработки.
Как работает /goals
Функционал /goals добавляет слой проверки в цикл работы агентов. После определения цели агент Claude Code будет последовательно выполнять шаги, и в конце каждого из них выполняется оценка с помощью отдельной модели. Например, если цель означает, что все тесты должны пройти успешно, то будет выполняться постоянная проверка, чтобы убедиться, что эти условия достигнуты. Если условия не удовлетворены, агент продолжает работать, что уменьшает риск преждевременного завершения.
По данным Anthropic, данная модель значительно упрощает взаимодействие разработчиков, так как нет необходимости в настройке сторонних систем для оценивания результатов. Интересно, что по аналогии с другими платформами — LangChain и Google ADK — многие также используют независимые системы оценки, однако их реализация требует дополнительных действий со стороны разработчиков.
Что это значит для бизнеса
Для российских разработчиков и компаний такое решение может стать настоящим прорывом. Возможность внедрения независимой оценки увеличивает производительность и снижает затраты на мониторинг и диагностику. Важно, что теперь пользователям не придется тратить лишние ресурсы на внешние инструменты для контроля качества. На фоне растущей зависимости от AI в процессах программирования, похожие изменения могут стать нормой и в других продуктах.
Следующий шаг для Anthropic — расширение функционала и изучение возможности интеграции с другими системами, что поможет завоевать еще большую долю на рынке AI-агентов.