KodaCode 1.2.0 получил две новые модели, фоновых субагентов и режим планирования в Desktop и CLI. Для разработчиков это не очередная косметика в интерфейсе, а попытка собрать более взрослый рабочий цикл для ИИ-агента: сначала разобраться в проекте, затем разложить задачу на части и пережить сетевые сбои без драматического «начнём сначала».
О релизе сообщает Habr / Новости. В обновление вошли Koda Base на Qwen 3.8 Flash 125B и Koda Pro на GLM 5.3, поддержка до четырёх параллельных субагентов, управление задачами из Telegram и доработки устойчивости после временных ошибок, обрывов соединения и проблем в IDE-плагинах.
Главная ставка релиза — новые собственные модели для разных сценариев. Koda Base остаётся бесплатной с дневными лимитами в основных клиентах KodaCode и рассчитана на более массовые задачи. Koda Pro адресована длинным агентным сессиям: когда нужно удерживать цель, изучать несколько частей репозитория, принимать архитектурные решения и выполнять много последовательных действий. Это важное различие: в реальной разработке слабое место ИИ-агентов часто не в том, что они не могут написать функцию, а в том, что они теряют нить после третьего обходного манёвра.
Koda приводит результаты внутреннего «Индекса Кода» — набора из 261 агентной задачи по разработке в существующих репозиториях, проектированию ПО и анализу данных. Агент в этих тестах должен был работать с файлами, запускать команды, исправлять ошибки и выдавать результат, проходящий автоматическую проверку. По опубликованным данным, Koda Base выросла с 38,5% до 49,5% успешности, почти не увеличив среднее число шагов: 38,5 против 39,7. Koda Pro поднялась с 46,7% до 54,3%, при этом средняя траектория стала короче: 52,1 шага вместо 70,3. Вендорский бенчмарк, конечно, не заменяет независимых сравнений, но направление понятное: меньше блужданий по проекту, больше шансов дойти до проверяемого результата.
Вторая заметная часть KodaCode 1.2.0 — субагенты. Основной агент теперь может запускать фоновые задачи для независимого исследования: один процесс смотрит тесты, другой ищет связанные модули, третий читает документацию, а основной диалог собирает выводы в решение. Одновременно поддерживается до четырёх таких задач. Для каждой можно отдельно задать модель, reasoning effort, лимит времени и доступные инструменты. По умолчанию субагенты работают в режиме чтения, а запись файлов, команды и MCP-инструменты нужно разрешать явно. Это разумная страховка: параллельность полезна ровно до момента, пока несколько автономных помощников не начинают одновременно «улучшать» одну и ту же кодовую базу.
Для команд важна не только сама параллельность, но и роли. В релизе появились проектные и глобальные роли, которые хранятся в Markdown-файлах: можно завести ревьюера, исследователя документации, специалиста по тестам или любую другую прикладную роль с собственными инструкциями, моделью и набором инструментов. В Desktop для субагентов сделали отдельный интерфейс с активными и завершёнными задачами, прогрессом, бюджетами шагов и времени, историей вызовов инструментов и итогом. Завершённого субагента можно продолжить, перезапустить или сжать его контекст. В CLI управление вынесли в команду /subagents и интерактивную панель, а поддержка также появилась в Telegram Remote и ACP-сессиях.
Режим планирования закрывает другой болезненный сценарий: агент слишком рано начинает менять файлы. Теперь в Desktop план выводится в отдельной панели над полем ввода, а пользователь может отредактировать шаги, добавить новые, удалить лишние или поменять порядок до запуска. План можно поставить на паузу, продолжить или закрыть; состояние сохраняется вместе с чатом после перезапуска приложения. В CLI режим включается командой /plan: агент изучает проект в read-only, обновляет план по мере исследования и переходит к реализации только после подтверждения. Для продактов и тимлидов это может быть даже важнее автогенерации кода: план даёт точку контроля до того, как в репозитории появились изменения.
Telegram Remote в этом релизе тоже стал практичнее. В Desktop собственного бота можно привязать по QR-коду, ссылке или одноразовому коду. Из Telegram агент принимает сообщения, изображения и документы; в мессенджере видны статус работы, черновик и финальный ответ. Действия агента можно подтверждать или отклонять кнопками, новые сообщения занятому агенту попадают в очередь, а Telegram-топики связываются с чатами Desktop и задачами планировщика. Для удалённой работы это не магия, а удобная диспетчерская: проверить ход задачи, дать разрешение на действие и не держать IDE открытой перед глазами весь день.
Отдельная, менее эффектная, но полезная часть обновления — устойчивость. Клиенты лучше повторяют попытки после временных ошибок и продолжают работу после обрыва соединения. В IDE-плагинах исправили смешивание аргументов параллельных вызовов инструментов, зависания составных и многострочных терминальных команд, лишнее переключение фокуса и самовольное открытие вкладок при работе агента с файлами. Это как раз те мелочи, из-за которых ИИ-ассистент в демо выглядит бодро, а в рабочем проекте начинает раздражать через полчаса.
KodaCode 1.2.0 хорошо показывает, куда движутся кодовые ИИ-агенты: от «напиши мне функцию» к управляемому процессу с планом, ролями, параллельным исследованием и подтверждением рискованных действий. Следующий вопрос для рынка — смогут ли такие инструменты стать частью нормального инженерного процесса, а не отдельным окном для экспериментов между задачами в трекере.