OpenAI представила ChatGPT Sketch — новый способ объяснить чат-боту, какую картинку нужно сгенерировать: не только текстом, но и простым рисунком прямо в интерфейсе. Для русскоязычных продуктовых команд, дизайнеров и разработчиков это важный сигнал: генеративные инструменты всё заметнее уходят от промптов как единственного языка общения с моделью.
Функция появилась вместе с обновлением ChatGPT Images 2.5, сообщает The Verge. Пользователь может набрать @Sketch в поле ввода, открыть окно для рисования, набросать объект мышью или пальцем, а затем текстом уточнить, что именно ChatGPT должен сделать с этим эскизом. В примере The Verge журналист Джей Питерс нарисовал грубого кота мышью, после чего ChatGPT превратил набросок в реалистичное изображение.
Идея проста, но практичная: эскиз становится частью промпта. Это снимает типичную проблему генерации изображений, когда словами приходится долго объяснять композицию, форму объекта или расположение деталей. Иногда проще нарисовать кривой прямоугольник, стрелку и пару ушей, чем пять минут подбирать фразу, которую модель всё равно поймёт по-своему.
В ChatGPT Sketch OpenAI также добавила точечные комментарии к уже созданным изображениям. Пользователь может указать на конкретную область картинки и попросить изменить именно её. В тесте The Verge таким образом меняли цвет глаз у сгенерированного кота. Для дизайнеров интерфейсов, маркетологов и контент-команд это полезнее, чем очередная кнопка «сделай лучше»: правка наконец получает координаты, а не живёт в тумане общего текстового запроса.
Параллельно OpenAI заявляет, что ChatGPT Images 2.5 лучше работает с естественным освещением и текстурами, а также стабильнее выполняет инструкции при многошаговом редактировании. Ещё одна конкретная цифра — задержка генерации изображений снижена до 50% по сравнению с предыдущей версией. Для пользовательского опыта это не косметика: если генерация занимает меньше времени, люди чаще пробуют варианты, быстрее отбрасывают неудачные и активнее используют инструмент в рабочих сценариях.
Обновление уже доступно пользователям ChatGPT, ChatGPT Work и Codex на десктопе, в мобильных приложениях и веб-версии. Отдельно интересно появление функции у Codex-пользователей: визуальные наброски могут пригодиться не только иллюстраторам, но и разработчикам, которые собирают прототипы, описывают состояния интерфейса или передают идею компонента без полноценного макета в Figma.
Контекст здесь шире одного кота из демо. Генеративные AI-сервисы постепенно добавляют мультимодальный ввод как норму: текст, изображение, голос, скриншоты, файлы и теперь быстрые эскизы. Для индустрии это означает, что конкуренция смещается от качества одиночной генерации к качеству диалога с моделью. Побеждает не та система, которая один раз красиво нарисовала баннер, а та, с которой можно быстро пройти десять итераций без ощущения, что ты споришь с упрямым стажёром.
Для бизнеса ChatGPT Sketch может сократить путь от идеи до черновика визуала. SMM-команда сможет набросать структуру постера, продакт — показать желаемую компоновку экрана, HR — быстро собрать иллюстрацию для внутренней коммуникации. Это не отменяет дизайнеров и не превращает мышиный рисунок в арт-дирекшн, но убирает часть трения на раннем этапе, где обычно нужны не финальные пиксели, а понятный визуальный черновик.
Для разработчиков и продуктовых команд главный вопрос теперь не в том, умеет ли ChatGPT превращать каракули в симпатичные картинки. Гораздо важнее, насколько точно такие инструменты смогут удерживать контекст между правками: форму, стиль, композицию, ограничения бренда и конкретные элементы интерфейса. Если OpenAI доведёт многошаговое редактирование до предсказуемого уровня, генерация изображений станет не игрушкой для промптов, а обычным рабочим слоем между идеей, прототипом и готовым ассетом.