OpenAI создала независимую консультативную группу по теме AI в математике после громкого заявления: внутренний ИИ-модель компании якобы решила более 100 открытых математических задач. Для русскоязычной IT-аудитории это важный сигнал: генеративные модели всё активнее заходят в область, где цена ошибки измеряется не багом в проде, а годами научной репутации.
Группа получила название Advisory Group on Mathematics and Artificial Intelligence и будет работать на базе Institute for Advanced Study в Принстоне, сообщает TechCrunch. Формально её задача — дать профессиональным математикам больше влияния на то, как OpenAI оформляет, оценивает и публикует результаты математических исследований, полученных с участием ИИ. По задумке компании, совет должен стать мостом между лабораторией, математическим сообществом и широкой публикой.
Повод для такого моста появился не на пустом месте. Ранее OpenAI резко опубликовала решение одной из задач тысячелетия — проблемы Навье — Стокса. В рамках нового объявления компания также заявила, что та же внутренняя модель решила более 100 других открытых задач из разных областей математики. Это не релиз продукта и не очередная кнопка в ChatGPT, но по масштабу заявления звучит громче большинства коммерческих анонсов: речь идёт о задачах, над которыми люди могли работать годами.
Состав совета тоже выбран не случайно. В него вошли девять известных математиков. Среди первых участников — Камилло Де Леллис из Institute for Advanced Study. Он примечателен ещё и тем, что был единственным членом новой группы, подписавшим открытое письмо 25 лауреатов Филдсовской премии. В том письме математики критиковали гонку AI-лабораторий за громкими решениями известных задач и предупреждали, что такая динамика угрожает их интеллектуальному труду. Переводя с академического на инженерный: исследователи боятся не только ошибок, но и ситуации, когда лаборатории будут выносить результаты в публичное поле быстрее, чем сообщество успеет их проверить.
Но независимость нового совета ограничена. Его участники не будут получать оплату от OpenAI, смогут публично высказывать свои взгляды, давать непрошеные рекомендации и самостоятельно контролировать состав группы. Это плюс: совет не выглядит как внутренний PR-комитет с красивой вывеской. При этом у него нет права тормозить или менять ход математических исследований OpenAI. Компания прямо указала, что группа не будет отвечать за темп внутреннего прогресса в математике.
Institute for Advanced Study отдельно подчеркнул эту границу. Институт заявил, что совет может давать рекомендации, но не имеет полномочий принимать решения за какую-либо AI-компанию. Ответственность за решения остаётся на самой компании. Это важная формулировка: OpenAI получает канал связи с академическим миром, но не передаёт ему управление. В терминах корпоративного governance это advisory board, а не внешний регулятор и не научный комитет с правом вето.
Для разработчиков и R&D-команд история полезна не только как научная драма. Она показывает, какой класс проблем возникает, когда модель начинает претендовать на вклад в области с жёсткими правилами доказательства. В прикладном коде можно прогнать тесты, поднять staging, откатить релиз. В математике результат должен пройти проверку людьми, которые способны увидеть тонкую ошибку в рассуждении на десятой странице доказательства. Если ИИ генерирует сотни потенциальных решений, bottleneck внезапно оказывается не в генерации, а в верификации.
Для бизнеса здесь тоже есть практический урок. Компании, которые внедряют ИИ в юридические, инженерные, медицинские или финансовые процессы, часто говорят о human-in-the-loop. Случай OpenAI показывает, что сама фраза ничего не гарантирует. Важно, какие именно полномочия есть у людей в контуре: они могут остановить процесс или только комментировать его постфактум. В новом совете математиков у OpenAI, судя по описанию, скорее второй вариант.
Тема AI в математике становится проверкой зрелости всей индустрии. Если модели действительно помогают закрывать открытые задачи, наука получит ускоритель, с которым придётся научиться жить. Если часть результатов окажется сырой, плохо проверенной или преждевременно поданной как прорыв, доверие к таким заявлениям быстро сгорит. Следующий конфликт, похоже, будет не о том, может ли ИИ предложить доказательство, а о том, кто имеет право объявить его доказательством.