AI И НЕЙРОСЕТИ

Исследование: LLM избегают религии и хуже всего относятся к свидетелям Иеговы

27 LLM в тесте на 150 этических вопросов почти не ссылались на религию и стабильно негативно оценивали свидетелей Иеговы.

✍️ Редакция iTech News | 28.05.2026 | ⏱ 4 мин | Источник: The Register
Исследование: LLM избегают религии и хуже всего относятся к свидетелям Иеговы

Исследователи прогнали 27 больших языковых моделей через набор из 150 этически и лично значимых вопросов и получили неудобный результат: религиозные предубеждения ИИ работают не так, как ждут религиозные институты. Модели почти всегда отвечают в светско-рациональной рамке, а единственная конфессия, к которой все без исключения отнеслись негативно, — свидетели Иеговы. Для русскоязычной IT-аудитории это не спор о богословии, а напоминание: даже «нейтральный» чат-бот всегда несет скрытый набор ценностей.

Об этом сообщает The Register со ссылкой на исследование консорциума CEFE-AI, куда входят Brigham Young University, Baylor University, University of Notre Dame и Yeshiva University. Авторы попытались измерить, насколько LLM учитывают религиозную перспективу в ответах на вопросы о grief, любви, измене, смысле жизни, честности и моральном выборе. Их вывод: у моделей есть omissive bias, то есть склонность обходить религиозную оптику даже там, где часть пользователей могла бы ее ожидать.

Цифры у исследования довольно приземленные и потому показательные. Самая «религиозная» модель в таблице CEFE-AI — Grok 4.20 — все равно давала религиозно окрашенные ответы менее чем в 30 процентах случаев. Если смотреть строже, на «содержательные упоминания» религии, то их оказалось всего 2 процента в ответах на этические вопросы. Иными словами, если пользователь не просит прямо о христианском, мусульманском или буддийском взгляде, LLM почти всегда уходят в психологию, гуманизм, научный консенсус и общие практические советы. Для большинства продуктовых команд это звучит не как баг, а как ожидаемое поведение безопасного массового ассистента.

Примеры из статьи хорошо показывают, из-за чего вообще возник спор. На вопрос о том, как жить с ошибками, сделанными за последний год, модели советовали принять ответственность, восстановить отношения и не проваливаться в тревогу, стыд и чувство вины. Исследователи же упрекнули LLM в том, что те не подключают религиозные ресурсы вроде исповеди, покаяния, отпущения и прощения. Аналогично с вопросом о возрасте Вселенной: модели отвечали научно, не пытаясь добавить к космологии религиозные нарративы о сотворении мира. Для авторов работы это упущение, для многих инженеров — нормальная настройка системы, которая не должна начинать проповедь без явного запроса.

Самый спорный фрагмент — не сама диагностика, а карта симпатий и антипатий моделей. CEFE-AI отдельно оценивал так называемый conversion bias, то есть склонность подталкивать пользователя к той или иной вере. Почти у всех моделей нашелся положительный уклон в сторону католицизма. Grok, если верить пересказу The Register, сильнее других благоволил католицизму и протестантизму, а к большинству остальных религий был заметно холоднее. Но по-настоящему выделились именно свидетели Иеговы: ни одна из 27 моделей не показала по отношению к этой конфессии положительного уклона, а наиболее мягкой оказалась Mistral Small 3.2, у которой все равно зафиксировали отрицательный показатель.

Здесь важно не потерять контекст. Консорциум, который проводил исследование, сам не выглядит нейтральной выборкой мировых религиозных традиций. Все четыре участвующих в нем вуза представляют западный монотеистический контур: мормонский, баптистский, католический и еврейский академический мир. The Register отдельно подчеркивает этот перекос. Поэтому материал интересен не только тем, что он нашел религиозные предубеждения ИИ, но и тем, кто именно и из какой ценностной точки их измерял. Когда одна сторона считает проблемой отсутствие религиозной рамки по умолчанию, а другая — как раз ее нежелательным навязыванием, спор быстро выходит из области ML-оценки и упирается в продуктовую философию.

Для разработчиков и компаний здесь несколько практических выводов. Во-первых, системные инструкции, датасеты для alignment и правила safety неизбежно формируют не только тон ответа, но и мировоззренческий слой продукта. Во-вторых, универсальный ассистент для массового рынка почти наверняка будет смещен в сторону секулярного языка, потому что это наименее конфликтный дефолт для широкой аудитории. В-третьих, если продукт работает в чувствительных сценариях — mental health, образование, HR, поддержка семейных сервисов, религиозные и локальные community-платформы, — одной абстрактной «нейтральности» уже мало. Нужны явные настройки контекста: спрашивать у пользователя, хочет ли он светский, религиозный или смешанный тип ответа, логировать такие предпочтения и отдельно валидировать, не превращается ли персонализация в скрытую агитацию.

Отдельный урок — про бенчмарки. Пока рынок меряет LLM в основном по accuracy, latency, цене токена и устойчивости к jailbreak, вопросы ценностного перекоса выглядят второстепенными. Но чем глубже AI заходит в консультационные сценарии, тем чаще споры будут идти не о том, «правильно» ли модель ответила, а о том, из какой картины мира она отвечала. И в этом смысле религиозные предубеждения ИИ — не экзотика для академических семинаров, а ранний сигнал для продуктовых команд, которые привыкли считать мировоззренческий слой чем-то внешним по отношению к модели.

Следующий раунд дискуссии, похоже, будет уже не про то, должны ли LLM чаще вспоминать религию, а про то, кто вообще получает право вшивать в массовые модели «правильную» моральную рамку по умолчанию. Исходная публикация The Register со ссылкой на исследование — здесь: The Register.

Поделиться: Telegram X LinkedIn