61% против 59% в тесте точности флагманских моделей и 37% против 85% по уровню галлюцинаций у средних моделей: сравнение Claude vs ChatGPT вышло за пределы вкусовщины. Как пишет Engadget, при похожем наборе функций Anthropic и OpenAI расходятся там, где для команд важны не демо-эффекты, а цена ошибки. Для русскоязычных разработчиков, продактов и ИТ-руководителей это уже не спор о любимом чат-боте, а выбор между разным уровнем риска, удобства и контроля.
Повод для разговора понятен. ChatGPT, запущенный 30 ноября 2022 года, для многих стал первой массовой встречей с LLM, а Claude вышел в марте 2023-го и быстро занял позицию альтернативы для тех, кому нужен не только разговорный интерфейс. На бытовом уровне различия действительно размыты: обе системы умеют писать код, резюмировать документы, отвечать на короткие вопросы, разбирать файлы и собирать черновики текстов. Но как только модель становится частью рабочего контура, где ответ влияет на релиз, документ или решение по продукту, приходится смотреть не на магию промпта, а на то, как именно инструмент ошибается. Именно поэтому спор о моделях все чаще уходит из плоскости личных предпочтений в плоскость закупки, регламентов и внутренних политик использования ИИ.
Здесь у сравнения Claude vs ChatGPT появляются числа, а не эмоции. В материале приводится бенчмарк AA-Omniscience Accuracy: у флагманов Claude Fable 5 (Max) набирает 61%, GPT 5.6 Sol (Max) — 59%. Разница почти статистическая и в обычном диалоге ее можно не заметить. Зато у более доступных моделей картина меняется: ChatGPT 5.6 Terra (Max) получает 46%, а Claude Sonnet 5 (Max) — 38%. Если смотреть только на точность, mid-tier у OpenAI выглядит сильнее. Но отдельный тест на галлюцинации ломает красивую картину: чем ниже показатель, тем лучше, и здесь Claude впереди с заметным запасом — 55% против 89% у флагманов и 37% против 85% у средних моделей. Для бизнеса это важнее сухой «умности»: неверный, но уверенный ответ обычно дороже, чем осторожный отказ.
Не менее важен сценарий использования. По данным Anthropic Economic Index за март 2026 года, 42% диалогов в Claude связаны с личными задачами, 45% — с работой, остальное приходится на учебу. У OpenAI, по собственному отчету компании, около 70% использования ChatGPT остается вне рабочих сценариев. Отсюда и разный продуктовый акцент. Claude Cowork, представленный в январе 2026-го, заточен под «знаниевую» работу вроде навигации по файлам и организации материалов, а его skills можно вызывать прямо в ходе диалога через косую черту и использовать не только в чате, но и в Claude Cowork и Claude Code. Плюс есть Artifacts: они сразу рендерят куски кода, одностраничные HTML-сайты, React-компоненты и диаграммы, причем результат можно публиковать и шарить как отдельный объект.
У OpenAI похожие идеи тоже есть, но реализация более фрагментированная. Skills в экосистеме ChatGPT работают для индивидуальных пользователей в Codex и через API, а не в обычных чатах, что для части команд сразу поднимает порог внедрения. Аналог Artifacts — Sites — ориентирован прежде всего на внутренние корпоративные сценарии и тоже живет внутри Codex. Важная деталь для разработчиков: Sites не подтягивает живые данные, тогда как Claude Artifacts умеют работать с подключенными приложениями и MCP-коннекторами. Если команде нужен LLM не только для ответов, но и как прослойка между документацией, кодом, интерфейсами и рабочими сервисами, эта разница быстро перестает быть косметикой и начинает влиять на архитектуру процессов.
При этом у ChatGPT остаются зоны, где Claude пока догоняет. Самая заметная — голос. В статье отмечается, что ChatGPT звучит естественнее, легче переживает перебивания и не теряет нить разговора, если пользователь говорит поверх модели. Для оперативной помощи есть и live video в Advanced voice mode: можно буквально направить камеру на проблему и разбирать ее в реальном времени, что удобно для онбординга, техподдержки и удаленной диагностики. Плюс генерация изображений: ChatGPT умеет создавать фотореалистичные картинки, тогда как Claude ограничивается диаграммами, графиками и интерактивной визуализацией на HTML и SVG. Для саппорта, демо, обучения и полевых сценариев этот перевес у OpenAI пока выглядит вполне практическим, а не маркетинговым.
Пожалуй, самый неприятный вывод касается не самих моделей, а общего пользовательского опыта. Новые версии ChatGPT в ряде тестов сильнее предыдущих, но часть пользователей ощущает сервис менее комфортным, и у этого есть причины. В том же тесте на галлюцинации GPT-4o получает 38%, а GPT 5.6 Sol — уже 89%. К этому добавились более заметные защитные настройки и реклама в бесплатном тарифе и плане ChatGPT Go, тогда как Anthropic, наоборот, расширила бесплатный Claude без рекламы. На этом фоне в последние месяцы выросли и загрузки Claude: автор связывает это в том числе с февральским спором вокруг американских госконтрактов на ИИ, после которого Anthropic часть аудитории увидела как более осторожного поставщика. По цене же сервисы идут почти вровень: у Claude есть уровни за $20, $100 и $200 в месяц, причем Pro при годовой оплате стоит $17 в пересчете на месяц, а старшие Max-тарифы дают лимиты в 5x и 20x относительно Pro. У ChatGPT есть планы за $8, $20, $100 и $200, а Codex формально доступен бесплатно, но с настолько низкими лимитами, что это скорее пробник, чем рабочий режим.
Следующий раунд конкуренции пройдет не в таблицах с бенчмарками, а в том, какой из ассистентов компания готова пустить в рабочий контур без постоянной ручной валидации. Для одних решающими останутся голос, видео и генерация изображений, для других — дисциплина ответа и более рабочая упаковка вокруг модели. Исходный разбор метрик, функций и тарифов собрал .