OpenAI временно отключила лимит GPT-5.6 Sol в пятичасовом окне для платных подписок Plus, Pro и Business и заодно обнулила текущую статистику использования. Для тех, кто уже успел уткнуться в потолок посреди рабочего дня, новость вполне прикладная: можно снова гонять длинные сессии в Codex и ChatGPT Work без паузы по таймеру. По данным Habr / Новости, компания сняла именно краткосрочное ограничение, а недельные лимиты оставила без изменений.
Решение выглядит как экстренная настройка системы после слишком удачного запуска. В OpenAI признали, что новая модель оказалась настолько востребованной, что за 48 часов пользователи массово начали упираться в короткие окна доступа. Основная проблема была не просто в высоком спросе, а в архитектуре лимитов: локальные запросы в Codex и облачные задачи в ChatGPT Work списывались из одного общего пула. На практике это означало довольно раздражающий сценарий: разработчик мог активно использовать один сервис, а второй внезапно оказывался заблокированным, хотя его даже не открывали.
Для аудитории, которая использует ИИ не как игрушку, а как рабочий инструмент, это важная деталь. Пятичасовое окно еще можно пережить в режиме редких запросов, но оно быстро становится проблемой, когда модель встроена в повседневный процесс: генерация кода, разбор ошибок, подготовка рабочих материалов, исследовательские задачи, параллельные сессии в команде. Если лимит GPT-5.6 Sol срабатывает из-за соседнего сервиса в том же аккаунте, пользователи получают не контроль затрат, а довольно странную лотерею. В этом смысле временная отмена окна выглядит не жестом щедрости, а признанием того, что старая схема плохо выдержала реальную нагрузку.
OpenAI одновременно сообщила и о технической оптимизации. По словам компании, GPT-5.6 Sol теперь тратит меньше доступного лимита на сопоставимый объем задач. Продакт-лид OpenAI Тибо Соттье также анонсировал механизм banked reset: пользователи смогут сохранять сброс лимита до 30 дней и активировать его тогда, когда это действительно нужно. Для тех, кто работает неравномерно, а рывками, идея понятная и здравая. Условный спокойный вторник можно пережить и без бонусов, а вот перед релизом, миграцией или разбором инцидента такой запас куда полезнее стандартного расписания.
Почему это важно не только для подписчиков
История с лимитами хорошо показывает, где сейчас находится рынок ИИ-сервисов для профессионалов. Главная конкуренция идет уже не вокруг абстрактного «умнее или не умнее», а вокруг емкости, предсказуемости и стоимости рабочего сценария. Если модель хороша, но регулярно ставит пользователя на паузу, это бьет не по впечатлениям, а по процессам. Разработчику все равно, насколько красиво устроен внутренний scheduler, если он не может добить задачу в окне, когда команда ждет результат. Для продактов и IT-руководителей тут еще более прагматичный вывод: при выборе корпоративного ИИ-инструмента начинают играть роль не только качество ответов, но и то, как устроены лимиты между режимами, продуктами и типами нагрузки.
OpenAI подкрепляет этот тезис цифрами, хотя пока скорее в формате ориентира, чем полноценного публичного бенчмарка. По данным Artificial Analysis, Sol расходует примерно вдвое меньше токенов, чем Claude Fable 5 от Anthropic. Сэм Альтман, как передает источник, оценил рост токен-эффективности в 54% относительно предыдущего поколения. Ожидаемая экономия для пользователя должна составить не менее 10% доступной квоты. Эти цифры еще не отвечают на все вопросы о реальной стоимости владения, но направление понятно: борьба идет за то, чтобы в тот же лимит помещалось больше полезной работы. И это уже похоже на следующую фазу гонки моделей, где маркетинговые сравнения постепенно уступают место арифметике потребления.
Есть и еще один важный штрих. По информации из исходного сообщения, OpenAI отдельно компенсировала сбой, который затронул 50 тысяч пользователей: у них не сработал сброс лимита. Даже если детали компенсации не раскрываются, сам факт публичного признания проблемы показателен. Когда сервисом пользуются в рабочем режиме, сбой в лимитах воспринимается не как мелкое неудобство, а как остановка инструмента. Для B2B-аудитории это, пожалуй, даже важнее красивых заявлений об улучшении модели: если платформа видит, что ограничения сломали сценарий, и быстро исправляет последствия, это повышает доверие сильнее, чем очередной рекламный тезис о производительности.
Контекст у решения вполне рыночный. Habr / Новости пишет, что Anthropic уже второй раз за неделю продлила бесплатный доступ к Claude Fable 5, теперь до 19 июля. На таком фоне шаг OpenAI выглядит как попытка удержать именно профессиональную аудиторию, которая платит не за любопытство, а за возможность использовать ИИ без трения в длинных сессиях. Когда пользователь выбирает между двумя сильными системами, его легко потерять не на уровне качества модели, а на уровне повседневной фрустрации. Если один сервис постоянно говорит «приходите позже», а другой позволяет закрыть задачу здесь и сейчас, исход сравнения обычно решается без лишней философии.
Пока мера объявлена как временная, и OpenAI не уточняет, когда именно вернет пятичасовое окно. Это оставляет открытым главный вопрос: компания действительно перестраивает механику доступа под профессиональное использование или пока просто тушит перегрев после удачного запуска. Для рынка важен именно второй шаг. Если лимит GPT-5.6 Sol и дальше будут подстраивать под реальные рабочие нагрузки, конкуренция между ИИ-платформами начнет все сильнее напоминать борьбу облачных сервисов: побеждает не тот, кто громче обещает, а тот, у кого меньше внезапных стоп-сигналов в середине рабочего процесса.