Claude Opus 5.5 вышел с ценой $4 за миллион входных токенов и $20 за миллион выходных — на 20% дешевле предыдущего Opus. Для русскоязычных команд, которые уже считают стоимость агентных пайплайнов не в демо, а в продакшене, это хорошая новость с неприятной припиской: часть запросов может автоматически уходить на более старую модель.
Anthropic выпустила новую версию во вторник, сообщает The New Stack. По сравнению с Claude Opus 5 тариф снизился с $5 до $4 за миллион входных токенов и с $25 до $20 за миллион выходных. Для кэшированных сценариев экономия заметнее: чтение из кэша теперь стоит $0,20 за миллион токенов против $0,50 раньше. На бумаге это выглядит как обычное снижение прайса. На практике это удар именно по тем продуктам, где LLM не отвечает на один вопрос, а долго таскает контекст между шагами: кодовые агенты, ассистенты поддержки, внутренние аналитические инструменты, автогенерация тестов и документации.
Главный технический нюанс — маршрутизация. Если система безопасности Anthropic классифицирует запрос как чувствительный, в частности связанный с кибербезопасностью, вызов может быть обслужен не Claude Opus 5.5, а более старой моделью Opus 4.8. Для пользователя это не обязательно будет выглядеть как ошибка. Запрос прошёл, ответ пришёл, счёт выставлен. Но для команды, которая измеряет качество агента, сравнивает модели или обещает клиенту конкретный backend, такая «тихая» подмена превращается в источник странных расхождений.
Это особенно важно для AI-агентов. В классическом чат-боте можно пережить небольшую вариативность: пользователь спросил, модель ответила, человек сам оценил. Агентная система устроена иначе. Она вызывает инструменты, читает репозиторий, пишет патч, запускает тесты, снова зовёт модель, иногда делает это десятки раз. Если часть таких шагов уходит на другую модель, трассировка должна это показывать. Иначе разработчики будут дебажить не поведение Opus 5.5, а смесь моделей, спрятанную под одной бизнес-логикой.
Снижение цены Anthropic хорошо ложится в более широкий тренд: поставщики frontier-моделей всё чаще конкурируют не только качеством ответов, но и стоимостью выполненной задачи. Для бизнеса цена за токен давно перестала быть единственной метрикой. Важнее, сколько стоит закрытый тикет, принятый pull request, найденная причина инцидента или корректно собранный отчёт. Модель может быть дешевле за миллион токенов, но дороже в работе, если делает больше попыток, чаще вызывает инструменты или генерирует лишний вывод. Anthropic, судя по позиционированию релиза, хочет показать обратное: новая версия должна быть дешевле не только в прайсе, но и в типовых рабочих цепочках.
Для разработчиков вывод довольно приземлённый. При миграции на Claude Opus 5.5 мало заменить идентификатор модели и радостно обновить таблицу расходов. Нужно проверить логи вызовов, фактический model id в ответах, поведение на задачах с безопасностью, стоимость кэширования и число токенов на успешный результат. Особенно это касается команд, которые строят инструменты для DevSecOps, анализа уязвимостей, внутреннего аудита кода и автоматизированной поддержки разработчиков. Там один и тот же промпт может быть обычной инженерной задачей или попадать в зону дополнительных ограничений.
Для IT-директоров и продактов новость звучит почти приятно: верхний сегмент моделей дешевеет, а значит, часть сценариев, которые вчера казались дорогой игрушкой, можно снова положить на стол. Но закупать «самую умную модель» вслепую становится всё менее разумно. Нужны собственные тестовые наборы, контроль маршрутизации, измерение стоимости успешного действия и честный ответ на вопрос, где Opus действительно нужен, а где хватит модели классом ниже. Счёт за токены — это уже не бухгалтерская строка, а архитектурное решение.
Релиз Claude Opus 5.5 показывает, что рынок LLM входит в более взрослую фазу: модели становятся дешевле, но их поведение — сложнее. Следующий спор будет не о том, кто написал самый красивый benchmark, а о том, кто способен доказать, какая модель фактически выполнила задачу, сколько это стоило и можно ли повторить результат завтра.