Claude Sonnet 5 выходит с ценой от $2 за миллион входных токенов и претендует на роль более доступной рабочей модели для ИИ-агентов. Для разработчиков и продуктовых команд это важный сигнал: гонка в генеративном ИИ смещается от вопроса «кто умнее» к вопросу «кто доведёт задачу до конца дешевле, стабильнее и с меньшим числом ручных проверок».
Anthropic запустила Claude Sonnet 5 как новую версию своей среднеразмерной модели, сообщает TechCrunch. С 30 июня модель стала доступна всем подпискам, а для бесплатного и Pro-планов назначена моделью по умолчанию. До 31 августа компания берёт $2 за миллион входных токенов и $10 за миллион выходных, после чего цена вырастет до $3 и $15 соответственно. На уровне позиционирования это не просто очередной апдейт Sonnet-линейки, а попытка занять самый прагматичный сегмент рынка: тех, кому нужен не флагман ради флагмана, а модель, способная планировать, пользоваться браузером и терминалом, работать с инструментами и закрывать многошаговые сценарии без счёта на тысячи долларов в месяц.
Anthropic прямо продаёт новинку через тезис «почти Opus, но заметно дешевле». По данным компании, Claude Sonnet 5 приблизилась по качеству к Opus 4.8, хотя именно Opus остаётся ставкой на максимальную точность в сложных задачах, где важны тонкие суждения и глубокое исследование. На бенчмарке агентного программирования Sonnet 5 набирает 63,2% против 69,2% у Opus 4.8 и 58,1% у Sonnet 4.6, выпущенной в феврале. В задачах knowledge work новая модель, по словам Anthropic, даже слегка обгоняет Opus 4.8. Для рынка это довольно неприятная новость для всех, кто ещё надеялся продавать агентные функции как премиальную экзотику. Похоже, что теперь «умеет работать автономно» станет базовой галочкой даже в среднем ценовом сегменте.
Контекст здесь важнее самого релиза. За последние месяцы почти все крупные игроки начали описывать свои модели уже не как чат-ботов, а как рабочих исполнителей. TechCrunch напоминает, что OpenAI неделей ранее показала в preview GPT-5.6 Sol, делая акцент на более автономной работе и разделении задач между субагентами. Google ещё в мае выводила Gemini 3.5 Flash как переход от диалоговой модели к инструменту, который планирует, собирает и дорабатывает реальную работу с минимальным участием человека. На этом фоне запуск Claude Sonnet 5 выглядит не прорывом в вакууме, а подтверждением новой нормы: агентность стала обязательной функцией, а конкуренция уходит в экономику и надёжность.
Именно экономика в этом релизе выглядит самой практичной частью. Anthropic отдельно подчёркивает, что Sonnet 5 дешевле Opus 4.8, а также дешевле OpenAI GPT-5.5 и Google Gemini 3.1 Pro. При этом TechCrunch уточняет: модель всё ещё дороже Gemini 3.5 Flash. Для бизнеса разница важна не только на бумаге. Если компания строит автоматизацию поддержки, CRM-операций, внутреннего ресерча, подготовки кода или рутинных действий в SaaS-сервисах, то счёт идёт уже не в «сколько стоит один хороший ответ», а в «сколько стоит тысяча завершённых действий без эскалации к человеку». В такой логике даже умеренное снижение цены при сохранении качества даёт более заметный эффект, чем редкие победы флагманов в самых сложных тестах.
Anthropic подкрепляет это не только бенчмарками, но и отзывами ранних тестировщиков. В материале приводится пример Zapier: старший инженер Дэниел Шепард говорит, что компании дали модели составную задачу из двух частей — обновить уровни аккаунтов в Salesforce и разослать анонс запуска по списку корпоративных контактов, и Claude Sonnet 5 довела процесс до конца. По его словам, раньше такие сценарии нередко застревали на середине. Ещё один отзыв пришёл от Lovable: сооснователь Фабиан Хедин отметил, что модель стабильно и чисто отказывает в небезопасных запросах. Для обычного пользователя это звучит как ещё один рекламный абзац, но для тех, кто реально пытается внедрять агентов в рабочие процессы, тут как раз зарыта суть. Самая дорогая часть таких систем часто не токены, а человеческий контроль после того, как модель на четвёртом шаге «почти справилась», но потом решила остановиться, свернуть не туда или уверенно придумать несуществующий результат.
На безопасности Anthropic тоже делает заметный акцент. По её данным, Claude Sonnet 5 реже демонстрирует нежелательное поведение, чем Sonnet 4.6: лучше отказывается от вредоносных запросов, устойчивее к попыткам hijack через prompt injection, реже галлюцинирует и меньше скатывается в угодливые ответы. Это особенно чувствительно именно для агентного режима, где модель не просто выдаёт текст, а получает право что-то делать: открыть браузер, вызвать инструмент, изменить данные, пройти по цепочке действий. При этом компания не пытается продать абсолютную безопасность. В материале прямо сказано, что по misaligned behavior модель всё ещё уступает Opus 4.8 и Claude Mythos Preview. Более того, оценки показывают, что Sonnet 5 обладает заметно меньшей способностью выполнять опасные задачи в кибербезопасности, чем текущие модели Opus. Для корпоративных клиентов это, скорее, плюс: не всякое ограничение выглядит недостатком, если речь идёт о модели, которую хотят допустить к реальным операциям.
Для русскоязычной IT-аудитории смысл релиза довольно приземлённый. Если вы разработчик, который строит агентные сценарии поверх LLM, то Claude Sonnet 5 выглядит как кандидат на основной рабочий слой там, где раньше приходилось выбирать между дорогим флагманом и заметно более слабой моделью. Если вы продакт или IT-директор, картина ещё интереснее: поставщики больших моделей начинают продавать не столько интеллект, сколько предсказуемую unit-экономику автономных действий. А это уже язык, который понимают и стартапы, и энтерпрайз. Следующий раунд конкуренции, похоже, будет не про то, кто громче назовёт модель агентом, а про то, у кого агент действительно не зависнет на седьмом шаге и не раздует бюджет в три раза. Подробности релиза и исходные цифры можно сверить в материале .