AI И НЕЙРОСЕТИ

Anthropic снизила цену Claude Haiku 5.5 в десять раз

Claude Haiku 5.5 стоит от $0,10 за миллион входных токенов: Anthropic выпустила быструю модель для массовых AI-задач и агентов.

✍️ Редакция iTech News | 08.10.2026 | ⏱ 4 мин | Источник: The New Stack
🔮

Anthropic выпустила Claude Haiku 5.5 — младшую модель в линейке Claude — и снизила базовую API-цену для коротких запросов до $0,10 за миллион входных и $0,50 за миллион выходных токенов. Это в десять раз ниже заявленных ставок Haiku 4.5; для российских команд, которые считают экономику AI-функций в продукте, Claude Haiku 5.5 выглядит не как «облегчённый чат-бот», а как кандидат на роль массового исполнителя рутинных задач.

Релиз состоялся 7 октября. Как сообщает The New Stack, это первое обновление самой компактной и доступной модели Anthropic почти за год. Новинка стала третьей моделью семейства 5.5 за месяц: ранее компания представила более крупные Sonnet 5.5 и Opus 5.5. Haiku в этой конструкции отвечает не за самые трудные архитектурные решения или многочасовые цепочки рассуждений, а за скорость, объём и предсказуемый счёт за API.

Новая цена действует для запросов с промптом до 100 000 токенов. После этого порога тариф меняется: $0,50 за миллион входных и $2,50 за миллион выходных токенов. Граница принципиальна для агентных систем: короткие операции — классификация, извлечение полей из документов, маршрутизация обращений, сжатие контекста — получают очень дешёвое исполнение, а длинная история диалога или большой пакет документов могут заметно изменить стоимость одного запуска.

У Haiku 5.5 контекстное окно в 1 млн токенов, максимальный размер ответа — 128 000 токенов. Модель поддерживает adaptive thinking: разработчик может через параметр effort задавать глубину рассуждений, а сама система выбирает, когда тратить на задачу больше вычислений. Anthropic позиционирует Haiku как самую быструю модель в своей линейке при стандартном режиме работы. В документации среди целевых сценариев названы классификация, извлечение данных, маршрутизация и подзадачи для агентов.

Важная оговорка для тех, кто любит сравнивать прайс-листы в отрыве от реальных запросов: Haiku 5.5 использует новый токенизатор, похожий на токенизаторы более новых моделей Anthropic. Один и тот же текст может занимать примерно на 30% больше токенов, чем в Haiku 4.5. Поэтому «в десять раз дешевле за токен» не следует автоматически превращать в «в десять раз дешевле задача». Компания оценивает снижение стоимости запросов до 100 000 токенов в 90%, уже учитывая изменения в расходе токенов; это её оценка, которую разумно проверить на собственных промптах и данных.

Параллельно Anthropic вдвое снизила цену чтения кэша для Claude Sonnet 5.5 — до $0,10 за миллион токенов. По расчёту компании, это может сократить стоимость большинства длительных агентных задач на Sonnet примерно на 20%. Логика понятна: крупной модели остаются сложные этапы, а дешёвой и быстрой Haiku — повторяемые операции вокруг них. В агентном контуре это может быть разбор входящего запроса, выделение сущностей, подготовка краткого контекста, проверка формата ответа или выбор следующего инструмента.

Для разработчиков релиз означает, что экономику AI-фич можно пересмотреть не только на уровне модели «для чата». Например, обработчик тикетов, поиск по внутренним документам, извлечение реквизитов из файлов или предварительная модерация обычно состоят из тысяч однотипных коротких вызовов. Именно там разница между $1 и $0,10 за миллион входных токенов способна перейти из красивого слайда в заметную строку инфраструктурного бюджета. Но длинные промпты, цепочки с накопленным контекстом и генерация больших ответов требуют отдельного расчёта: после 100 000 токенов преимущество Haiku 5.5 становится существенно скромнее.

Модель уже доступна через Claude API под идентификатором claude-haiku-5-5, а также в Amazon Web Services, Google Cloud и Microsoft Azure. Anthropic также заявила поддержку компьютерного и браузерного использования в бета-версиях Python- и TypeScript-SDK. При этом компания прямо оставляет сложные агентные задачи по программированию более крупным Sonnet 5.5 и Opus 5.5: Haiku предназначена для узко очерченной работы, где важнее пропускная способность и цена.

Главный тест для Claude Haiku 5.5 теперь не в демонстрационных бенчмарках, а в архитектурах команд: смогут ли они действительно дробить процессы на дешёвые короткие вызовы, не утопив выигрыш в оркестрации, повторных запросах и длинном контексте. Если смогут, рынок малых моделей будет конкурировать уже не только качеством ответа, но и тем, насколько безболезненно модель встраивается в тысячи незаметных операций продукта.

Поделиться: Telegram X LinkedIn