Claude Haiku 5.5 вышел. Счета за агентов стали интереснее

Anthropic обновила младшую модель Claude, снизила стоимость кеша Sonnet и добавила API-кредиты в подписки. Скидки внушительные, но считать их нужно по-разному.

Компактный ИИ-помощник сортирует документы, а большой вычислительный блок работает над сложным проектом

Поручаешь ИИ разобрать тысячу писем. Он справляется, а потом приходит счет, будто каждое письмо разбирал совет директоров. Приятно, конечно, что письма получили столько внимания.

7 октября Anthropic выпустила Claude Haiku 5.5. Модель рассчитана на частые небольшие задачи: распределить обращения, извлечь данные из документов, сделать краткую сводку, помочь старшему агенту. И цены здесь стали ощутимо интереснее.

Claude Haiku 5.5: сколько теперь стоит работа

В новых тарифах есть два уровня. Цена зависит от длины входного запроса, а суммы ниже указаны за миллион токенов - небольших фрагментов текста, которыми модель измеряет работу.

Тариф APIВходВыход
Haiku 4.5$1$5
Haiku 5.5, запрос до 100 тысяч токенов включительно$0,10$0,50
Haiku 5.5, запрос длиннее 100 тысяч токенов$0,50$2,50

Для коротких запросов тариф снизился в 10 раз, для длинных - вдвое. Порог относится к отдельному запросу, а не к месячному расходу. И это цены API, не скидка на подписку Claude.

Зато среднюю экономию на выполненной работе Anthropic оценивает примерно в 75%. Почему не 90%? Изменился и сам способ подсчета текста: тот же материал теперь занимает примерно на 30% больше токенов. Плюс расход зависит от того, сколько модель размышляет и пишет в ответ. Дешевле единица измерения - еще не значит, что счет уменьшится ровно на тот же процент.

Что умеет младший Claude

Haiku 5.5 принимает текст и изображения, выдает текст и поддерживает контекст до миллиона токенов. Максимальный обычный ответ - 128 тысяч токенов. Впервые у Haiku можно регулировать глубину размышлений: простой задаче дать меньше времени, сложной больше. По умолчанию включен адаптивный режим, в котором модель выбирает, когда и сколько думать.

В таблице тестов Anthropic модель набрала 72,4% на офлайн-части OSWorld 2.1, где агент выполняет задачи на компьютере. У Haiku 4.5 было 15,7%. На Terminal-Bench 4.0, проверяющем работу в командной строке, результат вырос с 0 до 39,2%. Это результаты оценки компании; саму разницу видно без торжественного объявления нового сверхразума.

Для сложного программирования Anthropic по-прежнему предлагает Sonnet и Opus. Haiku отводят отдельную роль: выполнять небольшие поручения внутри большой работы. Скажем, старший агент готовит отчет, а помощник достает нужные цифры из документов.

Пример распределения работы: Haiku извлекает данные, старший агент собирает отчет

В проектировании ИИ-агентов мне нравится именно такой подход. Платить за сложное мышление там, где оно нужно, однозначно полезнее, чем отправлять главного архитектора перекладывать бумажки.

Sonnet тоже стал дешевле

Одновременно Anthropic вдвое снизила цену чтения кеша Sonnet 5.5: с $0,20 до $0,10 за миллион токенов. Кеш позволяет повторно использовать уже обработанные инструкции и материалы, вместо того чтобы каждый раз оплачивать их как новый вход.

Компания оценивает снижение расходов на большинстве агентных задач примерно в 20%. Здесь скидка относится к конкретной части работы, поэтому ждать половинного счета за весь проект было бы слишком красиво.

Старому агенту понадобится небольшая переделка

Haiku 5.5 уже доступен через Claude Platform, AWS, Google Cloud и Microsoft Azure. Но при переходе со старого Haiku одной замены названия модели в коде может не хватить.

В руководстве по переходу Anthropic просит пересчитать объем запросов и лимиты ответа, изменить старые настройки размышлений и убрать параметры случайности генерации. Старое значение бюджета размышлений новая модель отклоняет с ошибкой. И ответ может начинаться служебным блоком размышлений, так что брать первый блок как готовый текст уже нельзя.

Довольно земная часть большого релиза: модель обновилась, а код сам себя не обновил. Бывает.

Подписчикам Max и Team дадут деньги на API

На этой неделе Anthropic начинает выдавать ежемесячные API-кредиты: $100 для Max 5x, $200 для Max 20x, а для Team общий фонд до $500. В Team он складывается из $20 за обычное место и $100 за премиальное. Новым подписчикам нужно провести на подходящем плане семь дней и связать подписку с организацией в Claude Console.

Средства можно тратить на свои приложения и агентов в Claude Platform. Они не увеличивают лимиты обычного Claude или интерактивного Claude Code, не работают через сторонние облачные платформы и не переносятся на следующий расчетный период.

К слову, недавние релизы Opus и Sonnet мы уже разбирали. Теперь младшая модель тоже обновилась, причем конкуренция добралась до цен. Вот это уже приятно видеть в счете, а не только на очередном графике.

Старт

Хотите так же
в своём бизнесе?

Оставьте заявку — разберём ваши процессы, и я покажу, какую рутину ИИ-агент заберёт первой и сколько это сэкономит. Бесплатно и без обязательств.

  • Ответ в течение дня
  • Разбор вашей задачи на созвоне
  • Расчёт экономии и роста продаж

Обсудить задачу

или напишите напрямую в Telegram или ВКонтакте