Claude Haiku 5.5 вышла 7 октября: $0.10 за 1 млн входных токенов и $0.50 за 1 млн выходных, у Haiku 4.5 было $1 и $5. Месяц агента на 10 млн входных и 2 млн выходных токенов стоил $20, теперь $2, если запросы короче 100 000 токенов. В среднем Anthropic считает экономию в 75%.
Отдавать ей стоит рутину агента: разбирать входящие заявки или сжимать переписку с клиентом в сводку для менеджера. Думать должна, естественно, сильная модель, исполнять может попроще.
Я в Hermes так и делаю: более слабые задачи отдаю более слабым моделям, а самые умные умным. Экономия на токенах в моём случае достигает 80%.
Что вышло 7 октября и сколько стоит Haiku 5.5
Если вы работаете в Claude Code через Anthropic API, переключать ничего не нужно: с v2.1.293, вышедшей в тот же день, Haiku по умолчанию там Haiku 5.5. Всё, что шло на Haiku, уже идёт на модель до 10 раз дешевле за токен.
Модель claude-haiku-5-5 читает за раз до 1 млн токенов и пишет ответ до 128 тысяч токенов. Впервые у Haiku есть настройка effort: насколько сильно модель думает. Доступна в Claude API, Amazon Bedrock, Google Cloud и Microsoft Foundry.
| Цена за 1 млн токенов | Haiku 5.5, запрос до 100k | Haiku 5.5, запрос свыше 100k | Haiku 4.5 | Sonnet 5.5 |
|---|---|---|---|---|
| Ввод | $0.10 | $0.50 | $1.00 | $2.00 |
| Вывод | $0.50 | $2.50 | $5.00 | $10.00 |
| Чтение кэша | $0.01 | $0.05 | $0.10 | $0.10 |
| Запись кэша | $0.125 | $0.625 | $1.25 | $2.50 |
Выгода - на запросах до 100 000 токенов, по данным Anthropic это около 90% запросов к прежней Haiku. На запросах длиннее цена в 5 раз выше.
Кто остаётся на Sonnet 5.5, тоже платит меньше: чтение кэша подешевело вдвое, с $0.20 до $0.10 за 1 млн токенов, и агентные задачи, по словам Anthropic, дешевле примерно на 20%.
Разборы новых моделей и их цен я выкладываю в канале:
Если вы собираете свои проекты с ИИ-агентами, посмотрите программу практикума СмыслоКода.
Что это меняет для агента и как попробовать
Anthropic сама советует её для такой рутины и для работы помощником у Opus 5.5 и Sonnet 5.5. Простую рутину вы можете отдавать более дешёвым моделям, так и надо делать. Нельзя отправлять директора ездить за хлебом в магазин.
Сложные задачи агента Anthropic советует оставлять Sonnet и Opus. В Terminal-Bench 4.0, где модель решает многошаговые задачи в командной строке, Haiku 5.5 набирает 39,2%, Sonnet 5.5 - 70,6%. В OSWorld, где модель сама работает за компьютером, рост большой: 72,4% против 15,7% у Haiku 4.5, но до 83,9% у Sonnet 5.5 она не дотягивает.
Таблицу «какую модель под какую задачу» я отдаю бесплатно: выложил её в канале 24.09 вместе с полной схемой Hermes Agent с нуля. Забрать можно здесь.
Как попробовать
- Выберите 1 рутинный шаг, например разбор заявок. Поставьте ему модель
claude-haiku-5-5, остальные шаги не трогайте. - Если код писали под Haiku 4.5, уберите ручную настройку мышления
budget_tokens: на 5.5 она даёт ошибку 400. Адаптивное мышление у новой модели включено по умолчанию. - Начните с effort по умолчанию, это medium. Ниже опускайте, только если результат держится.
- Прогоните через Haiku 5.5 10-20 одинаковых задач, которые шли через прежнюю модель. Сравните качество ответов (не потерялась ли заявка, не выпало ли важное из сводки) и счёт за эти задачи в кабинете Anthropic.
Есть подвох. Тот же текст Haiku 5.5 считает в большее число токенов: по замеру Саймона Уиллисона примерно в 1,25 раза. Так что реальная экономия будет меньше 75%.
Проверить можно и бесплатно. Подписчикам Max и Team Anthropic в течение недели начислит ежемесячный кредит на API: Max 5x - $100, Max 20x - $200, Team - до $500 на всех, на любую модель. Уиллисон пишет, что забрать его можно в Settings → Billing, остаток не переносится.
Что я думаю: тупая модель или способ платить меньше
Про прежние версии Haiku я говорил прямо: это тупая модель, очень для простых задач. Для разработки её вообще использовать нельзя. В своей работе я беру самую сильную модель и никогда не включаю Sonnet: я не экономлю на токенах, для меня важен результат. А рутину агентов в Hermes отдаю бесплатным или очень дешёвым моделям.
Так же отдайте Haiku 5.5 только разбор заявок: подключите её рядом с сильной моделью и скажите агенту делать через неё самые несложные задачи. Как подключать модели, я показал в видео, обязательно посмотрите.
С 30:33 я подключаю ChatGPT, Claude и Kimi, на 37:41 показываю таблицу: какая модель под какую задачу.
Порядок у меня такой: сначала всё самое дорогое, а потом снижаем. Добейтесь результата на сильной модели, потом переводите шаги на Haiku 5.5 по одному и смотрите, не просело ли качество.
Модели я меняю регулярно, и задачи от этого лучше выполняться не начинают, иногда даже наоборот. Мне кажется, уже не так важно, какая у вас модель. Важно, какая у вас инструкция.
А какую рутину своего агента вы бы первой перевели на Haiku 5.5? Напишите в комментариях в канале.
Частые вопросы
Источники
- Anthropic: Introducing Claude Haiku 5.5 - цены Haiku 5.5, Haiku 4.5 и Sonnet 5.5, скидка 75%, задачи для модели, результаты тестов, чтение кэша Sonnet 5.5, API-кредит для Max и Team
- Anthropic: заметки о выпусках Claude Platform, 7 октября 2026 - 1 млн токенов работы, ответ до 128 тысяч токенов, effort, площадки, ошибка 400 на budget_tokens, новый подсчёт токенов
- Anthropic: Claude Code v2.1.293 - Haiku 5.5 стала моделью Haiku по умолчанию в Anthropic API
- Simon Willison: Claude Haiku 5.5 - замер токенов в 1,25 раза, сравнение с GPT-6 Luna, стоимость effort, Settings → Billing, кредиты не переносятся
- Артемий Миллер: Hermes Agent, несколько моделей сразу - экономия до 80% при раскладке задач по моделям
Новые материалы - дайджестом, без спама
Гайды выходят регулярно. Подпишись, чтобы не пропускать: пришлю подборку в Telegram или на email. Раз в неделю или каждый день - выбираешь сам.

