Claude Haiku 5.5: цена и какие задачи агента отдать дешёвой модели

Опубликовано 08.10.20266 мин чтенияБазовый
Мужчина держит телефон с логотипом Claude, рядом надпись «ХАЙКУ 5.5 ЦЕНА ЗАДАЧИ».
Что узнаешь
  • Сколько стоит Claude Haiku 5.5 рядом с Haiku 4.5 и Sonnet 5.5
  • Какую рутину агента отдать новой Haiku и где она не справится
  • Как перевести на неё один шаг агента и проверить счёт
Базовый
3просмотров

Claude Haiku 5.5 вышла 7 октября: $0.10 за 1 млн входных токенов и $0.50 за 1 млн выходных, у Haiku 4.5 было $1 и $5. Месяц агента на 10 млн входных и 2 млн выходных токенов стоил $20, теперь $2, если запросы короче 100 000 токенов. В среднем Anthropic считает экономию в 75%.

Отдавать ей стоит рутину агента: разбирать входящие заявки или сжимать переписку с клиентом в сводку для менеджера. Думать должна, естественно, сильная модель, исполнять может попроще.

Я в Hermes так и делаю: более слабые задачи отдаю более слабым моделям, а самые умные умным. Экономия на токенах в моём случае достигает 80%.

Что вышло 7 октября и сколько стоит Haiku 5.5

Если вы работаете в Claude Code через Anthropic API, переключать ничего не нужно: с v2.1.293, вышедшей в тот же день, Haiku по умолчанию там Haiku 5.5. Всё, что шло на Haiku, уже идёт на модель до 10 раз дешевле за токен.

Модель claude-haiku-5-5 читает за раз до 1 млн токенов и пишет ответ до 128 тысяч токенов. Впервые у Haiku есть настройка effort: насколько сильно модель думает. Доступна в Claude API, Amazon Bedrock, Google Cloud и Microsoft Foundry.

Цена за 1 млн токеновHaiku 5.5, запрос до 100kHaiku 5.5, запрос свыше 100kHaiku 4.5Sonnet 5.5
Ввод$0.10$0.50$1.00$2.00
Вывод$0.50$2.50$5.00$10.00
Чтение кэша$0.01$0.05$0.10$0.10
Запись кэша$0.125$0.625$1.25$2.50

Выгода - на запросах до 100 000 токенов, по данным Anthropic это около 90% запросов к прежней Haiku. На запросах длиннее цена в 5 раз выше.

Кто остаётся на Sonnet 5.5, тоже платит меньше: чтение кэша подешевело вдвое, с $0.20 до $0.10 за 1 млн токенов, и агентные задачи, по словам Anthropic, дешевле примерно на 20%.

Разборы новых моделей и их цен я выкладываю в канале:

Если вы собираете свои проекты с ИИ-агентами, посмотрите программу практикума СмыслоКода.

Практикум по вайб-кодингу
+Твой второй мозг
3 вечера - инструменты, метод, первый проект
Старт 17–19 ноября  ·  2 000 ₽
Записаться →

Что это меняет для агента и как попробовать

Anthropic сама советует её для такой рутины и для работы помощником у Opus 5.5 и Sonnet 5.5. Простую рутину вы можете отдавать более дешёвым моделям, так и надо делать. Нельзя отправлять директора ездить за хлебом в магазин.

Сложные задачи агента Anthropic советует оставлять Sonnet и Opus. В Terminal-Bench 4.0, где модель решает многошаговые задачи в командной строке, Haiku 5.5 набирает 39,2%, Sonnet 5.5 - 70,6%. В OSWorld, где модель сама работает за компьютером, рост большой: 72,4% против 15,7% у Haiku 4.5, но до 83,9% у Sonnet 5.5 она не дотягивает.

Таблицу «какую модель под какую задачу» я отдаю бесплатно: выложил её в канале 24.09 вместе с полной схемой Hermes Agent с нуля. Забрать можно здесь.

Как попробовать

  1. Выберите 1 рутинный шаг, например разбор заявок. Поставьте ему модель claude-haiku-5-5, остальные шаги не трогайте.
  2. Если код писали под Haiku 4.5, уберите ручную настройку мышления budget_tokens: на 5.5 она даёт ошибку 400. Адаптивное мышление у новой модели включено по умолчанию.
  3. Начните с effort по умолчанию, это medium. Ниже опускайте, только если результат держится.
  4. Прогоните через Haiku 5.5 10-20 одинаковых задач, которые шли через прежнюю модель. Сравните качество ответов (не потерялась ли заявка, не выпало ли важное из сводки) и счёт за эти задачи в кабинете Anthropic.

Есть подвох. Тот же текст Haiku 5.5 считает в большее число токенов: по замеру Саймона Уиллисона примерно в 1,25 раза. Так что реальная экономия будет меньше 75%.

Проверить можно и бесплатно. Подписчикам Max и Team Anthropic в течение недели начислит ежемесячный кредит на API: Max 5x - $100, Max 20x - $200, Team - до $500 на всех, на любую модель. Уиллисон пишет, что забрать его можно в Settings → Billing, остаток не переносится.

Что я думаю: тупая модель или способ платить меньше

Про прежние версии Haiku я говорил прямо: это тупая модель, очень для простых задач. Для разработки её вообще использовать нельзя. В своей работе я беру самую сильную модель и никогда не включаю Sonnet: я не экономлю на токенах, для меня важен результат. А рутину агентов в Hermes отдаю бесплатным или очень дешёвым моделям.

Так же отдайте Haiku 5.5 только разбор заявок: подключите её рядом с сильной моделью и скажите агенту делать через неё самые несложные задачи. Как подключать модели, я показал в видео, обязательно посмотрите.

Видео загрузится при скролле
Полная схема по Hermes Agent с нуля для автоматизации бизнеса

С 30:33 я подключаю ChatGPT, Claude и Kimi, на 37:41 показываю таблицу: какая модель под какую задачу.

Порядок у меня такой: сначала всё самое дорогое, а потом снижаем. Добейтесь результата на сильной модели, потом переводите шаги на Haiku 5.5 по одному и смотрите, не просело ли качество.

Модели я меняю регулярно, и задачи от этого лучше выполняться не начинают, иногда даже наоборот. Мне кажется, уже не так важно, какая у вас модель. Важно, какая у вас инструкция.

А какую рутину своего агента вы бы первой перевели на Haiku 5.5? Напишите в комментариях в канале.

Частые вопросы

Источники

Практикум по вайб-кодингу
+Твой второй мозг
3 вечера - инструменты, метод, первый проект
Старт 17–19 ноября  ·  2 000 ₽
Записаться →

Новые материалы - дайджестом, без спама

Гайды выходят регулярно. Подпишись, чтобы не пропускать: пришлю подборку в Telegram или на email. Раз в неделю или каждый день - выбираешь сам.

Была инструкция полезна?
Артемий Миллер
Автор
Артемий Миллер
Предприниматель и вайб-кодер

Артемий Миллер - предприниматель и вайб-кодер. Бывший программист, собирает продукты исключительно вместе с ИИ-агентами, без найма разработчиков.

Связанные инструкции

GPT-6.1 Sol в ChatGPT и Codex: что это, чем отличается от GPT-6 Astra и сколько стоит

OpenAI описывает GPT-6.1 Sol как модель, близкую к GPT-6 Astra. Ставки за вход и выход у неё в пять раз ниже, за кешированный вход - в десять. Сравнили цены API, ставки кредитов и оценки сообщений в подписке, доступность по планам и способы выбрать модель.

9 мин

GPT-5.5 отключат в Codex со входом через ChatGPT: что делать до 14 октября 2026

14 октября 2026 GPT-5.5 перестанет быть доступна в Codex при входе через ChatGPT-аккаунт на всех планах. OpenAI API это не касается. Официальные замены по плану, способы сменить модель и проверки перед отключением.

9 мин

Claude Max и API-кредиты: сколько дают каждый месяц и на что тратить

Подписчикам Claude Max каждый месяц начисляют кредиты на Claude API: $100 на Max 5x и $200 на Max 20x, в Team до $500. Они идут на API, Agent SDK и Managed Agents, на Claude Code в терминале не идут.

5 мин

GPT-6 в ChatGPT бесплатно: что получил Free и что умеет Intelligent UI

С 8 октября GPT-6 есть в бесплатном ChatGPT: Free и Go работают на GPT-6 Luna, Plus, Pro, Business и Enterprise с 7 октября на GPT-6 Sol. Вместе с моделью пришёл Intelligent UI: чат сам собирает под задачу калькулятор, делилку счёта или план с кнопками и графиками.

4 мин