Стоит ли переходить на Claude Opus 5: честный разбор для вайб-кодера

Опубликовано 25.07.202613 мин чтенияСредний
Светящаяся нейросеть Claude Opus 5 и знак доллара идеально балансируют на минималистичных весах.
Что узнаешь
  • Что нового в Opus 5 и чем она сильнее Opus 4.8
  • Сколько стоит Opus 5 и почему цена - главная новость релиза
  • Что такое режимы усилий и как на них экономить токены
  • Где Opus 5 обходит конкурентов, а где остаётся слабее
  • Как включить Opus 5 в Claude Code и пользоваться из России
Применить за 15 мин
Сэкономит 5 ч
Средний
4просмотров
Что понадобится

Каждый день в Telegram-канале - что нового в вайб-кодинге: инструменты, примеры, ошибки. Подпишись, чтобы быть в курсе.

Что такое Claude Opus 5 и почему про неё все говорят?

Полгода назад Anthropic выкатила Fable 5 - модель, которая делает большие проекты почти с одного промпта, продуманно и аккуратно. Потом её на время убрали из подписки и оставили только за токены по высокой цене, а следом и вовсе временно отключили из-за экспортных ограничений. Кто следит за моим каналом, помнит эти качели. Теперь история закрылась красиво: тот же класс силы лежит прямо в подписке, а платишь как за прошлый Opus. Вот это для меня и есть новость.

Вот как саму модель описывает Anthropic:

Продуманная и проактивная модель, которая приближается к передовому интеллекту Claude Fable 5 - за половину цены.

- Anthropic, https://www.anthropic.com/news/claude-opus-5

Что это значит на практике:

  • Opus 5 заменила Opus 4.8 как старшая модель. Если ты работал на Opus - ты уже перешёл, менять ничего не надо.
  • По умолчанию стоит в Claude Code (с версии v2.1.219) и в подписке Claude Max (заметки к релизу). На Claude Pro это сильнейшая из доступных моделей.
  • Fable 5 никуда не делась. Anthropic прямо говорит: для самых сложных многодневных автономных задач по-прежнему советуют Fable. Opus 5 - это рабочая лошадка на каждый день. Убийцей флагмана её никто и не называет.

Я на записи практикумов не раз говорил, что всегда работаю на Opus - это моя основная модель под реальные задачи. Так что переход на Opus 5 для меня - обычное обновление того, чем я и так пользуюсь каждый день. Дальше разберу, что именно это обновление даёт.

Насколько Opus 5 сильнее Opus 4.8?

Anthropic на своей странице даёт в основном относительные формулировки вроде «более чем удваивает Opus 4.8». Точные числа собрали независимые трекеры. Вот как выглядит обновление по ключевым тестам:

ТестOpus 4.8Opus 5
Frontier-Bench (сложные агентные задачи)18.7%43.3%
ARC-AGI-3 (рассуждение без зубрёжки)1.5%30.2%
SWE-bench Pro (починка реальных багов)69.2%79.2%
OSWorld 2.0 (работа с интерфейсом)55.7%70.6%
SWE-bench Multimodal (код по картинке)38.4%59.4%

Источник точных чисел - разбор бенчмарков на Codersera и MarkTechPost. Сравнение Opus 4.8 с Claude Code я разбирал отдельно в гайде «Opus 4.8 в Claude Code» - там видно, с какой базы модель стартовала.

Обрати внимание на строку ARC-AGI-3. Этот тест придумали так, чтобы модель нельзя было натаскать заранее: каждая задача новая. Прыжок с 1.5% до 30.2% - это смена уровня рассуждения. Полтора процента у Opus 4.8 означают почти случайное угадывание, тридцать - уже осмысленную работу. И на строке про работу с интерфейсом (OSWorld) важно, что Opus 5 обходит даже Fable 5, при этом, по данным Anthropic, примерно за треть стоимости.

Одна оговорка про числа. Громкую цифру «96% на SWE-bench Verified» разносят многие обзоры, но на официальной странице Anthropic её нет - она есть только у сторонних трекеров (benchlm.ai). Я такие цифры беру как ориентир. Истиной в последней инстанции они не будут. Бенчмарк - это лаборатория, а в реальной работе те же цифры ведут себя иначе.

Сколько стоит Opus 5 и почему это главная новость?

Прайс Opus 5 (OpenRouter, модель Claude Opus 5):

ЧтоOpus 5Opus 4.8
Вход, за 1M токенов$5$5
Выход, за 1M токенов$25$25
Быстрый режим (Fast), в Claude Code$10 / $50-
Контекст1M токенов1M токенов

Цену подтверждают и сама Anthropic, и Bloomberg: те же $5 и $25, что у прошлого Opus. Отдельно есть быстрый режим (Fast) - модель отвечает примерно в 2.5 раза быстрее, но стоит вдвое дороже базовой цены. В Claude Code он идёт по $10 за 1M входных и $50 за выходные (разбор Claude Code v2.1.219). Врубаю его, когда ответ нужен здесь и сейчас. На постоянку он просто дороже, держать незачем.

Цена бьёт по карману сильнее, чем цифры на бенчмарке. Fable 5 многие хвалили, но она дорогая, и её то убирали из подписки, то возвращали. Opus 5 закрывает эту боль: тот же класс задач, но по цене, которую можно планировать. Как не жечь лимиты на любой модели - отдельная дисциплина, я разбирал её в гайде «Как не сжечь лимиты в Claude Code».

Хочешь не только выбрать модель подешевле, но и собрать связку, при которой ИИ реже галлюцинирует и дольше держит контекст? Выбор модели и режима усилий - это одна ручка. Контекст-инжиниринг - ручка мощнее: то, что ты кладёшь модели в контекст до промпта, влияет на результат сильнее, чем цифра на бенчмарке. На практикуме показываю всю систему: контекст-инжиниринг собирается со Вторым мозгом (структура business/) и ИИ-клоном (твой ai-clone/). Это три кита, без которых любая модель, хоть Opus 5, хоть Fable, разваливается на длинной сессии.

Практикум по вайб-кодингу
+Твой второй мозг
3 вечера - инструменты, метод, первый проект
Набор открыт
Записаться →

Что такое режимы усилий и как на них экономить?

Это самая практичная новая ручка релиза. Раньше модель думала настолько глубоко, насколько считала нужным сама. Теперь глубину задаёшь ты параметром усилий (документация Anthropic про effort). В приложении Claude тумблер простой - три положения, low / medium / high. В Claude Code и через API уровней пять.

Вот как я бы раскладывал их под задачи вайб-кодера:

УровеньКогда включать
lowмелкие правки, переименования, простой текст - максимум экономии
mediumобычные задачи по коду, где не нужно глубоко планировать
high (по умолчанию)сложный код, архитектура, разбор большого проекта
xhigh / maxсамое трудное, когда цена ошибки высокая и не жалко токенов

Практический порядок, чтобы не переплачивать:

  1. Начинай с high - этого хватает почти на всё.
  2. На рутине опускай до medium или low - ответ быстрее и дешевле.
  3. Поднимай до xhigh или max только на реально сложных задачах: большой рефакторинг, запутанный баг, архитектура с нуля.
  4. Помни: на xhigh и max рассуждение нельзя выключить - если попробуешь его отключить, получишь ошибку.

Один уровень усилий не сделает из плохого промпта хороший. Но он реально экономит деньги: держишь low на мелочи - и счёт за месяц заметно тоньше.

Где Opus 5 обходит конкурентов, а где отстаёт?

Начну с хорошего. Независимый обозреватель Simon Willison, чьи разборы моделей читают все, кто в теме, пишет прямо:

Сейчас она возглавляет рейтинг Artificial Analysis, опережая даже Fable 5.

- Simon Willison, https://simonwillison.net/2026/Jul/24/introducing-claude-opus-5/

Если сравнивать с текущим флагманом OpenAI - GPT-5.6 Sol - по данным трекеров расклад в пользу Opus 5 на нескольких осях:

ТестOpus 5GPT-5.6 Sol
Frontier-Bench43.3%34.4%
ARC-AGI-3 (рассуждение)30.2%7.8%
GDPval-AA (общий интеллект, Elo)18611736

Числа - из разбора запуска на Codersera. Прямого сопоставления Opus 5 с новым агентным Codex от OpenAI пока нет: модели вышли в разное время и меряются на разных обвязках, так что таблицу «Opus 5 против Codex» с точными числами сейчас никто собрать корректно не может. Кто такую таблицу показывает - скорее всего склеил несопоставимые замеры.

Слабые места у Opus 5 тоже есть. Тот же Willison отмечает, что в поиске уязвимостей она близка к Mythos 5, но в их эксплуатации - то есть в превращении дыры в реальную атаку - заметно слабее. И сама Anthropic на самые тяжёлые многодневные автономные задачи по-прежнему рекомендует Fable 5.

Отдельно про китайские открытые модели вроде Kimi K3 - их сейчас много, они дешёвые и по бенчмаркам выглядят красиво. Я к ним отношусь спокойно и по опыту скажу так: как бы красиво ни выглядели их цифры, в реальной работе они пока уступают Opus - процентов на пятнадцать по качеству, плюс думают дольше. Claude уже закончил задачу, а такая модель ещё возится. Подробнее я разбирал это в гайде «Kimi K3 против Claude Code». Так что Opus 5 берёт силой и предсказуемостью, дешевизна тут не главный козырь.

Как включить Opus 5 в Claude Code?

Порядок действий, если хочешь убедиться, что работаешь на Opus 5:

  1. Обнови Claude Code до версии v2.1.219 или новее - именно она сделала Opus 5 моделью по умолчанию (заметки к релизу на GitHub).
  2. Открой выбор модели командой /model.
  3. Выбери Claude Opus 5. В свежих версиях она и так стоит по умолчанию, так что часто этот шаг можно пропустить.
  4. При необходимости задай уровень усилий - по умолчанию стоит high, для рутины опусти ниже.

Отдельный сюжет для тех, кто настраивает Claude Code под себя. Инженер Anthropic Thariq Shihipar на запуске написал важную вещь:

Мы убрали около 80% системного промпта Claude Code для наших новых моделей.

- Thariq Shihipar, https://x.com/trq212/status/2080710971228918066

По их словам, качество на кодинге при этом не просело (разбор на the-decoder). Смысл в том, что новым моделям нужно меньше подсказок в системном промпте - они и так лучше держат задачу. Для тебя вывод простой: не заваливай агента тоннами инструкций в CLAUDE.md. Я и свой держу коротким - на Opus 5 это работает лучше, чем длинные простыни правил.

Как пользоваться Opus 5 из России?

Коротко про варианты доступа:

  1. Подписка Claude Max или Pro - самый простой путь по интерфейсу, но оплата российской картой не проходит, и с 4 апреля 2026 эти подписки не работают со сторонними клиентами.
  2. Платный доступ по API - если пользуешься сторонним клиентом поверх Claude, нужен именно он. Обычная подписка тут не подойдёт (разбор новых правил оплаты).
  3. Через OpenRouter - Opus 5 доступна по $5 за 1M входных и $25 за выходные, пополнение картой, AliPay или криптой (USDC), минимальная транзакция $5 (OpenRouter).

Тему доступа из России со всеми нюансами регистрации я разбирал отдельно в гайде «Claude Code из России» - там про VPN, номера и подводные камни подробнее. Сама Opus 5 из России работает без магии, весь вопрос упирается в способ оплаты.

Стоит ли тебе переходить на Opus 5?

Разложу по типам, чтобы ты нашёл себя:

  • Ты работаешь на Opus 4.8. Переходи не раздумывая. Та же цена, заметно сильнее на трудных задачах, в Claude Code уже по умолчанию. Это редкий случай, когда обновление модели ничего не стоит.
  • Ты экономишь каждый токен. Opus 5 стала выгоднее: держи low и medium на рутине, поднимай усилия только на сложном. Если бюджет совсем жёсткий - сравни с дешёвыми моделями, но помни про разницу в реальной работе.
  • У тебя сложные автономные задачи на много часов. Тут Anthropic сама советует Fable 5. Opus 5 - отличная модель на каждый день, но флагман под тяжёлую автономию пока другой.
  • Ты только начинаешь. Не думай о выборе модели вообще. Бери то, что стоит по умолчанию (это уже Opus 5), и вкладывайся в то, как ты готовишь контекст. Это важнее самой модели.

Я гоняю Opus основной моделью давно, и каждый релиз повторяет одно и то же: новая модель поднимает потолок, но проект за меня не соберёт. Решает то, что я кладу в контекст, а цифра на бенчмарке идёт следом. Opus 5 я уже поставил по умолчанию и об этом больше не думаю. Думаю про то, как готовлю business/ и ai-clone/ - вот где реальный рычаг. С Opus 5 или без - собирать эту структуру всё равно тебе.

Источники

Полная схема по вайб-кодингу за вечер: ИИ-клон + Второй мозг + Контекст-инжиниринг. 3 эфира по 2 часа, записи остаются у тебя.

Практикум по вайб-кодингу
+Твой второй мозг
3 вечера - инструменты, метод, первый проект
Набор открыт
Записаться →

Новые материалы - дайджестом, без спама

Гайды выходят регулярно. Подпишись, чтобы не пропускать: пришлю подборку в Telegram или на email. Раз в неделю или каждый день - выбираешь сам.

Была инструкция полезна?
Артемий Миллер
Автор
Артемий Миллер
Предприниматель и вайб-кодер

Артемий Миллер - предприниматель и вайб-кодер. Бывший программист, собирает продукты исключительно вместе с ИИ-агентами, без найма разработчиков.

Связанные концепты