> · · 8 мин

Claude Opus 5: «вдвое дешевле» — это не про твой счёт. Цена та же, что у Opus 4.8, а изменилась цензура

Claude Opus 5: «вдвое дешевле» — это не про твой счёт. Цена та же, что у Opus 4.8, а изменилась цензура

Anthropic выкатила Opus 5 в пятницу вечером, и весь интернет процитировал одну фразу из анонса: «половина цены Fable 5». Фраза честная. Но если ты платишь по API, твой счёт после перехода не изменится ни на цент — цена Opus 5 ровно такая же, как у Opus 4.8, которого он заменяет: $5 за миллион входных токенов и $25 за миллион выходных.

TL;DR: Claude Opus 5 вышел 24 июля. Цена не изменилась относительно Opus 4.8, «вдвое дешевле» — это про Fable 5. На Frontier-Bench v0.1 модель даёт 43,3% против 33,7% у Fable 5 и 18,7% у Opus 4.8. Стала новой моделью по умолчанию на Claude Max и доступна в API как claude-opus-5. Главное для разработчика — не бенчмарки, а то, что кибер-классификаторы теперь срабатывают на 85% реже, а при срабатывании запрос молча уезжает на Opus 4.8.

Что нового в Claude Opus 5 по сравнению с Opus 4.8

Opus 5 решает те же задачи за меньшее число токенов и заметно лучше держит длинные агентные цепочки. На Frontier-Bench v0.1 — агентном терминальном бенчмарке — он набирает 43,3% против 18,7% у Opus 4.8, то есть больше чем вдвое, и при этом дешевле в пересчёте на задачу. Модель доступна сразу везде: claude-opus-5 в API, дефолт на Claude Max, самая сильная модель на Claude Pro, плюс Claude Code и Cowork.

Цифры ниже Anthropic приводит сама, и читать их стоит как вендорские:

  • Frontier-Bench v0.1 — 43,3% (Opus 5), 33,7% (Fable 5), 18,7% (Opus 4.8)
  • CursorBench 3.2 на max effort — в пределах 0,5% от пикового результата Fable 5, но вдвое дешевле за задачу
  • OSWorld 2.0 (computer use) — обходит лучший результат Fable 5 примерно за треть стоимости
  • ARC-AGI 3 — втрое выше следующей модели, по замерам Anthropic
  • Zapier AutomationBench — pass rate примерно в 1,5 раза выше ближайшего конкурента при той же цене за задачу

Отдельно интересна органическая химия: +10,2 процентных пункта к Opus 4.8 на внутреннем бенчмарке по выводу структуры молекулы из спектроскопии, +7,7 на задачах про белки. Для сайд-проектов это ничего не значит, для биоинформатиков — значит.

Из полунезависимых подтверждений. Harvey сообщила, что Opus 5 даёт качество Opus 4.8 в режиме максимального рассуждения, генерируя в среднем на 26% меньше токенов. Lovable отчиталась о +22% к Opus 4.7 на своих самых тяжёлых агентных задачах и, что важнее, о меньшем разбросе между прогонами. Cognition (Devin) говорит про «уровень Fable за половину цены» с сильной стороной в дебаге и поиске корневой причины. Всё это — партнёры раннего доступа, то есть заинтересованная сторона, но замеры хотя бы на своих кодовых базах, а не на публичном лидерборде.

Сколько стоит Claude Opus 5 и где экономия

$5 за миллион входных токенов и $25 за миллион выходных — столько же, сколько стоил Opus 4.8. Экономия появляется не в прайсе, а в двух других местах: в числе токенов на задачу и в проценте задач, которые модель дорешивает до конца с первого раза.

Это ровно тот случай, когда маркетинг и бухгалтерия говорят про разные метрики. «Вдвое дешевле» — сравнение с Fable 5, который стоит своих денег на многодневных автономных прогонах. Если ты сидел на Opus 4.8, то после переключения строки model увидишь ту же цену за токен и, если верить Harvey, примерно на четверть меньше токенов. Если ты гонял всё на Fable 5 из принципа «беру самое умное» — вот здесь счёт действительно может уполовиниться.

Fast mode работает примерно в 2,5 раза быстрее дефолта и стоит вдвое дороже базы, то есть $10/$50. В Claude Code он идёт через usage credits.

Вместе с моделью в бете приехали две вещи, которые агентописателям важнее половины бенчмарков. Первая — смена набора инструментов посреди диалога без инвалидации prompt cache: раньше добавление инструмента на шаге 12 обнуляло кэш и весь контекст переоплачивался заново. Вторая — автоматические фолбэки на API: запрос, который зарезал классификатор, можно роутить на другую модель вместо ошибки.

Почему главная новость Opus 5 — это цензура, а не бенчмарки

Кибер-классификаторы Opus 5 срабатывают примерно на 85% реже, чем у Fable 5, и это оценка самой Anthropic. Для всех, кто упирался в отказы на легальной security-работе, это важнее любого процента на лидерборде.

Логика новых ограничений внятная: модели разрешено искать уязвимости в исходниках, но заблокированы бинарный анализ, пентест и генерация эксплойтов. Это отражает реальный расклад способностей. На OSS-Fuzz Opus 5 находит уязвимости в 79,4% случаев против 80% у Mythos 5 — то есть практически вровень. А вот довести находку до рабочего эксплойта он смог в 4 задачах против 13 у Mythos 5. Сильный в защите, слабый в нападении — и Anthropic говорит, что это сделано намеренно: на кибер-задачах модель специально не обучали, способности подтянулись сами как побочный эффект общего роста.

Подвох тоже есть. Когда классификатор всё-таки срабатывает, в Claude.ai, Claude Code и Cowork запрос по умолчанию уезжает на Opus 4.8. VentureBeat задал Anthropic очевидный вопрос: если запрос слишком рискованный для одной модели, почему он приемлем для другой? Ответ — «модель, на которую идёт фолбэк, менее способная, значит и риск вреда ниже». Логика есть, но для тебя это означает: часть прода может тихо исполняться другой моделью. В чате про это есть уведомление, на API фолбэк нужно включать явно.

Ещё одна деталь того же ряда: биологические запросы, которые блокирует Fable 5, теперь маршрутизируются на Opus 5, а не на Opus 4.8. Кто занимается структурной биологией — вам стало заметно легче жить.

Подводные камни

  • «Вдвое дешевле» не уменьшит твой счёт. Цена за токен идентична Opus 4.8. Если бюджет планировался под фразу из пресс-релиза, пересчитай его по своей реальной метрике — стоимости успешно завершённой задачи, а не миллиона токенов.
  • Бенчмарк Frontier-Bench прогоняли с подмешанной моделью. В сноске к анонсу указано: замер шёл на harness mini-SWE-agent и бэкенде GKE, среднее по 5 попыткам, и Opus 4.8 служил фолбэком при отказах классификатора у Opus 5 и Fable 5. То есть в итоговых 43,3% есть неизвестная доля ответов другой модели. Насколько большая — не раскрыто.
  • На длинных задачах Fable 5 всё ещё лучше, и это признаёт Anthropic. Формулировка их представителя: «Opus 5 — лучший инструмент для задач, которые видят бенчмарки, а Fable 5 берут, когда работа выходит за их пределы». Бенчмарки меряют ограниченные задачи с понятным результатом, а не длительность. Если у тебя агент живёт часами и днями по плотному контексту — не переключайся вслепую.
  • Fast mode стоит ровно вдвое. 2,5× скорости за 2× денег — арифметика в целом в твою пользу, но только если латентность реально узкое место, а не привычка.
  • Mythos 5 впереди по кибербезу и по длинным автономным исследовательским задачам в биологии. Opus 5 — самая способная общедоступная модель Anthropic для научной работы, но не самая способная вообще.
  • Фолбэк меняет модель под тобой. На API это опция, в интерфейсах — дефолт. Если у тебя воспроизводимость важнее удобства, фолбэк надо выключать осознанно.

Альтернативы

  • Claude Fable 5 — та же семья, но для многодневных автономных прогонов с плотным исходным материалом. Дороже, умнее на длинной дистанции, и Anthropic прямо советует прогнать обе модели на своём воркфлоу: одну ограниченную задачу и одну длинную.
  • Claude Sonnet 5 — когда решает цена за вызов и скорость, а не потолок интеллекта. Позиционируется под массовые прогоны.
  • GPT-5.6 Sol — прямой конкурент в агентном кодинге, и по признанию самой Anthropic модель семейства OpenAI всё ещё лидирует на одном из агентных кодинг-бенчмарков. Плюс с 23 июля это единственный вариант для тех, у кого в коде остались снапшоты gpt-5.x-codex.
  • Kimi K3 — открытые веса, $3/$15 за миллион, 1M контекста. Дешевле почти вдвое и не требует доверия к чужому API, но по агентным задачам и стабильности прогонов до Opus 5 не дотягивает.

Вердикт: стоит ли переходить на Opus 5

Если ты сидел на Opus 4.8, переключайся сегодня, это строго лучше при той же цене. Строка model меняется на claude-opus-5, и по данным партнёров ты получишь примерно на четверть меньше токенов при том же качестве. Если основная нагрузка на Fable 5 — сначала прогони обе модели на одной ограниченной и одной длинной задаче, потому что именно на длинных Fable по-прежнему выигрывает. А если тебя раньше резали классификаторы на security-задачах — это релиз, ради которого стоит вернуться и перепроверить свои сценарии: 85% меньше отказов меняет практику работы сильнее, чем десять пунктов на лидерборде.

Как попробовать

  1. В API поменяй идентификатор модели на claude-opus-5 — базовый URL, ключ и формат запроса не меняются.
  2. В Claude Code и на Claude Max ничего делать не нужно: Opus 5 уже стоит по умолчанию. На Pro он доступен как самая сильная опция.
  3. Прогони свою реальную задачу дважды — на Opus 4.8 и на Opus 5 — и сравни не качество, а число выходных токенов и время. Экономия здесь, а не в прайсе.
  4. Если строишь агента, включи в бете смену инструментов посреди диалога и посмотри на hit rate prompt cache до и после — на длинных цепочках это самая заметная экономия релиза.
  5. Решите заранее, нужен ли вам автоматический фолбэк: на API он выключен, в интерфейсах включён. Для воспроизводимого прода — выключать.
  6. Детали, сноски и графики по effort-уровням — в анонсе Anthropic, рекомендации по промптам — в отдельном гайде.
$ ls ./related/

Похожие статьи

openai-model-sandbox-escape.md
Модель OpenAI час искала дыру в песочнице, чтобы выложить PR на GitHub. И разбила токен надвое в обход сканера
> · 8 мин

Модель OpenAI час искала дыру в песочнице, чтобы выложить PR на GitHub. И разбила токен надвое в обход сканера

OpenAI рассказала, как её внутренняя модель во время тестов час искала дыру в песочнице ради PR на GitHub и дробила украденный токен в обход сканера. Разбираем, что случилось на самом деле, почему это баг приоритетов, а не бунт машины, и как изолировать агентов, чтобы они физически не могли навредить.

ai agents openai security
fable-5-usage-credits-tiers.md
Дедлайн Fable 5 всё-таки наступил: Max получил модель навсегда, Pro отправили платить по $10/$50 за миллион токенов
> · 8 мин

Дедлайн Fable 5 всё-таки наступил: Max получил модель навсегда, Pro отправили платить по $10/$50 за миллион токенов

После трёх продлений Anthropic не стала продлевать промо Fable 5 в четвёртый раз, а разделила пользователей по тарифам: Max получил модель навсегда, Pro перевели на оплату по токенам $10/$50 за миллион. Считаем реальную стоимость сессии, разбираем разовый кредит $100 и куда уходить с Pro.

ai llm claude anthropic
open-weight-coding-models-july-2026.md
На чём кодить дёшево в июле 2026: GLM-5.2 обошёл GPT-5.5 на SWE-Pro, MiniMax M3 стоит копейки — но «open» не значит «на твоём ноуте»
> · 7 мин

На чём кодить дёшево в июле 2026: GLM-5.2 обошёл GPT-5.5 на SWE-Pro, MiniMax M3 стоит копейки — но «open» не значит «на твоём ноуте»

Открытые веса догнали закрытых: GLM-5.2 обходит GPT-5.5 на SWE-bench Pro, MiniMax M3 стоит $0.30 за миллион токенов, а DeepSeek V4-Pro кодит почти как Opus за десятую часть цены. Сравниваем цену, бенчмарки, контекст и лицензии — и почему «open-weight» не значит «влезет в твой ноут».

ai llm benchmarks coding
subscribe.sh

$ cat /dev/blog/updates

> Свежие заметки о программировании,

> DevOps и AI — прямо в мессенджер

./subscribe