24 июля 2026 года Anthropic выпустила Claude Opus 5. Релиз состоялся примерно через два месяца после Opus 4.8, а номер версии перескочил через целое поколение — с 4.8 сразу на 5. В собственной документации Anthropic это названо качественным скачком, а не постепенным улучшением Opus 4.8.

Если коротко: цена не изменилась ($5 за вход / $25 за выход на миллион токенов), но в агентных бенчмарках модель догоняет или обходит флагманский Claude Fable 5, который стоит $10 / $50 — то есть Opus 5 делает ту же работу вдвое дешевле. С другой стороны, в API появились два ломающих изменения, и код, перенесённый без правок, может упереться в ошибку 400 или обрезанный ответ. В статье официальный анонс и документация сверены с несколькими публикациями в прессе, а производительность, цены и ловушки миграции разобраны с точки зрения практика.

CLAUDE OPUS 5 — 2026.07.24

Та же цена, заметный скачок

— формулировка самой Anthropic: уровень фронтира вдвое дешевле Fable 5

ID МОДЕЛИ
claude-opus-5
Без суффикса с датой
ЦЕНА (ЗА МИЛЛИОН ТОКЕНОВ)
$5 / $25
Как у Opus 4.8, вдвое дешевле Fable 5
КОНТЕКСТ / ВЫВОД
1M / 128K
1M — и значение по умолчанию, и максимум
НА ЧТО ОБРАТИТЬ ВНИМАНИЕ
2 ломающих изменения
Мышление включено по умолчанию, отключить его можно не всегда
Источник: официальный анонс Anthropic и документация Claude Platform (24 июля 2026)

1. Opus 5 в трёх строках

1. ПРОИЗВОДИТЕЛЬНОСТЬ

Сильный рост в агентном кодинге, работе с компьютером и длительных задачах. В агентном терминальном бенчмарке Frontier-Bench v0.1, по данным Anthropic, результат более чем вдвое выше Opus 4.8 — и при меньшей стоимости одной задачи.

2. ЦЕНА

Без повышения. $5 за вход / $25 за выход на миллион токенов — ровно как у Opus 4.8 и ровно вдвое дешевле флагманского Fable 5 ($10 / $50).

3. РИСК ПРИ МИГРАЦИИ

Мышление теперь включено по умолчанию, а отключить его можно только при effort high и ниже. Всё, что работает с жёстко подобранным max_tokens, рискует оборваться на середине ответа.

Одной фразой: Opus 5 делает почти ту же работу, что и Fable 5, по цене Opus 4.8. Верно и обратное: когда нужен предельный уровень возможностей, у Fable 5 и Mythos 5 по-прежнему есть своя роль (см. раздел о проигрышах ниже).

2. Ключевые характеристики и где модель доступна

Начнём с цифр. Ниже основные характеристики по официальному списку моделей Anthropic.

Параметр Claude Opus 5 Claude Opus 4.8 (предыдущая) Claude Fable 5 (флагман)
ID модели в API claude-opus-5 claude-opus-4-8 claude-fable-5
Цена (вход / выход) $5 / $25 $5 / $25 $10 / $50
Окно контекста 1M токенов (по умолчанию и максимум) 1M токенов 1M токенов
Максимум вывода 128K токенов 128K токенов 128K токенов
Надёжная граница знаний май 2026 январь 2026 январь 2026
Мышление Включено по умолчанию Выключено по умолчанию (включается явно) Всегда включено (отключить нельзя)
Уровни effort low / medium / high / xhigh / max low / medium / high / xhigh / max low / medium / high / xhigh / max

Источник: Anthropic, «Models overview» и «What's new in Claude Opus 5» (по состоянию на июль 2026)

Строка, которую обычно пролистывают, но которая заметна в ежедневной работе, — сдвиг границы знаний вперёд. Opus 4.8 и Fable 5 останавливаются на январе 2026, Opus 5 доходит до мая 2026. Это лишние несколько месяцев версий библиотек и свежих изменений в спецификациях, о которых модель знает без поиска. И всё же «сегодняшний день» ей по-прежнему неизвестен: никогда не позволяйте ей утверждать что-то о текущих событиях или новых ценах без веб-поиска.

Где её можно запускать

API и облака

Claude API (claude-opus-5), Amazon Bedrock (anthropic.claude-opus-5), Google Cloud, Microsoft Foundry. Opus 4.8 остаётся доступной.

Приложения и инструменты разработчика

claude.ai, Claude Code и Claude Cowork. Это модель по умолчанию на тарифе Max и старшая модель, доступная для выбора на Pro.

Ограничение быстрого режима

Высокоскоростной вариант — исследовательское превью и работает только в Claude API. На Bedrock, Google Cloud и Microsoft Foundry его сегодня нет.

3. Цены: без изменений и вдвое дешевле Fable 5

Самый практичный факт этого релиза — возможности выросли, а цена осталась прежней. Документация Anthropic формулирует это прямо: «$5 за миллион входных токенов и $25 за миллион выходных, без изменений относительно Claude Opus 4.8».

Цена за миллион токенов (Claude API)

Claude Opus 5
$5 вход / $25 выход
Запись в кеш $6.25 (5 мин) / $10 (1 час), чтение из кеша $0.50
Claude Fable 5
$10 вход / $50 выход
Флагман. Ровно вдвое дороже Opus 5
Быстрый режим Opus 5
$10 вход / $50 выход
Примерно в 2.5 раза быстрее при цене в 2 раза выше. Только в API

Источник: Anthropic, «What's new in Claude Opus 5» и «Pricing» (июль 2026). Тарифы кеша посчитаны по официальным множителям (запись 1.25x и 2x, чтение 0.1x)

Что действительно стоит усвоить: цена за токен и стоимость одной задачи — разные вещи. В материалах по Opus 5 Anthropic на первое место ставит графики стоимости задачи, а не цену за токен. Например, в бенчмарке работы с компьютером OSWorld 2.0 официальный анонс сообщает, что модель превосходит лучший результат Fable 5 примерно втрое дешевле. Вдвое меньшая цена за токен плюс меньше лишних шагов складываются в куда больший разрыв на практике.

Одна оговорка: раз мышление теперь включено по умолчанию, тот же самый промпт может дать больше выходных токенов и обойтись дороже. Если у вас что-то дёшево работало на Opus 4.8 с выключенным мышлением и вы просто поменяли ID модели, счёт может вырасти. После миграции обязательно измерьте usage на реальном трафике.

4. Бенчмарки в подробностях

Анонс Anthropic построен на графиках, а не на таблице чисел, поэтому в тексте страницы почти всё сказано относительно: «более чем вдвое», «в пределах 0.5%». Поэтому в статье сравнения, которые Anthropic формулирует своим текстом, отделены от цифр, которые одинаково приводят несколько изданий.

4-1. Сравнения, названные самой Anthropic

Frontier-Bench v0.1

Агентная работа в терминале и кодинг. Модель обходит все протестированные и набирает более чем вдвое больше Opus 4.8 при меньшей стоимости задачи.

CursorBench 3.2

На effort max результат в пределах 0.5% от лучшего показателя Fable 5 — примерно вдвое дешевле.

ARC-AGI 3

Мера решения по-настоящему новых задач: здесь модель набирает втрое больше, чем занявшая второе место.

OSWorld 2.0

Работа с компьютером. Модель лидирует над конкурентами в каждой ценовой точке и превосходит лучший результат Fable 5 примерно втрое дешевле.

Zapier AutomationBench

При равных затратах доля успешных прогонов примерно в 1.5 раза выше, чем у ближайшего преследователя. По словам Anthropic, даже её самый низкий уровень effort обходит лучший результат конкурирующих моделей.

Науки о жизни

Впереди Opus 4.8 во всех оценках, которые ведёт Anthropic, причём органическая химия выросла более чем на 10 пунктов (например, распознавание структур по спектральным данным).

4-2. Цифры из публикаций в прессе

Приведённые ниже числа взяты из the decoder (24 июля 2026) и tech-ish (тот же день) — оба издания считывали их с графиков Anthropic. В список попали только пункты, в которых оба источника совпадают. Учтите: в тексте официальной страницы эти цифры не приведены (помечены жёлтой точкой — «по данным прессы»).

Бенчмарк Opus 5 Fable 5 GPT-5.6 Sol Opus 4.8
Frontier-Bench v0.1
Агентная работа в терминале
43.3% 33.7% 34.4% около 21%🟡
ARC-AGI-3
Решение новых задач
30.2% 7.8% 1.5%
GDPval-AA v2 (Elo)
Реальная интеллектуальная работа
1,861 1,747 1,736 1,593
OSWorld 2.0
Агенты, управляющие компьютером
70.6% 66.1%
DeepSWE v1.1
Агентный кодинг
68.8% 69.7% 72.7%

Картина довольно очевидная. Чем дольше модель работает самостоятельно, тем больше отрыв — терминал, управление компьютером, автоматизация бизнес-процессов, новые задачи. И наоборот: в кодинге «одним патчем» (DeepSWE) она проигрывает GPT-5.6 Sol. Ровно та же картина, которую мы разбирали в сравнении с GPT-5.6 Sol, повторяется этажом выше.

5. Где модель всё ещё проигрывает

Обзоры релизов обычно перечисляют только победы, поэтому сделаем наоборот. Ниже слабые места, которые Anthropic признаёт в анонсе сама, плюс цифры, на которые обратили внимание журналисты.

Наступательная кибербезопасность

Разрыв с Mythos 5 в поиске уязвимостей сократился, но Anthropic прямо пишет, что модель сильно отстаёт в написании эксплойтов. Специализированная защитная модель — по-прежнему линейка Mythos.

Длительные автономные исследования в биологии

Науки о жизни подтянулись по всем направлениям, но в документации отмечено, что модель всё ещё уступает Mythos 5 в длительных автономных биологических исследованиях.

Кодинг «с одного захода»🟡

В DeepSWE v1.1 у неё 68.8% против 72.7% у GPT-5.6 Sol. В Humanity's Last Exam по сути ничья: 56.3% против 56.5% у Fable 5 (по данным прессы).

Effort max не всегда лучший🟡

the decoder указывает, что в Frontier-Bench и Coding Agent Index уровень max дал результат ниже, чем более низкие настройки. Больше потраченных денег не всегда означает больше пользы.

Что это значит на практике: ставить max по умолчанию — способ поднять счёт и опустить качество. Сама документация советует начинать с high или xhigh и пробовать спускаться до medium на собственном наборе тестов. Относитесь к effort как к настраиваемому параметру, а не к константе, которую задают один раз.

6. Два ломающих изменения (мышление включено, лимиты на effort)

Если вы обращаетесь к API напрямую, этот раздел пропускать нельзя. Два пункта, которые Anthropic перечисляет как «изменения поведения», способны сломать работающий код, перенесённый без правок.

Изменение 1: мышление включено по умолчанию

В Opus 4.8 отсутствие параметра thinking означало работу без мышления. В Opus 5 его отсутствие означает, что мышление включается — то же самое, что написать thinking: {"type": "adaptive"}.

# Тот же код, который на Opus 4.8 работал без мышления...
client.messages.create(
    model="claude-opus-5",
    max_tokens=1024,          # теперь это лимит на мышление и ответ вместе
    messages=[...],
)
# На Opus 5 модель сначала думает, поэтому ответ может оборваться

max_tokens — это потолок для токенов мышления и текста ответа вместе. Всё, где max_tokens был подобран впритык под ожидаемую длину ответа, теперь потратит этот бюджет на мышление и окажется обрезанным. При миграции придётся выбрать: явно отключать мышление или давать max_tokens запас.

Изменение 2: отключить мышление можно только при effort high и ниже

И у самой возможности «выключить» теперь есть ограничение. Сочетание thinking: {"type": "disabled"} с effort xhigh или max возвращает ошибку 400. Проверка выполняется для каждого запроса, поэтому код, который повышает effort по ходу работы, ломается самым неприятным образом: сначала всё работает, а затем внезапно начинаются ошибки.

✅ Разрешено

Мышление выключено + effort low/medium/high

❌ Ошибка 400

Мышление выключено + effort xhigh/max

🔧 Рекомендуется

Оставить мышление включённым и понижать effort для контроля расходов

Anthropic идёт дальше и документирует, что именно ломается, если всё-таки работать с выключенным мышлением. В этом режиме Opus 5 иногда пишет вызовы инструментов обычным текстом — то есть инструмент не запускается, а ход выглядит успешным — и может «просачивать» внутренние XML-теги в вывод. Если вы строите агентов, безопаснее оставить мышление включённым и снизить effort.

7. Как выбрать один из пяти уровней effort

Opus 5 поддерживает все пять уровней — low / medium / high / xhigh / max, — и по умолчанию и в API, и в Claude Code стоит high. О настройке со стороны Claude Code читайте в нашем руководстве по параметру effort.

Effort Для чего подходит Примечания
low / medium Рутинная обработка, классификация, рабочие субагенты, участки, чувствительные к задержке Именно здесь Anthropic подчёркивает: «Opus 5 остаётся сильной даже на низком effort». Стоит попробовать первым делом
high (по умолчанию) Общие задачи, где нужен реальный интеллект Безопасный выбор, если сомневаетесь. Точка баланса между качеством и ценой
xhigh Рекомендованная стартовая точка для кодинга и агентных нагрузок Дайте max_tokens хороший запас (начните примерно с 64K токенов)
max Трудные задачи, где правильный ответ важнее счёта за API Самое глубокое рассуждение, но не всегда лучший результат (см. раздел 5)

8. Остальные новые возможности

Смена набора инструментов по ходу диалога (бета)

Раньше изменение списка инструментов посреди диалога сбрасывало весь кеш промпта. Opus 5 позволяет добавлять и убирать инструменты, сохраняя кеш (бета-заголовок mid-conversation-tool-changes-2026-07-01). Для долго живущих агентов это прямая экономия.

Минимальная длина кешируемого промпта вдвое меньше

Минимальная длина промпта для кеширования снижена с 1,024 до 512 токенов. Промпты, которые были слишком короткими для кеша на Opus 4.8, кешируются без единой правки в коде.

Режим запасной маршрутизации «default»

Если запрос отклонён фильтрами безопасности, вместо перечисления альтернативных моделей вручную можно автоматически применить рекомендованную Anthropic маршрутизацию (бета-заголовок server-side-fallback-2026-07-01).

Быстрый режим

Исследовательское превью: примерно в 2.5 раза быстрее вывод при цене в 2 раза выше. Только Claude API — на Bedrock, Google Cloud и Microsoft Foundry недоступен.

9. Другой характер модели и правка промптов

Скорее всего, вы заметите это раньше любых бенчмарков. Документация перечисляет четыре изменения поведения, которые видны без единой строчки правок в коде.

Изменение Что делать
Ответы и артефакты становятся длиннее
Ответы пользователю, Markdown-файлы, которые она пишет
Просите краткость явно. Понижение effort текст не укорачивает, так что добиваться этого нужно промптом
Она больше комментирует свою работу Удалите старые подпорки вроде «подводи итоги каждые N шагов». Если шума всё равно много, попросите по умолчанию молчать между вызовами инструментов
Она охотно делегирует субагентам
Opus 4.8 делала это неохотно
Уберите подталкивания «делегируй больше», написанные под 4.8. Явно ограничьте параллелизм, чтобы расходы не убежали
Она проверяет себя без напоминаний «Добавь шаг проверки в конце» и «пусть субагент всё перепроверит» теперь вызывают избыточные проверки — удалите их (Anthropic пишет об этом прямо)

Миграция — это вычитание, а не сложение. Куски промпта, которые вы дописывали, чтобы компенсировать слабости старой модели (заставить проверять, заставить делегировать, требовать отчёты о прогрессе), на Opus 5 превращаются в побочный эффект. Сначала уберите их, посмотрите на «сырое» поведение и верните только то, чего действительно не хватает.

10. Кому стоит переходить прямо сейчас

Переходить сразу
  • У вас долго работающие кодинг-агенты
  • Вы строите агентов для управления компьютером или автоматизации бизнес-процессов
  • Вы на Fable 5 и расходы ощутимы (почти та же производительность вдвое дешевле)
  • Вы всё ещё на Opus 4.8 (заметно лучше за те же деньги)
Сначала протестировать
  • Рутинные задачи, которые дёшево крутятся с выключенным мышлением и малым max_tokens
  • Последующие шаги пайплайна, зависящие от длины или стиля вывода
  • Промпты, набитые указаниями про проверку и делегирование
Можно не спешить
  • В основном генерация «одним патчем» (выигрыш небольшой, иногда проигрыш)
  • Вы завязаны на быстрый режим через Bedrock и подобные площадки
  • Наступательное тестирование безопасности или длительные биологические исследования (лидирует Mythos)

Шаги миграции (для тех, кто работает с API)

  1. Замените ID модели с claude-opus-4-8 на claude-opus-5
  2. Найдите все места, где мышление отключается (thinking: disabled); при effort xhigh или max это теперь ошибка 400, поэтому либо снижайте effort, либо возвращайте мышление
  3. Пересмотрите max_tokens везде, где вы не задаёте thinking (добавьте запас под токены мышления)
  4. Удалите из промптов подталкивания к проверке, к делегированию и требования отчётов о прогрессе
  5. Добавьте указание быть кратким, а затем пересчитайте расходы, измерив usage на реальном трафике
  6. Прогоните effort по значениям medium / high / xhigh и выберите оптимум на своём наборе тестов

Итоги

Claude Opus 5 — как раз тот релиз, которому пользователь может просто порадоваться: заметный скачок за ту же цену. Отрыв максимален в агентах, которые долго работают самостоятельно, и Anthropic строит аргументацию на стоимости одной задачи: уровень фронтира вдвое дешевле Fable 5.

При этом в API есть два изменения, которые нельзя игнорировать (мышление включено по умолчанию; отключить его можно только при effort high и ниже). А ключ к удачной миграции в том, что текст промпта нужно убирать, а не добавлять. Инструкции, написанные ради заплаток на слабые места старой модели, — именно то, что делает Opus 5 многословной и чрезмерно осторожной.

Наконец, помните: число в бенчмарке — всего лишь значение, измеренное на конкретной задаче. Opus 5 проигрывает GPT-5.6 Sol в DeepSWE, и есть области, где effort max не лучшая настройка. Перемерьте всё на своей нагрузке — в конечном счёте только это число что-то решает.

FAQ

В. Opus 5 дороже, чем Opus 4.8?

О. Цена за токен идентична ($5 за вход / $25 за выход на миллион токенов). Но поскольку мышление включено по умолчанию, выходных токенов может стать больше, поэтому фактический счёт способен вырасти. После миграции измерьте usage.

В. Что выбрать — Fable 5 или Opus 5?

О. По соотношению цены и результата — Opus 5: вдвое дешевле за токен и впереди во многих агентных бенчмарках. Для самых сложных рассуждений и длительных исследований Fable 5 по-прежнему лидирует. Схема выбора из нашего разбора Fable 5 против Opus переносится напрямую.

В. Можно ли пользоваться ею на бесплатном тарифе?

О. Opus 5 — модель по умолчанию на тарифе Max и старшая модель, доступная для выбора на Pro. Структура тарифов меняется, поэтому проверяйте актуальную доступность на странице цен Anthropic.

В. После перехода получаю ошибку 400.

О. Сначала проверьте, не отправляете ли вы thinking: {"type": "disabled"} вместе с effort xhigh или max. Opus 5 такую комбинацию отклоняет. Снизьте effort до high или ниже либо уберите параметр thinking (тогда вернётся значение по умолчанию — мышление включено).

В. Ответы слишком длинные. Поможет ли понижение effort?

О. Нет. Effort управляет в основном глубиной рассуждений и не даёт надёжного сокращения текста для пользователя. Правильное решение — явно попросить краткость в промпте.

Примечание: цифры в статье взяты из анонса Anthropic «Introducing Claude Opus 5», официальной документации «What's new in Claude Opus 5» и «Models overview», а также из публикаций the decoder и tech-ish (все от 24 июля 2026). Значения, помеченные 🟡, не приведены числами в официальном тексте и считаны журналистами с графиков, поэтому их достоверность ниже. Характеристики и цены могут меняться — всё, что для вас критично, сверяйте с официальной документацией.