Содержание
- 1. Opus 5 в трёх строках
- 2. Ключевые характеристики и где модель доступна
- 3. Цены: без изменений и вдвое дешевле Fable 5
- 4. Бенчмарки в подробностях
- 5. Где модель всё ещё проигрывает
- 6. Два ломающих изменения (мышление включено, лимиты на effort)
- 7. Как выбрать один из пяти уровней effort
- 8. Остальные новые возможности
- 9. Другой характер модели и правка промптов
- 10. Кому стоит переходить прямо сейчас
- Итоги
- FAQ
24 июля 2026 года Anthropic выпустила Claude Opus 5. Релиз состоялся примерно через два месяца после Opus 4.8, а номер версии перескочил через целое поколение — с 4.8 сразу на 5. В собственной документации Anthropic это названо качественным скачком, а не постепенным улучшением Opus 4.8.
Если коротко: цена не изменилась ($5 за вход / $25 за выход на миллион токенов), но в агентных бенчмарках модель догоняет или обходит флагманский Claude Fable 5, который стоит $10 / $50 — то есть Opus 5 делает ту же работу вдвое дешевле. С другой стороны, в API появились два ломающих изменения, и код, перенесённый без правок, может упереться в ошибку 400 или обрезанный ответ. В статье официальный анонс и документация сверены с несколькими публикациями в прессе, а производительность, цены и ловушки миграции разобраны с точки зрения практика.
Та же цена, заметный скачок
— формулировка самой Anthropic: уровень фронтира вдвое дешевле Fable 5
1. Opus 5 в трёх строках
Сильный рост в агентном кодинге, работе с компьютером и длительных задачах. В агентном терминальном бенчмарке Frontier-Bench v0.1, по данным Anthropic, результат более чем вдвое выше Opus 4.8 — и при меньшей стоимости одной задачи.
Без повышения. $5 за вход / $25 за выход на миллион токенов — ровно как у Opus 4.8 и ровно вдвое дешевле флагманского Fable 5 ($10 / $50).
Мышление теперь включено по умолчанию, а отключить его можно только при effort high и ниже. Всё, что работает с жёстко подобранным max_tokens, рискует оборваться на середине ответа.
Одной фразой: Opus 5 делает почти ту же работу, что и Fable 5, по цене Opus 4.8. Верно и обратное: когда нужен предельный уровень возможностей, у Fable 5 и Mythos 5 по-прежнему есть своя роль (см. раздел о проигрышах ниже).
2. Ключевые характеристики и где модель доступна
Начнём с цифр. Ниже основные характеристики по официальному списку моделей Anthropic.
| Параметр | Claude Opus 5 | Claude Opus 4.8 (предыдущая) | Claude Fable 5 (флагман) |
|---|---|---|---|
| ID модели в API | claude-opus-5 |
claude-opus-4-8 |
claude-fable-5 |
| Цена (вход / выход) | $5 / $25 | $5 / $25 | $10 / $50 |
| Окно контекста | 1M токенов (по умолчанию и максимум) | 1M токенов | 1M токенов |
| Максимум вывода | 128K токенов | 128K токенов | 128K токенов |
| Надёжная граница знаний | май 2026 | январь 2026 | январь 2026 |
| Мышление | Включено по умолчанию | Выключено по умолчанию (включается явно) | Всегда включено (отключить нельзя) |
| Уровни effort | low / medium / high / xhigh / max | low / medium / high / xhigh / max | low / medium / high / xhigh / max |
Источник: Anthropic, «Models overview» и «What's new in Claude Opus 5» (по состоянию на июль 2026)
Строка, которую обычно пролистывают, но которая заметна в ежедневной работе, — сдвиг границы знаний вперёд. Opus 4.8 и Fable 5 останавливаются на январе 2026, Opus 5 доходит до мая 2026. Это лишние несколько месяцев версий библиотек и свежих изменений в спецификациях, о которых модель знает без поиска. И всё же «сегодняшний день» ей по-прежнему неизвестен: никогда не позволяйте ей утверждать что-то о текущих событиях или новых ценах без веб-поиска.
Где её можно запускать
Claude API (claude-opus-5), Amazon Bedrock (anthropic.claude-opus-5), Google Cloud, Microsoft Foundry. Opus 4.8 остаётся доступной.
claude.ai, Claude Code и Claude Cowork. Это модель по умолчанию на тарифе Max и старшая модель, доступная для выбора на Pro.
Высокоскоростной вариант — исследовательское превью и работает только в Claude API. На Bedrock, Google Cloud и Microsoft Foundry его сегодня нет.
3. Цены: без изменений и вдвое дешевле Fable 5
Самый практичный факт этого релиза — возможности выросли, а цена осталась прежней. Документация Anthropic формулирует это прямо: «$5 за миллион входных токенов и $25 за миллион выходных, без изменений относительно Claude Opus 4.8».
Цена за миллион токенов (Claude API)
Источник: Anthropic, «What's new in Claude Opus 5» и «Pricing» (июль 2026). Тарифы кеша посчитаны по официальным множителям (запись 1.25x и 2x, чтение 0.1x)
Что действительно стоит усвоить: цена за токен и стоимость одной задачи — разные вещи. В материалах по Opus 5 Anthropic на первое место ставит графики стоимости задачи, а не цену за токен. Например, в бенчмарке работы с компьютером OSWorld 2.0 официальный анонс сообщает, что модель превосходит лучший результат Fable 5 примерно втрое дешевле. Вдвое меньшая цена за токен плюс меньше лишних шагов складываются в куда больший разрыв на практике.
Одна оговорка: раз мышление теперь включено по умолчанию, тот же самый промпт может дать больше выходных токенов и обойтись дороже. Если у вас что-то дёшево работало на Opus 4.8 с выключенным мышлением и вы просто поменяли ID модели, счёт может вырасти. После миграции обязательно измерьте usage на реальном трафике.
4. Бенчмарки в подробностях
Анонс Anthropic построен на графиках, а не на таблице чисел, поэтому в тексте страницы почти всё сказано относительно: «более чем вдвое», «в пределах 0.5%». Поэтому в статье сравнения, которые Anthropic формулирует своим текстом, отделены от цифр, которые одинаково приводят несколько изданий.
4-1. Сравнения, названные самой Anthropic
Агентная работа в терминале и кодинг. Модель обходит все протестированные и набирает более чем вдвое больше Opus 4.8 при меньшей стоимости задачи.
На effort max результат в пределах 0.5% от лучшего показателя Fable 5 — примерно вдвое дешевле.
Мера решения по-настоящему новых задач: здесь модель набирает втрое больше, чем занявшая второе место.
Работа с компьютером. Модель лидирует над конкурентами в каждой ценовой точке и превосходит лучший результат Fable 5 примерно втрое дешевле.
При равных затратах доля успешных прогонов примерно в 1.5 раза выше, чем у ближайшего преследователя. По словам Anthropic, даже её самый низкий уровень effort обходит лучший результат конкурирующих моделей.
Впереди Opus 4.8 во всех оценках, которые ведёт Anthropic, причём органическая химия выросла более чем на 10 пунктов (например, распознавание структур по спектральным данным).
4-2. Цифры из публикаций в прессе
Приведённые ниже числа взяты из the decoder (24 июля 2026) и tech-ish (тот же день) — оба издания считывали их с графиков Anthropic. В список попали только пункты, в которых оба источника совпадают. Учтите: в тексте официальной страницы эти цифры не приведены (помечены жёлтой точкой — «по данным прессы»).
| Бенчмарк | Opus 5 | Fable 5 | GPT-5.6 Sol | Opus 4.8 |
|---|---|---|---|---|
| Frontier-Bench v0.1 Агентная работа в терминале |
43.3% | 33.7% | 34.4% | около 21%🟡 |
| ARC-AGI-3 Решение новых задач |
30.2% | — | 7.8% | 1.5% |
| GDPval-AA v2 (Elo) Реальная интеллектуальная работа |
1,861 | 1,747 | 1,736 | 1,593 |
| OSWorld 2.0 Агенты, управляющие компьютером |
70.6% | 66.1% | — | — |
| DeepSWE v1.1 Агентный кодинг |
68.8% | 69.7% | 72.7% | — |
Картина довольно очевидная. Чем дольше модель работает самостоятельно, тем больше отрыв — терминал, управление компьютером, автоматизация бизнес-процессов, новые задачи. И наоборот: в кодинге «одним патчем» (DeepSWE) она проигрывает GPT-5.6 Sol. Ровно та же картина, которую мы разбирали в сравнении с GPT-5.6 Sol, повторяется этажом выше.
5. Где модель всё ещё проигрывает
Обзоры релизов обычно перечисляют только победы, поэтому сделаем наоборот. Ниже слабые места, которые Anthropic признаёт в анонсе сама, плюс цифры, на которые обратили внимание журналисты.
Разрыв с Mythos 5 в поиске уязвимостей сократился, но Anthropic прямо пишет, что модель сильно отстаёт в написании эксплойтов. Специализированная защитная модель — по-прежнему линейка Mythos.
Науки о жизни подтянулись по всем направлениям, но в документации отмечено, что модель всё ещё уступает Mythos 5 в длительных автономных биологических исследованиях.
В DeepSWE v1.1 у неё 68.8% против 72.7% у GPT-5.6 Sol. В Humanity's Last Exam по сути ничья: 56.3% против 56.5% у Fable 5 (по данным прессы).
the decoder указывает, что в Frontier-Bench и Coding Agent Index уровень max дал результат ниже, чем более низкие настройки. Больше потраченных денег не всегда означает больше пользы.
Что это значит на практике: ставить max по умолчанию — способ поднять счёт и опустить качество. Сама документация советует начинать с high или xhigh и пробовать спускаться до medium на собственном наборе тестов. Относитесь к effort как к настраиваемому параметру, а не к константе, которую задают один раз.
6. Два ломающих изменения (мышление включено, лимиты на effort)
Если вы обращаетесь к API напрямую, этот раздел пропускать нельзя. Два пункта, которые Anthropic перечисляет как «изменения поведения», способны сломать работающий код, перенесённый без правок.
Изменение 1: мышление включено по умолчанию
В Opus 4.8 отсутствие параметра thinking означало работу без мышления. В Opus 5 его отсутствие означает, что мышление включается — то же самое, что написать thinking: {"type": "adaptive"}.
# Тот же код, который на Opus 4.8 работал без мышления... client.messages.create( model="claude-opus-5", max_tokens=1024, # теперь это лимит на мышление и ответ вместе messages=[...], ) # На Opus 5 модель сначала думает, поэтому ответ может оборваться
max_tokens — это потолок для токенов мышления и текста ответа вместе. Всё, где max_tokens был подобран впритык под ожидаемую длину ответа, теперь потратит этот бюджет на мышление и окажется обрезанным. При миграции придётся выбрать: явно отключать мышление или давать max_tokens запас.
Изменение 2: отключить мышление можно только при effort high и ниже
И у самой возможности «выключить» теперь есть ограничение. Сочетание thinking: {"type": "disabled"} с effort xhigh или max возвращает ошибку 400. Проверка выполняется для каждого запроса, поэтому код, который повышает effort по ходу работы, ломается самым неприятным образом: сначала всё работает, а затем внезапно начинаются ошибки.
Мышление выключено + effort low/medium/high
Мышление выключено + effort xhigh/max
Оставить мышление включённым и понижать effort для контроля расходов
Anthropic идёт дальше и документирует, что именно ломается, если всё-таки работать с выключенным мышлением. В этом режиме Opus 5 иногда пишет вызовы инструментов обычным текстом — то есть инструмент не запускается, а ход выглядит успешным — и может «просачивать» внутренние XML-теги в вывод. Если вы строите агентов, безопаснее оставить мышление включённым и снизить effort.
7. Как выбрать один из пяти уровней effort
Opus 5 поддерживает все пять уровней — low / medium / high / xhigh / max, — и по умолчанию и в API, и в Claude Code стоит high. О настройке со стороны Claude Code читайте в нашем руководстве по параметру effort.
| Effort | Для чего подходит | Примечания |
|---|---|---|
| low / medium | Рутинная обработка, классификация, рабочие субагенты, участки, чувствительные к задержке | Именно здесь Anthropic подчёркивает: «Opus 5 остаётся сильной даже на низком effort». Стоит попробовать первым делом |
| high (по умолчанию) | Общие задачи, где нужен реальный интеллект | Безопасный выбор, если сомневаетесь. Точка баланса между качеством и ценой |
| xhigh | Рекомендованная стартовая точка для кодинга и агентных нагрузок | Дайте max_tokens хороший запас (начните примерно с 64K токенов) |
| max | Трудные задачи, где правильный ответ важнее счёта за API | Самое глубокое рассуждение, но не всегда лучший результат (см. раздел 5) |
8. Остальные новые возможности
Раньше изменение списка инструментов посреди диалога сбрасывало весь кеш промпта. Opus 5 позволяет добавлять и убирать инструменты, сохраняя кеш (бета-заголовок mid-conversation-tool-changes-2026-07-01). Для долго живущих агентов это прямая экономия.
Минимальная длина промпта для кеширования снижена с 1,024 до 512 токенов. Промпты, которые были слишком короткими для кеша на Opus 4.8, кешируются без единой правки в коде.
Если запрос отклонён фильтрами безопасности, вместо перечисления альтернативных моделей вручную можно автоматически применить рекомендованную Anthropic маршрутизацию (бета-заголовок server-side-fallback-2026-07-01).
Исследовательское превью: примерно в 2.5 раза быстрее вывод при цене в 2 раза выше. Только Claude API — на Bedrock, Google Cloud и Microsoft Foundry недоступен.
9. Другой характер модели и правка промптов
Скорее всего, вы заметите это раньше любых бенчмарков. Документация перечисляет четыре изменения поведения, которые видны без единой строчки правок в коде.
| Изменение | Что делать |
|---|---|
| Ответы и артефакты становятся длиннее Ответы пользователю, Markdown-файлы, которые она пишет |
Просите краткость явно. Понижение effort текст не укорачивает, так что добиваться этого нужно промптом |
| Она больше комментирует свою работу | Удалите старые подпорки вроде «подводи итоги каждые N шагов». Если шума всё равно много, попросите по умолчанию молчать между вызовами инструментов |
| Она охотно делегирует субагентам Opus 4.8 делала это неохотно |
Уберите подталкивания «делегируй больше», написанные под 4.8. Явно ограничьте параллелизм, чтобы расходы не убежали |
| Она проверяет себя без напоминаний | «Добавь шаг проверки в конце» и «пусть субагент всё перепроверит» теперь вызывают избыточные проверки — удалите их (Anthropic пишет об этом прямо) |
Миграция — это вычитание, а не сложение. Куски промпта, которые вы дописывали, чтобы компенсировать слабости старой модели (заставить проверять, заставить делегировать, требовать отчёты о прогрессе), на Opus 5 превращаются в побочный эффект. Сначала уберите их, посмотрите на «сырое» поведение и верните только то, чего действительно не хватает.
10. Кому стоит переходить прямо сейчас
- У вас долго работающие кодинг-агенты
- Вы строите агентов для управления компьютером или автоматизации бизнес-процессов
- Вы на Fable 5 и расходы ощутимы (почти та же производительность вдвое дешевле)
- Вы всё ещё на Opus 4.8 (заметно лучше за те же деньги)
- Рутинные задачи, которые дёшево крутятся с выключенным мышлением и малым
max_tokens - Последующие шаги пайплайна, зависящие от длины или стиля вывода
- Промпты, набитые указаниями про проверку и делегирование
- В основном генерация «одним патчем» (выигрыш небольшой, иногда проигрыш)
- Вы завязаны на быстрый режим через Bedrock и подобные площадки
- Наступательное тестирование безопасности или длительные биологические исследования (лидирует Mythos)
Шаги миграции (для тех, кто работает с API)
- Замените ID модели с
claude-opus-4-8наclaude-opus-5 - Найдите все места, где мышление отключается (
thinking: disabled); при effort xhigh или max это теперь ошибка 400, поэтому либо снижайте effort, либо возвращайте мышление - Пересмотрите
max_tokensвезде, где вы не задаётеthinking(добавьте запас под токены мышления) - Удалите из промптов подталкивания к проверке, к делегированию и требования отчётов о прогрессе
- Добавьте указание быть кратким, а затем пересчитайте расходы, измерив
usageна реальном трафике - Прогоните effort по значениям
medium/high/xhighи выберите оптимум на своём наборе тестов
Итоги
Claude Opus 5 — как раз тот релиз, которому пользователь может просто порадоваться: заметный скачок за ту же цену. Отрыв максимален в агентах, которые долго работают самостоятельно, и Anthropic строит аргументацию на стоимости одной задачи: уровень фронтира вдвое дешевле Fable 5.
При этом в API есть два изменения, которые нельзя игнорировать (мышление включено по умолчанию; отключить его можно только при effort high и ниже). А ключ к удачной миграции в том, что текст промпта нужно убирать, а не добавлять. Инструкции, написанные ради заплаток на слабые места старой модели, — именно то, что делает Opus 5 многословной и чрезмерно осторожной.
Наконец, помните: число в бенчмарке — всего лишь значение, измеренное на конкретной задаче. Opus 5 проигрывает GPT-5.6 Sol в DeepSWE, и есть области, где effort max не лучшая настройка. Перемерьте всё на своей нагрузке — в конечном счёте только это число что-то решает.
FAQ
В. Opus 5 дороже, чем Opus 4.8?
О. Цена за токен идентична ($5 за вход / $25 за выход на миллион токенов). Но поскольку мышление включено по умолчанию, выходных токенов может стать больше, поэтому фактический счёт способен вырасти. После миграции измерьте usage.
В. Что выбрать — Fable 5 или Opus 5?
О. По соотношению цены и результата — Opus 5: вдвое дешевле за токен и впереди во многих агентных бенчмарках. Для самых сложных рассуждений и длительных исследований Fable 5 по-прежнему лидирует. Схема выбора из нашего разбора Fable 5 против Opus переносится напрямую.
В. Можно ли пользоваться ею на бесплатном тарифе?
О. Opus 5 — модель по умолчанию на тарифе Max и старшая модель, доступная для выбора на Pro. Структура тарифов меняется, поэтому проверяйте актуальную доступность на странице цен Anthropic.
В. После перехода получаю ошибку 400.
О. Сначала проверьте, не отправляете ли вы thinking: {"type": "disabled"} вместе с effort xhigh или max. Opus 5 такую комбинацию отклоняет. Снизьте effort до high или ниже либо уберите параметр thinking (тогда вернётся значение по умолчанию — мышление включено).
В. Ответы слишком длинные. Поможет ли понижение effort?
О. Нет. Effort управляет в основном глубиной рассуждений и не даёт надёжного сокращения текста для пользователя. Правильное решение — явно попросить краткость в промпте.
Примечание: цифры в статье взяты из анонса Anthropic «Introducing Claude Opus 5», официальной документации «What's new in Claude Opus 5» и «Models overview», а также из публикаций the decoder и tech-ish (все от 24 июля 2026). Значения, помеченные 🟡, не приведены числами в официальном тексте и считаны журналистами с графиков, поэтому их достоверность ниже. Характеристики и цены могут меняться — всё, что для вас критично, сверяйте с официальной документацией.