28 сентября 2026 года Anthropic выпустила Claude Sonnet 5.5. Согласно анонсу, это «вторая модель семейства Claude 5.5» после вышедшей шестью днями раньше Opus 5.5, а предыдущая Sonnet 5 (выпущена 30 июня 2026 года) переведена в Legacy (устаревшие модели, которые по-прежнему доступны). В официальном списке моделей она описана как «модель с лучшим сочетанием скорости и интеллекта».

Сначала вывод. Цена в точности такая же, как у Sonnet 5 (за миллион токенов: ввод $2, вывод $10, чтение из кэша $0.20), а в сравнительной таблице Anthropic она по большинству строк заметно опережает Sonnet 5. Зато работа с API изменилась: есть 5 изменений, из-за которых код, работавший на Sonnet 5, получает ошибку 400. Главное — отключить рассуждения через thinking: {"type": "disabled"} больше нельзя, а заменяющее его between_tools принимается только при effort не выше high. В этой статье мы сверяем официальную документацию и анонс в оригинале и в практическом порядке разбираем, что изменилось, что ломается при миграции и как выбирать между этой моделью и Opus 5.5.

Информация на 29 сентября 2026 года: статья написана на следующий день после выхода по оригинальным текстам официальной документации Claude Platform (Models overview, страница Sonnet 5.5, What's new, руководство по миграции, Pricing, Thinking, Effort, Prompt caching), анонса Anthropic, документации и CHANGELOG Claude Code, а также changelog GitHub. Claude Haiku 5.5, выход которой анонс обещает «в течение нескольких недель», на этот момент ещё не выпущена.

CLAUDE SONNET 5.5 — 2026.09.28

Цена прежняя, 5 несовместимых изменений

— Официально: «модель с лучшим сочетанием скорости и интеллекта»

ID модели
claude-sonnet-5-5
Без суффикса с датой (официальный список моделей)
Цена (за миллион токенов)
$2 / $10
Как у Sonnet 5 (официальная страница цен)
effort по умолчанию
high в API
medium в Claude Code и приложениях (официальная документация и анонс)
Внимание
5 несовместимых изменений
Официально перечислены как breaking changes
Источник: официальный анонс Anthropic и документация Claude Platform (28 сентября 2026 года)

1. Sonnet 5.5 коротко: производительность, цена, подводные камни миграции

① Производительность

В сравнительной таблице Anthropic она опережает Sonnet 5 во всех строках, а в GDPval-AA отстаёт от Opus 5.5 всего на 2 балла. Однако сам анонс пишет: «в сложной работе без заранее известного ответа Opus 5.5 остаётся явно сильнее».

② Цена

Все тарифы совпадают с Sonnet 5. Изменилась минимальная длина, которую можно закэшировать: она снизилась с 1024 до 512 токенов. Анонс говорит «до 30% дешевле в расчёте на задачу», но это собственные измерения Anthropic.

③ Подводные камни миграции

Пять изменений: отключение рассуждений теперь через between_tools / принудительный вызов инструмента даёт 400 / блоки рассуждений привязаны к модели и разговору / старый инструмент computer use не принимается / часть комбинаций advisor запрещена. Кроме того, текст между вызовами инструментов возвращается в блоках thinking.

Если одной фразой, Sonnet 5.5 — это «Sonnet, поднявшаяся на ступень при той же цене, с которой работают почти по тем же правилам, что и с Opus 5.5». Три из пяти несовместимых изменений (принудительный вызов инструмента, привязка блоков рассуждений и старый инструмент computer use) есть и у Opus 5.5, и у Fable 5.1. Особенностей только Sonnet 5.5 две: способ отключить рассуждения сохранился в виде отдельного значения between_tools, и появились ограничения на комбинации с инструментом advisor.

2. Основные характеристики и где доступна

Для сравнения взяты три модели: заменяемая Sonnet 5, старшая Opus 5.5 и младшая Haiku 4.5.

Параметр Sonnet 5.5 Sonnet 5 (Legacy) Opus 5.5 Haiku 4.5
ID модели в API claude-sonnet-5-5 claude-sonnet-5 claude-opus-5-5 claude-haiku-4-5-20251001
Цена (ввод/вывод) $2 / $10 $2 / $10 $4 / $20 $1 / $5
Контекст / макс. вывод 1 млн / 128 тыс. 1 млн / 128 тыс. 1 млн / 128 тыс. 200 тыс. / 64 тыс.
Рассуждения (thinking) Адаптивные по умолчанию (минимум — between_tools) Адаптивные по умолчанию (отключаются через disabled) Адаптивные, всегда включены (не отключаются) Расширенные (с бюджетом)
effort по умолчанию в API high high medium Не поддерживается
Надёжная граница знаний Июнь 2026 года Январь 2026 года Июнь 2026 года Февраль 2025 года
Минимальная длина для кэша 512 токенов 1024 токена 512 токенов 4096 токенов
Скорость (официальная относительная оценка) Быстрая — Средняя Самая быстрая
Прекращение поддержки Не раньше 28 сентября 2027 года Не раньше 30 июня 2027 года Не раньше 22 сентября 2027 года Не раньше 15 октября 2026 года

Источники: Anthropic, «Models overview», «Claude Sonnet 5.5», «Claude Sonnet 5», «Prompt caching» (проверено 29 сентября 2026 года). Скорость — относительная оценка внутри текущей линейки, для Sonnet 5 из Legacy она не указана. Даты прекращения поддержки — обязательства для платформ, которыми управляет Anthropic; Amazon Bedrock и Google Cloud устанавливают их сами.

От Sonnet 5 в таблице отличаются только три строки: «рассуждения», «граница знаний» и «минимальная длина для кэша». Контекст, максимальный вывод и effort по умолчанию в API те же, токенизатор тоже как у Sonnet 5, так что один и тот же текст даёт одинаковое число токенов (What's new). В Message Batches API с бета-заголовком output-300k-2026-03-24 лимит вывода расширяется до 300 тыс. токенов (как у Sonnet 5). Кстати, если передать в temperature, top_p или top_k значение, отличное от значения по умолчанию, вернётся 400. Так было и у Sonnet 5, поэтому это касается только тех, кто переходит напрямую с Sonnet 4.6 или более ранних.

Где доступна

API / облака

Claude API (claude-sonnet-5-5), Amazon Bedrock (anthropic.claude-sonnet-5-5), Claude Platform on AWS, Google Cloud, Microsoft Foundry. В день выхода модель появилась на всех платформах.

Приложения / инструменты разработчика

claude.ai и приложения Claude (Anthropic опубликовала системный промпт для Sonnet 5.5), Claude Code (v2.1.284 и новее), GitHub Copilot (Pro, Pro+, Max, Business, Enterprise).

Чего нет

fast mode (ускоренный вариант) на странице цен предусмотрен только для Opus 5.5, Opus 5 и Opus 4.8 — у Sonnet 5.5 его нет. В Bedrock для Sonnet 5.5 недоступны структурированные выводы (включая strict tool use) (руководство по миграции).

3. Цена: как у Sonnet 5, меняется только нижний порог кэша

Официальная страница What's new пишет: «та же цена, что у Sonnet 5, и такие же цены на кэширование промптов и пакетную обработку». Подробные тарифы — ниже.

За миллион токенов Sonnet 5.5 Sonnet 5 Opus 5.5 Haiku 4.5
Ввод $2 $2 $4 $1
Вывод $10 $10 $20 $5
Запись в кэш (5 минут) $2.50 $2.50 $5 $1.25
Запись в кэш (1 час) $4 $4 $8 $2
Чтение из кэша $0.20 $0.20 $0.20 $0.10
Batch API (ввод/вывод) $1 / $5 $1 / $5 $2 / $10 $0.50 / $2.50

Источник: Anthropic, «Pricing» (проверено 29 сентября 2026 года). Batch API — скидка 50% от обычной цены и на ввод, и на вывод.

Две вещи, которые меняются при «той же цене»

Одинаковые тарифы ещё не означают одинаковый счёт. Есть два фактора, которые могут его изменить.

Первый — минимальная длина, которую можно закэшировать. У Sonnet 5 промпты короче 1024 токенов не кэшировались даже с cache_control. У Sonnet 5.5 этот порог снизился до 512 токенов. Например, задача, которая каждый раз отправляет системный промпт и определения инструментов на 800 токенов, на Sonnet 5 под кэширование не попадала, а на Sonnet 5.5 кэшируется. Сработал ли кэш, видно по usage в ответе: если и cache_creation_input_tokens, и cache_read_input_tokens равны 0, ничего не закэшировано (официальная страница Prompt caching). Если порог не достигнут, ошибки не будет, поэтому при миграции стоит заодно поискать задачи, где кэш молча не срабатывал.

Второй — число токенов на задачу. Анонс пишет, что для той же работы нужно гораздо меньше токенов, что в тестах Anthropic это «до 30% дешевле в расчёте на задачу» и что вывод генерируется «более чем на 30% быстрее, чем у Sonnet 5». Это собственные измерения Anthropic. С другой стороны, официальная документация сообщает, что уровни effort «откалиброваны заново», поэтому на том же уровне модель не обязательно рассуждает столько же, сколько Sonnet 5. Токены рассуждений оплачиваются как выходные, даже если их не показывают. После миграции остаётся лишь замерить usage и сравнить на собственных задачах.

Расчёт: одна задача с 10 млн токенов чтения из кэша, 500 тыс. токенов ввода и 300 тыс. токенов вывода (число токенов — допущение этой статьи; стоимость записи не учитывается)

  • Sonnet 5.5: $2.00 + $1.00 + $3.00 = $6.00 (у Sonnet 5 так же)
  • Opus 5.5: $2.00 + $2.00 + $6.00 = $10.00 (примерно в 1.7 раза дороже Sonnet 5.5, а не в 2 раза)
  • Haiku 4.5: $1.00 + $0.50 + $1.50 = $3.00 (ровно половина от Sonnet 5.5)

Это сравнение тарифов при одинаковом числе токенов; на деле каждая модель расходует разное количество токенов. Тарифы — по Anthropic, «Pricing».

Разница с Opus 5.5 не доходит до «двух раз», потому что чтение из кэша у Opus 5.5 стоит те же $0.20. Чем больше доля кэша в агентной работе, тем меньше экономия от выбора Sonnet 5.5. Цены на все модели Claude собраны в сравнении цен Opus, Sonnet и Haiku.

4. Бенчмарки: читаем их в рамках таблицы Anthropic

В сравнительной таблице анонса четыре столбца: Sonnet 5.5, Sonnet 5, Opus 5.5 и GPT-6 Sol. Сначала — условия таблицы.

  • Таблица взята из анонса Anthropic, и большинство строк — измерения самой Anthropic. Исключение — GDPval-AA v2.1 и AA-Briefcase v1.1, которые провела Artificial Analysis (примечание 3 к таблице).
  • Эти измерения Artificial Analysis проводились в среде до выпуска, где была ошибка, способная ухудшать ответы на запросы со структурированными выводами. Anthropic отмечает, что «влияние, если оно было, невелико и занижает результаты», и что ошибка исправлена.
  • Результат Opus 5.5 в Terminal-Bench 4.0 получен на xhigh и является лучшим результатом Opus 5.5 (примечание 1). Для Sonnet 5.5 в FrontierCode приведены два значения: 46.2% на max и 52.1% на xhigh (примечание 2).
  • К результатам GPT-6 Sol в GDPval-AA, AA-Briefcase и Chartography есть примечание: возможно, это значения до того, как OpenAI исправила ошибку в понимании изображений (примечание 4).
Бенчмарк Sonnet 5.5 Sonnet 5 Opus 5.5 GPT-6 Sol
Terminal-Bench 4.0
Агентное программирование в терминале
70.6% 10.3% 66.4% (xhigh) —
FrontierCode 1.1 (Main)
Примут ли изменения в основную ветку
52.1% (xhigh)
46.2% (max)
42.4% 54.4% 49.3%
CursorBench 4.0
Нечётко поставленные задачи на несколько файлов
55.5% 34.1% 57.8% —
GDPval-AA v2.1 (Elo)
Реальная работа в 44 профессиях (проводила Artificial Analysis)
1844 1449 1846 1487
AA-Briefcase v1.1 (Elo)
Длительная интеллектуальная работа (проводила Artificial Analysis)
1811 1359 1822 1483
Humanity's Last Exam
Междисциплинарные рассуждения (с инструментами)
64.5% 54.9% 67.7% —
OSWorld 2.1
Управление компьютером (в таблице пометка «partial»)
80.1% 57.0% 81.8% —
Chartography
Чтение графиков (без инструментов)
61.6% 15.6% 64.4% 53.6%

Источник: сравнительная таблица и примечания в анонсе Anthropic «Introducing Claude Sonnet 5.5» (28 сентября 2026 года, проверено 29 сентября). Жирным выделено лучшее значение в строке; «—» — значения в таблице нет. Подробности методики — в системной карточке Sonnet 5.5, на которую ссылается тот же анонс.

Из таблицы можно вынести три вывода.

  • Рост по сравнению с Sonnet 5 большой. Terminal-Bench 4.0 вырос с 10.3% до 70.6%, Chartography (без инструментов) — с 15.6% до 61.6%: в пределах одной таблицы это рост в разы. В GDPval-AA прибавка около 400 баллов.
  • Разница с Opus 5.5 в большинстве строк — в пределах нескольких пунктов. В GDPval-AA — 2 балла, в CursorBench — 2.3 пункта, в OSWorld 2.1 — 1.7 пункта. В Terminal-Bench 4.0 Sonnet 5.5 превосходит лучший результат Opus 5.5 (66.4% на xhigh).
  • И всё же Anthropic ставит Opus 5.5 выше. Анонс пишет: «бенчмарки отражают лишь одну сторону возможностей. И во внутренних тестах, и у внешних тестировщиков в сложной работе без заранее известного ответа, требующей длительного суждения, Opus 5.5 остаётся явно сильнее».

Стоимость по уровням effort: по подписям к графикам анонса

В анонсе есть и графики, где для каждого уровня effort сопоставлены результат и стоимость одной задачи. Вот что сказано в подписях к ним.

Terminal-Bench 4.0

На medium, уровне по умолчанию в приложениях Claude, модель намного превосходит лучший результат Sonnet 5 при стоимости задачи менее одной десятой.

FrontierCode 1.1

На high, уровне по умолчанию в Claude Platform, модель сравнивается с лучшим результатом GPT-6 Sol при стоимости задачи примерно в одну пятую. По сравнению с Sonnet 5 на том же high — на 10 пунктов выше при стоимости примерно в одну пятнадцатую.

CursorBench 4.0

На самом низком уровне, low, модель превосходит лучший результат Sonnet 5 при стоимости задачи менее одной десятой.

AA-Briefcase v1.1

На medium модель превосходит лучший результат Sonnet 5 при стоимости задачи примерно в одну девятую.

Источник: подписи к графикам в анонсе Anthropic «Introducing Claude Sonnet 5.5». На графиках Terminal-Bench и CursorBench показана GPT-5.6 Sol, поскольку результаты GPT-6 Sol не опубликованы (примечание на той же странице).

Здесь стоит обратить внимание на два значения FrontierCode. У Sonnet 5.5 результат на max (46.2%) ниже, чем на xhigh (52.1%). Согласно примечанию в анонсе Anthropic, на max модель чаще запускала навык ревью кода Claude Code и дробила работу между множеством субагентов, что в ряде случаев приводило к превышению лимита времени и правкам за пределами задачи. Повышение effort не всегда улучшает результат, поэтому уровень лучше выбирать, сравнивая на собственной работе (раздел 7). Цифры GPT-6 Sol разобраны в обзоре выхода GPT-6 Sol и Luna.

Не смешивайте с таблицей из анонса Opus 5.5: даже для одной и той же Opus 5.5 в Chartography в анонсе Opus 5.5 указано 89.0% «с инструментами», а в этой таблице — 64.4% «без инструментов», то есть при разных условиях. Если взять цифры из двух анонсов и поставить рядом, вы будете сравнивать значения, полученные в разных условиях. Сравнивайте только столбцы внутри одной таблицы.

5. 5 несовместимых изменений, из-за которых код от Sonnet 5 получает ошибку 400, и как их исправить

Официальная страница What's new in Claude Sonnet 5.5 перечисляет 5 несовместимых изменений (breaking changes), затрагивающих код, который работает на Sonnet 5. Во всех случаях возвращается ошибка 400 invalid_request_error.

① Чтобы отключить рассуждения, используйте between_tools, а не disabled

У Sonnet 5 thinking: {"type": "disabled"} отключал рассуждения при любом effort. У Sonnet 5.5 disabled даёт 400 с таким сообщением.

"thinking.type.disabled" is not supported for this model. Use "thinking.type.between_tools" for the lowest thinking setting, or "thinking.type.adaptive" and "output_config.effort" to control thinking behavior.

Вместо него используется thinking: {"type": "between_tools"} — самая низкая настройка рассуждений у этой модели, которая отключает «предварительные рассуждения», когда модель сначала обдумывает всё перед ответом. Для запросов без инструментов ответ, как и с disabled у Sonnet 5, содержит только текст. Бета-заголовок не нужен, работает на всех платформах, где есть Sonnet 5.5. Но если просто заменить им disabled, можно споткнуться на трёх вещах.

  • При effort xhigh и max возвращается 400. between_tools принимается только на low, medium и high. Для задач, которые на Sonnet 5 работали в режиме «xhigh + рассуждения выключены», придётся либо снизить effort до high или ниже, либо перестать отключать рассуждения.
  • Нельзя передавать вместе с ним другие поля. Если отправить display, budget_tokens или block_binding вместе с between_tools, вернётся 400.
  • Нельзя менять effort посреди разговора. Если через effort для отдельного сообщения (бета) передать другой уровень, вернётся 400. Чтобы менять уровень от хода к ходу, используйте адаптивные рассуждения (опустите thinking или передайте {"type": "adaptive"}).

Ниже — пример «до и после» из руководства по миграции на Python. Обратите внимание: в примере «до» стоит xhigh, поэтому в примере «после» он понижен до high.

# До: работает на Sonnet 5, на Sonnet 5.5 возвращает 400
client.messages.create(
    model="claude-sonnet-5",
    max_tokens=16000,
    thinking={"type": "disabled"},
    output_config={"effort": "xhigh"},
    messages=[{"role": "user", "content": "..."}],
)

# После: отключаем предварительные рассуждения; effort не выше high
client.messages.create(
    model="claude-sonnet-5-5",
    max_tokens=16000,
    thinking={"type": "between_tools"},
    output_config={"effort": "high"},
    messages=[{"role": "user", "content": "..."}],
)

Даже с between_tools короткие заметки о ходе работы, которые модель пишет между вызовами инструментов, возвращаются в блоках thinking с текстом-сводкой. Не выбрасывайте их, а отправляйте обратно без изменений вместе с остальной частью хода ассистента. Из отправленных обратно блоков модель получает полный текст своих заметок (What's new). Ручной бюджет {"type": "enabled", "budget_tokens": N}, как и у Sonnet 5, по-прежнему даёт 400.

② Принудительный вызов инструмента даёт ошибку

Если задать tool_choice как {"type": "any"} или {"type": "tool", "name": "..."}, вернётся 400. API подсчёта токенов проверяет то же самое. Разрешены только auto (по умолчанию) и none.

tool_choice: type "tool" and "any" are not supported for this model.

Что делать: оставьте tool_choice равным auto и добавьте к определениям инструментов strict: true (strict tool use) или перенесите схему в структурированные выводы. При auto модель может ответить текстом, не вызвав инструмент, поэтому напишите в промпте, «в каких случаях использовать этот инструмент». strict tool use принимает лишь часть JSON Schema, и каждому object в схеме нужен additionalProperties: false. За один запрос строгими можно сделать не больше 20 инструментов, а для наборов инструментов MCP, computer use и browser use strict задать нельзя.

# До: работает на Sonnet 5, на Sonnet 5.5 возвращает 400
client.messages.create(
    model="claude-sonnet-5",
    max_tokens=1024,
    tools=tools,
    tool_choice={"type": "tool", "name": "get_weather"},
    messages=[{"role": "user", "content": "What's the weather in Paris?"}],
)

# После: auto + strict; когда использовать инструмент, говорим текстом
client.messages.create(
    model="claude-sonnet-5-5",
    max_tokens=1024,
    tools=[{**tool, "strict": True} for tool in tools],
    tool_choice={"type": "auto"},
    messages=[{"role": "user",
               "content": "What's the weather in Paris? Use the get_weather tool."}],
)

В Amazon Bedrock ситуация другая. Для Sonnet 5.5 в Bedrock структурированные выводы (включая strict tool use) недоступны, поэтому отправляйте auto без strict, пишите в промпте, когда вызывать инструмент, а входные данные инструмента проверяйте в своём коде (руководство по миграции).

③ Блоки рассуждений привязаны к модели и разговору

В блоке thinking записано, какая модель его создала. Sonnet 5.5 может читать блоки рассуждений Sonnet 5, Opus 4.8, Haiku 4.5 и более ранних моделей, но не Opus 5, Opus 5.5, Fable или Mythos. И ни одна другая модель не может читать блоки рассуждений Sonnet 5.5.

  • Переход с Sonnet 5 на Sonnet 5.5 сохраняет предыдущие рассуждения.
  • Переход с Sonnet 5.5 на любую другую модель означает, что ходы после переключения идут без рассуждений Sonnet 5.5. Сам запрос проходит успешно, а отброшенные блоки не оплачиваются.

Блоки рассуждений Opus 5.5 могут читать Fable 5.1 и Mythos 5.1, а блоки Sonnet 5.5 не может читать никто. Если у вас настроена маршрутизация «только трудные части поднимать с Sonnet 5.5 на Opus 5.5», проверяйте её с расчётом на то, что у модели, на которую вы поднимаете задачу, рассуждения Sonnet 5.5 пропадут.

Есть и ещё одна проверка: не изменилось ли то, что стоит перед блоком рассуждений Sonnet 5.5 (system, tools и более ранние сообщения), после создания блока. Для аккаунтов, созданных 31 августа 2026 года в 0:00 (UTC) или позже, это по умолчанию принудительно проверяется в Claude API, Amazon Bedrock и Google Cloud, и если отправить блок вместе с историей, переписанной по ходу, вернётся 400.

Что делать: ведите разговор только дописыванием. Если нужно изменить инструкции или инструменты, не переписывайте историю, а используйте системное сообщение посреди разговора (новая возможность Sonnet 5.5, которой у Sonnet 5 нет). Если без переписывания не обойтись, добавьте бета-заголовок thinking-binding-controls-2026-08-01 и задайте thinking.block_binding.prefix_mismatch_behavior равным "drop_block" — тогда вместо ошибки соответствующие блоки будут отброшены. Но block_binding работает только с адаптивными рассуждениями, поэтому с between_tools либо только дописывайте, либо сами удаляйте блоки thinking начиная с переписанного хода.

④ В Claude API и Google Cloud старый инструмент computer use не принимается

Sonnet 5 принимала управление компьютером (computer use) и через старый инструмент computer_20251124 с бета-заголовком. Sonnet 5.5 в Claude API и Google Cloud принимает только набор инструментов computer_toolset_20260801, а объявление старого инструмента даёт 400. В Claude API сообщение начинается так.

'claude-sonnet-5-5' does not support tool types: computer_20251124.

Что делать: уберите бета-заголовок, замените tools на [{"type": "computer_toolset_20260801"}] и переделайте цикл агента под формат набора инструментов (блоки tool_use для отдельных членов набора, несколько действий за раз, toolset_name в результатах). Если вы отправляете бета-заголовок fine-grained-tool-streaming-2025-05-14, уберите его: вместе с набором инструментов он даёт 400, поэтому добавьте eager_input_streaming: true к каждому инструменту, которому это нужно. В Amazon Bedrock старый инструмент работает как прежде, менять ничего не нужно.

⑤ Некоторые комбинации с инструментом advisor запрещены

Инструмент advisor (бета) позволяет модели-исполнителю обращаться за советом к более сильной модели. Когда исполнитель — Sonnet 5.5, указание в качестве советника Opus 4.8, Opus 4.7, Opus 4.6, Sonnet 5 или Sonnet 4.6 даёт 400. Допустимы Opus 5, Opus 5.5, Sonnet 5.5, Fable 5, Fable 5.1, Mythos 5 и Mythos 5.1.

Кроме того, любой советник, которого принимает Sonnet 5.5, возвращает совет в зашифрованном блоке advisor_redacted_result, так что на стороне клиента текст совета прочитать нельзя. Если вы записывали советы в журнал или показывали их на экране, это придётся переделать. Дешёвые связки вроде «Sonnet 5 — исполнитель, Opus 4.8 — советник» на Sonnet 5.5 в прежнем виде не работают.

6. Что меняется без ошибок

Пять несовместимых изменений дают 400, так что их вы заметите. Хуже то, что меняет только поведение, не вызывая ошибок.

Изменение Что происходит / что делать
Текст между вызовами инструментов попадает в блоки thinking Заметки длиннее одного-двух предложений вроде «Сейчас проверю X», которые у Sonnet 5 были блоками text, теперь возвращаются в блоках thinking для отображения хода работы (короткая фраза остаётся в text). При значении по умолчанию display: "omitted" их содержимое пустое, поэтому интерфейс, который транслировал пользователям ход работы, замолкает на время вызовов инструментов. С адаптивными рассуждениями задайте display равным "updates" (бета, заголовок thinking-display-updates-2026-08-18) или "summarized" и показывайте непустые блоки thinking перед следующим за ними tool_use. С between_tools текст возвращается без настройки.
Уровни effort откалиброваны заново На том же уровне модель не обязательно рассуждает столько же, сколько Sonnet 5. Официальная рекомендация — «не переносить настройки, а заново подобрать effort» (раздел 7).
Категорий отказа стало пять cyber, bio, frontier_llm, reasoning_extraction, general_harms. При отказе возвращается HTTP 200 со stop_reason: "refusal", поэтому читайте stop_details и обрабатывайте его. Резервное переключение на стороне сервера (fallbacks: "default", бета, только Claude API) повторяет на Sonnet 5 только cyber и frontier_llm.
Блоки рассуждений привязаны к аккаунту, который их создал Блоки рассуждений Sonnet 5.5 можно использовать только в создавшем их аккаунте или в связанных с ним. При отправке из другого аккаунта блоки отбрасываются, а запрос проходит успешно. Анонс уточняет: «в том числе при переключении аккаунта посреди сессии в Claude Code».
Нижний порог кэша снизился Промпты длиной от 512 до 1023 токенов теперь кэшируются. Появляется плата за запись (для 5 минут — 1.25 от цены ввода), зато со второго раза платится только цена чтения (раздел 3).

Источники: What's new in Claude Sonnet 5.5, Migrating to Claude Sonnet 5.5, анонс Anthropic

Анонс описывает изменения и в защитных мерах. Sonnet 5.5 — первая Sonnet, выпущенная с защитными мерами в области кибербезопасности и резервным переключением, поскольку её возможности, применимые для кибератак, достигли уровня Opus 5; высокорисковая работа по кибербезопасности заметно для пользователя переключается на Sonnet 5. Поиск и исправление ошибок в обычной разработке это не затрагивает. Защитные меры в области биологии такие же, как у Sonnet 5.

С другой стороны, есть и новые возможности. Effort для отдельного сообщения (бета; позволяет менять уровень, сохраняя кэш промпта), системные сообщения посреди разговора и изменение инструментов посреди разговора (бета) — всего этого у Sonnet 5 не было. Кроме того, в What's new указаны сжатие, которое по запросу подытоживает разговор в любой момент (бета, заголовок compact-2026-09-04), и определение инструментов внутри сообщений (бета, заголовок inline-tools-2026-09-15).

7. effort по умолчанию: high в API, medium в Claude Code

У Opus 5.5 effort по умолчанию снизился до medium даже в API, но у Sonnet 5.5 в API по умолчанию остаётся high. При этом анонс пишет: «в Claude Code и приложениях по умолчанию установлен medium». У одной и той же Sonnet 5.5 глубина рассуждений без явных настроек в API и в Claude Code различается на один уровень.

Официальная страница об effort рекомендует такие отправные точки для Sonnet 5.5.

Тип работы Начальный уровень (официальная рекомендация) Примечание
Обычная работа (кроме двух случаев ниже) high Совпадает со значением по умолчанию в API
Агентное программирование, многошаговое использование инструментов Начинать с medium Для чётко поставленных задач — medium, для трудных и длинных — high
Работа, чувствительная к задержкам, например чат medium или low Приоритет — скорость
xhigh и max Только если оценки показывают рост качества Нельзя сочетать с between_tools

Источники: раздел «Recommended effort levels for Claude Sonnet 5.5» на странице Anthropic, «Effort», руководство по миграции

Та же страница рекомендует задавать max_tokens с запасом и на рассуждения, и на ответ, а в агентном программировании — ставить max_tokens на предел этой модели, 128 000, и получать ответ потоково. Токены рассуждений учитываются в max_tokens, даже если содержимое рассуждений не возвращается. Как устроен сам effort, подробно описано в разборе настройки effort, а адаптивные рассуждения — в статье об отличиях адаптивных рассуждений от расширенных.

8. Как выбирать между Sonnet 5.5, Opus 5.5 и Haiku

Официальный список моделей по-прежнему советует «если сомневаетесь, начните с Opus 5.5» — отправной точкой Sonnet 5.5 не стала. При этом анонс разграничивает сильные стороны: Sonnet 5.5 — «чётко очерченная повседневная работа, исправление ошибок, создание документов, слайдов и таблиц», Opus 5.5 — «сложная работа, требующая взвешенных суждений». Кроме того, там сказано: «Sonnet 5.5 лучше всего дополняет Opus 5.5 при более низком effort. На высоких уровнях они могут выйти на сопоставимую производительность при сопоставимой стоимости». Иначе говоря, если вы работаете на xhigh или max, выбор Sonnet 5.5 почти не даёт выигрыша в стоимости.

Выбирайте Sonnet 5.5
  • Нужно быстро делать чётко поставленную реализацию и исправлять ошибки на уровнях от low до high.
  • Вы много создаёте документов, слайдов и таблиц.
  • Хотите отключить предварительные рассуждения и сократить ожидание (between_tools).
  • Вы сейчас используете Sonnet 5 (замена по той же цене).
Выбирайте Opus 5.5
  • Проектирование или исследование без заранее известного ответа требует длительных суждений.
  • Не можете решить, какую выбрать (официальная отправная точка).
  • Планируете работать на высоком effort, где разница в стоимости с Sonnet 5.5 сокращается.
  • Нужен fast mode (только у Opus).
Выбирайте Haiku
  • Объёмы большие, и главное — цена за единицу (Haiku 4.5 вдвое дешевле Sonnet 5.5).
  • Достаточно контекста в 200 тыс. токенов.
  • Haiku 5.5 анонс обещает «в течение нескольких недель».
  • Поддержка Haiku 4.5 прекратится «не раньше 15 октября 2026 года», так что сверьтесь с планами заранее.

Если сомневаетесь, действуйте так: ① прогоните Sonnet 5.5 на medium и high на своей работе → ② если не хватает, сравните с Opus 5.5 на medium → ③ если Sonnet 5.5 на xhigh стоит примерно как Opus 5.5, выбирайте Opus 5.5. Подробности об Opus 5.5 — в обзоре выхода Opus 5.5, список всех моделей на текущий момент — в статье об основных моделях ИИ и их границах знаний.

9. Использование в Claude Code и GitHub Copilot

Claude Code добавил Sonnet 5.5 в CHANGELOG v2.1.284 (28 сентября 2026 года) и сделал её Sonnet по умолчанию в Anthropic API.

Модель по умолчанию — по-прежнему Opus 5.5

default на Pro, Max, Team, Enterprise и в API остаётся Opus 5.5. Чтобы использовать Sonnet 5.5, выберите /model sonnet (при запуске — claude --model sonnet). В версиях старше v2.1.284 она недоступна, поэтому выполните claude update.

На что указывает sonnet, зависит от провайдера

Sonnet 5.5 получается только в Anthropic API. В Claude Platform on AWS это Sonnet 4.6, в Bedrock, Agent Platform в Google Cloud и Microsoft Foundry — Sonnet 4.5. Там выбирайте полное имя модели или задайте ANTHROPIC_DEFAULT_SONNET_MODEL.

effort начинается с medium, рассуждения не отключаются

Sonnet 5.5 стартует с medium. Старый вариант effortLevel на верхнем уровне пользовательских настроек не действует на Opus 5.5 и более новые модели. Переключатель рассуждений, alwaysThinkingEnabled и MAX_THINKING_TOKENS=0 на Sonnet 5.5 тоже не действуют.

Кибербезопасность — на Sonnet 5, биология — отказ

Когда срабатывает классификатор защитных мер, работа по кибербезопасности повторяется на Sonnet 5, и сессия продолжается на этой модели (вернуться можно через /model). Для биологии у Sonnet 5.5 резервной модели нет, и всё заканчивается отказом.

Источники: Claude Code, «Model configuration» и CHANGELOG (v2.1.284, проверено 29 сентября 2026 года)

В Anthropic API контекст Sonnet 5.5 всегда равен 1 млн токенов, без указания [1m] и без доплаты. Автоматическое сжатие (auto-compact) по умолчанию запускается примерно на 967 тыс. токенов. При работе через LLM-шлюз (задан ANTHROPIC_BASE_URL) контекст считается равным 200 тыс. токенов, поэтому выберите в меню моделей «Sonnet 5.5 (1M context)» (sonnet[1m]).

opusplan, где планирование отдаётся Opus, а выполнение — Sonnet, в Anthropic API работает на Opus 5.5 и Sonnet 5.5 соответственно. Как им пользоваться, описано в разборе opusplan. Сам Claude Code ведёт разговор только дописыванием, поэтому проблем с проверкой истории из раздела 5 ③ у него нет (по руководству по миграции на Opus 5.5).

GitHub Copilot

В тот же день, 28 сентября, GitHub в своём changelog объявил об общей доступности Sonnet 5.5. Она доступна в Copilot Pro, Pro+, Max, Business и Enterprise и выбирается в меню моделей VS Code, Visual Studio, Copilot CLI, Copilot coding agent, github.com, IDE JetBrains, Xcode и других. Развёртывание постепенное, поэтому модель может появиться не сразу. Оплата — по объёму использования, по прейскурантной цене провайдера. В Business и Enterprise доступность определяет администратор через политику моделей в настройках Copilot.

10. Шаги миграции (для пользователей API)

Ниже — пункты из чек-листа руководства по миграции, относящиеся к переходу с Sonnet 5, в рабочем порядке. В Claude Code есть и /claude-api migrate, который помогает с этой работой (встроенный навык, на который указывает руководство по миграции; перед правками он уточняет у вас объём работ).

  1. Смените ID модели с claude-sonnet-5 на claude-sonnet-5-5 (в Bedrock — anthropic.claude-sonnet-5-5).
  2. Замените thinking: {"type": "disabled"} на {"type": "between_tools"} и установите effort не выше high.
  3. Замените any и tool в tool_choice на auto + strict tool use (в Bedrock — только auto и собственная проверка входных данных).
  4. Если вы переписываете system, tools или прошлые сообщения посреди разговора, перейдите на схему «только дописывание».
  5. Если используете computer use в Claude API или Google Cloud, перейдите на computer_toolset_20260801 и переделайте цикл.
  6. Если в инструменте advisor советником указаны Opus 4.8, Opus 4.7, Sonnet 5 и т. п., замените его на советника, которого принимает Sonnet 5.5, и исходите из того, что совет возвращается зашифрованным.
  7. Если показываете ход работы на экране, задайте display равным "updates" или "summarized" (с between_tools не нужно).
  8. Обрабатывайте stop_reason: "refusal" и настройте резервное переключение.
  9. Если у вас есть маршрутизация на другие модели, проверьте её с расчётом на то, что рассуждения Sonnet 5.5 не передаются.
  10. Заново подберите effort и заново измерьте стоимость и задержку. Проверьте и кэширование промптов короче 1024 токенов.

Источник: разделы «Every starting model» и «Migrating to Claude Sonnet 5.5 from Claude Sonnet 5» в Anthropic, «Migrating to Claude Sonnet 5.5», переставленные в рабочем порядке

Если вы переходите напрямую с Sonnet 4.6 или более ранних, добавляется ещё работа: рассуждения запускаются и там, где они не были заданы, бюджет и temperature и т. п. дают 400, а тот же текст занимает примерно на 30% больше токенов. Если вы используете модель в Claude Managed Agents, кроме смены имени модели ничего менять не нужно (примечание в руководстве по миграции).

Итоги

Claude Sonnet 5.5 — это выпуск, который заметно поднял производительность при прежней цене, но взамен приблизил правила работы с API к Opus 5.5. В собственной таблице Anthropic она опережает Sonnet 5 во всех строках и в большинстве строк отстаёт от Opus 5.5 не больше чем на несколько пунктов. С другой стороны, disabled, принудительный вызов инструмента, старый инструмент computer use, переписывание истории и некоторые комбинации advisor теперь приводят к ошибке 400.

Легче всего упустить то, что заменяющее отключение рассуждений between_tools принимается только на high и ниже, а также расхождение: effort по умолчанию в API — high, а в Claude Code — medium. В API задавайте effort явно, в Claude Code выберите модель через /model sonnet и проверьте уровень effort. Стало ли дешевле, измеряйте по usage, а не по тарифам.

И наконец, цифры бенчмарков — это значения, полученные в этой таблице и в этих условиях. Сама Anthropic пишет, что «в сложной работе без заранее известного ответа Opus 5.5 явно сильнее». Начните со сравнения Sonnet 5.5 на medium и high на своей работе.

FAQ

Q. Sonnet 5.5 дороже Sonnet 5?

A. Тарифы совпадают по всем статьям (ввод $2, вывод $10, чтение из кэша $0.20, Batch API — за полцены). Anthropic говорит «до 30% дешевле в расчёте на задачу», но это её собственные измерения. Поскольку уровни effort откалиброваны заново, после миграции проверьте по usage.

Q. Можно ли отключить рассуждения (thinking)?

A. В API thinking: {"type": "between_tools"} отключает предварительные рассуждения. Для запросов без инструментов ответ будет содержать только текст. Однако при effort xhigh и max возвращается 400, а заметки о ходе работы между инструментами приходят в блоках thinking. В Claude Code настройки отключения рассуждений на Sonnet 5.5 не действуют.

Q. Сменил ID модели — и получил ошибку 400.

A. Причину можно определить по сообщению об ошибке. "thinking.type.disabled" — настройка рассуждений, tool_choice: type "tool" and "any" — принудительный вызов инструмента, computer_20251124 — старый инструмент computer use. Если ошибка появилась при использовании between_tools, проверьте, не стоит ли effort xhigh или выше и не передаёте ли вы вместе с ним display и т. п. Если используете инструмент advisor, подозревайте модель-советника, а если переписываете историю посреди разговора — проверку блоков рассуждений (раздел 5 ③).

Q. В Claude Code не включается Sonnet 5.5.

A. Модель по умолчанию — Opus 5.5, поэтому выберите её через /model sonnet. Если всё ещё Sonnet 5, ваша версия старше v2.1.284 — выполните claude update. В Bedrock, Google Cloud, Claude Platform on AWS и Microsoft Foundry sonnet указывает на более старую Sonnet, поэтому выбирайте полное имя модели или задайте ANTHROPIC_DEFAULT_SONNET_MODEL.

Q. Что сделать моделью по умолчанию — Opus 5.5 или Sonnet 5.5?

A. Официальная отправная точка — Opus 5.5. Если основная работа — чётко очерченная реализация, исправление ошибок и создание документов на effort от low до high, Sonnet 5.5 обойдётся вдвое дешевле по тарифам на ввод и вывод. Если вы работаете на xhigh или max, разница в стоимости, как сказано в анонсе, сокращается, так что сравните обе модели на своей работе.

* Цифры в статье основаны на официальном анонсе Anthropic «Introducing Claude Sonnet 5.5» (бенчмарки — по сравнительной таблице и подписям к графикам на той же странице), официальной документации «Models overview», «Claude Sonnet 5.5», «What's new in Claude Sonnet 5.5», «Migrating to Claude Sonnet 5.5», «Pricing», «Thinking», «Effort», «Prompt caching», документации Claude Code «Model configuration» и CHANGELOG, а также changelog GitHub (всё проверено 29 сентября 2026 года). Характеристики и цены могут меняться, поэтому окончательно сверяйтесь с официальной документацией.

Связанные статьи: обзор выхода Claude Opus 5.5, несовместимые изменения Claude Fable 5.1 и миграция, сравнение цен Claude.