Миграция на Claude Fable 5.1 не сводится к замене идентификатора модели. Anthropic прямо пишет, что три изменения являются ломающими (What's new in Claude Fable 5.1). Причём два из трёх проявляются далеко от того места, где возникают — как раз такие и пропускают.

⚠️ Третье принудительно применяется к аккаунтам, созданным 31 августа 2026 года и позже. На более старых аккаунтах API лишь фиксирует несовпадение и учитывает его в работе только тогда, когда вы попросили об этом явно.

То есть «у нас всё работает, значит всё в порядке» зависит от даты создания аккаунта. Свежесозданный тестовый контур может падать там, где продакшен не падает.

1. Сначала о месте модели: это не смена флагмана

Ошибка здесь портит само решение о миграции. Fable 5.1 — это преемник Fable 5, а не замена Opus 5.

Официальная документация формулирует это однозначно: «для большинства рабочих нагрузок начинайте с Claude Opus 5». За Fable 5.1 обращаются ради сложных рассуждений и длительной агентной работы либо тогда, когда Opus 5 на высоком effort всё равно не дотягивает.

  Claude Fable 5.1 Claude Opus 5
Позиционирование Сложные рассуждения, длительная агентная работа Начинать отсюда (сложное агентное программирование и корпоративные задачи)
Цена (за 1M токенов) Вход $10 / выход $50 Вход $5 / выход $25
Чтение кэша $0.25 (0.025x базового входа) 0.1x базового входа
Граница знаний Июнь 2026 Май 2026
Контекст / максимум на выходе 1M / 128k 1M / 128k
Вывод из обращения не раньше 1 сентября 2027 года 24 июля 2027 года

Fable 5 никуда не делась. В официальном списке моделей она остаётся как legacy (обслуживание продолжается). Мигрировать прямо сейчас никто не заставляет — хотя, как показано ниже, расходы при этом снижаются.

У Mythos 5.1 те же возможности, отличаются только предохранители. Доступ ограничен участниками Project Glasswing.

📌 Про подписки: в день релиза лимиты использования сбросили. Официальный аккаунт @ClaudeDevs объявил, что вместе с выходом 5.1 всем пользователям сбросили пятичасовые и недельные окна. Речь не о ценах API, а о квотах подписки — например, в Claude Code, и это не постоянное правило, а временная мера, приуроченная к крупному анонсу. Сколько раз такие сбросы случались раньше и что здесь подтверждено, а что нет, разбирается в статье о раннем сбросе недельного лимита. При этом сам недельный лимит пересматривается 14 сентября 2026 года, так что, если вы планируете работу исходя из квоты, загляните и туда.

2. Ломающее изменение 1: принудительный вызов инструмента возвращает 400

Это изменение выдаёт ошибку сразу, поэтому заметить его проще всего.

tool_choice: type "tool" and "any" are not supported for this model.

Передача в tool_choice значения {"type": "any"} или {"type": "tool", "name": "..."} возвращает 400 invalid_request_error. Значения по умолчанию {"type": "auto"} и {"type": "none"} не изменились. Та же проверка действует и на эндпоинте подсчёта токенов.

💡 Причина объяснена так, что с ней трудно спорить. Эта модель рассуждает постоянно, и принудительный вызов инструмента пропускает это рассуждение. Модель начинает записывать то, что обдумала бы, прямо в аргументы инструмента, и качество аргументов падает — поэтому путь и закрыли.

Чем это заменить

Если нужно соблюдение схемы

Оставьте tool_choice: auto и включите strict: true (strict tool use) либо перейдите на structured outputs

Если инструмент обязан вызываться

Опишите в промпте, когда его применять («на вопросы о погоде отвечай через инструмент get_weather»). Anthropic заявляет, что Fable 5.1 надёжно следует явным указаниям по инструментам

3. Ломающее изменение 2: блоки размышления привязаны к модели

Вот тут начинается неприятное. Блоки размышления теперь хранят отметку о том, какая модель их породила, и переносятся только в одну сторону.

✅ Направление, которое сохраняется

Разговор, переходящий на Fable 5.1 с прошлых поколений (Opus 5, Fable 5 и старше), продолжается с сохранением рассуждений

❌ Направление, которое теряется

Переход с Fable 5.1 обратно на прошлое поколение теряет рассуждения тех ходов, что прошли здесь. Прошлые поколения не читают блоки размышления Fable 5.1

⚠️ Опаснее всего то, что по умолчанию это ломается молча. Когда приходит запрос с блоками, которые модель не может прочитать, API отбрасывает их ещё до того, как модель их увидит. Отброшенное не попадает в input_tokens и не тарифицируется — то есть не появляется и в счёте.

Бьёт это по любой схеме, которая меняет модель посреди разговора. Маршрутизаторы, откаты на запасную модель, динамический выбор ради экономии. Каждая из них может оказаться в состоянии «вроде работает, а рассуждения просто пропадают».

Чтобы это стало видно, добавьте бета-заголовок thinking-binding-controls-2026-08-01. Тогда отбрасывания попадают в массив input_transformations верхнего уровня. Без заголовка отчёта не будет вовсе.

4. Ломающее изменение 3: правка прошлого хода всё ломает

Из трёх именно это шире всего задевает существующий код. Изменение чего угодно, что стоит перед блоком размышления Fable 5.1 — промпта system, массива tools или любого более раннего сообщения, — приводит к тому, что следующий запрос падает.

The block is bound to a different conversation

Схемы, обнуляющие все последующие блоки размышления

  • Правка, перестановка или удаление прошлого хода с сохранением ходов после него
  • Вставка текста для конкретного запроса в прошлый ход и его удаление в следующем запросе (напоминания или строки статуса)
  • Пересборка промпта system или массива tools внутри одного разговора
  • URL изображения или документа, который в более позднем запросе отдаёт другие байты (проверяются байты, а не URL, поэтому сменяющиеся подписанные ссылки на один и тот же файл не мешают)

А это, наоборот, ничего не ломает

  • Удаление блоков размышления подряд с начала (сначала самые старые)
  • Сокращение истории серверной компакцией или редактированием контекста
  • Перенос маркеров cache_control
  • Смена effort между запросами

Обратите внимание: если вынуть один блок размышления откуда угодно, кроме начала, всё, что идёт после него, обнуляется.

⚠️ Касается это вас или нет, зависит от даты создания аккаунта. Проверка принудительна для аккаунтов, созданных 31 августа 2026 года и позже. На более старых аккаунтах API лишь фиксирует несовпадение и учитывает его в работе только при заданном thinking.block_binding.prefix_mismatch_behavior.

Свежесозданный тестовый контур может падать там, где продакшен не падает — бывает и наоборот.

Как узнать, затронут ли ваш код

Anthropic описывает конкретную процедуру. Задайте prefix_mismatch_behavior: "drop_block", прогоните одну сессию и запишите в лог input_transformations. Если вы правите историю, там появится reason: "prefix_binding_mismatch".

Отметим также, что Claude Code, claude.ai, Claude Managed Agents и Claude Agent SDK сделаны так, чтобы не ломать этот префикс. Под удар попадает только код, который собирает массив messages самостоятельно.

5. Чтение кэша вчетверо дешевле: сколько это экономит на деле

Ни вход, ни выход не подорожали. Изменилась только цена чтения кэша.

Позиция За 1M токенов
Базовый вход $10
Запись в кэш (5 минут) $12.50
Запись в кэш (1 час) $20
Чтение кэша $0.25
Выход $50
Пакетная обработка Вход $5 / выход $25

Насколько это помогает, решает то, сколько раз вы перечитываете закэшированный префикс. На других моделях Claude чтение кэша стоит 0.1x базового входа, а на Fable 5.1 и Mythos 5.1 — 0.025x. Чем длиннее агентный прогон и чем чаще он перечитывает один и тот же префикс, тем шире разрыв.

Anthropic называет экономию примерно 25% на типичных нагрузках и до 45% на задачах с выраженной агентной частью. Запись в кэш и минимальная кэшируемая длина в 512 токенов не изменились.

6. Семь особенностей поведения, меняющихся без правок кода

Именно здесь миграции чаще всего недосматривают. Поверхность API та же, но то, что из неё выходит, стало другим. Anthropic перечисляет семь пунктов.

Меньше параллельных вызовов инструментов

Там, где Fable 5 отправляла их пачкой, можно получить один вызов на ход. Качество ответа не падает, но растут токены, число обменов и реальное время

Меньше рассказа о ходе работы

Особенно заметно на высоком effort. Интерфейс, который держится на комментариях по ходу дела, будет выглядеть немым

На низком effort отвечает по памяти

Инструменты поиска и извлечения вызываются реже. На ходах, где нужны свежие данные, поднимайте effort

Более плотная проза

Предложения бывают длиннее, а разбивка на абзацы реже

Меньше форматирования

Полужирное начертание, заголовки и списки используются реже прежнего. Написанные для старых моделей указания «не форматируй» теперь срабатывают слишком сильно

В пересказах цитаты не помечаются

Пересказывая документ, модель чаще воспроизводит фрагмент оригинала, не обозначив его как цитату

Ради мелкой правки переписывает всё

Результат тот же, но уходят лишние выходные токены и время

На каждый пункт Anthropic даёт средство на уровне промпта. Для параллельных вызовов достаточно строки о том, что независимые чтения следует отправлять вместе; если нужен ход работы, явно попросите вступительную, промежуточную и завершающую реплику.

7. Что добавлено

Anthropic насчитывает пять добавлений. Одно из них — удешевление чтения кэша, и, поскольку оно весит больше остальных, ему отведена отдельная пятая глава. Здесь разберём оставшиеся четыре.

Смена effort по ходу разговора (бета)

Регулируйте эффективность вверх и вниз, не ломая кэш промпта. Поднимайте на трудных шагах, опускайте на рутинных

Системные сообщения в пределах хода (бета)

clear_at: "next_user_message". Функция, призванная безопасно заменить приём «вставил и убрал» из третьего ломающего изменения, без переписывания истории

Ход работы приходит текстом (бета)

display: "updates". Рассуждения остаются скрытыми, а вам отдаётся только ход работы между вызовами инструментов как обычный текст

Происхождение контента

Статистический водяной знак на сгенерированном тексте. Ни лишних токенов, ни скрытых символов, ни сведений о пользователе или организации. Для изображений и видео — C2PA

Присмотритесь ко второму пункту. Против стиля «вставить напоминание, потом убрать», который запрещает третье ломающее изменение, одновременно выпущена замена, решающая ту же задачу. Миграция подана не как «прекратите так делать», а как «перенесите это сюда».

8. Порядок миграции: пять пунктов проверки

Помимо замены идентификатора модели Anthropic перечисляет следующие пять пунктов.

model = "claude-fable-5"    # Before
model = "claude-fable-5-1"  # After
  Что проверить
1 Уберите any и tool из tool_choice. Принудительное соблюдение схемы переведите на strict tool use или structured outputs
2 Возвращайте блоки размышления как есть и делайте историю доступной только для дописывания. То, что вы вставляли и убирали, переносите в системные сообщения в пределах хода, а изменения system и tools — в функцию правки по ходу разговора
3 Перенастройте effort относительно значения по умолчанию (high). Подумайте и о смене прямо по ходу разговора
4 Посмотрите, не скатился ли агентный цикл к одному вызову на ход
5 Прогоните заново свои оценки. Обработка отказов, откаты и подсчёт токенов не изменились

Вокруг отказов ничего не поменялось. stop_reason: "refusal" по-прежнему возвращается, а разрешёнными запасными вариантами для Fable 5.1 названы Opus 4.8 и Opus 5. Отказ, пришедший до вывода, не тарифицируется, а стоимость кэша промпта при смене модели возвращается кредитом за откат.

📌 Данные хранятся 30 дней, а режим нулевого хранения по общему правилу недоступен (кроме случаев, когда Anthropic одобрила его явно). Как Fable 5 и Mythos 5, модель относится к категории Covered Model. В зависимости от ваших требований одно это может решить вопрос о применимости.

Итоги

  • Это не смена флагмана. Anthropic пишет, что для большинства применений следует начинать с Opus 5, а Fable 5.1 предназначена для сложных рассуждений и длительной агентной работы
  • Ломающих изменений три. Принудительный вызов инструмента даёт 400 / блоки размышления привязаны к модели / правка прошлого хода их обнуляет
  • Второе ломается молча. Нечитаемые блоки отбрасываются и не появляются в счёте. Чтобы это заметить, нужен бета-заголовок
  • Третье применяется в зависимости от даты создания аккаунта (принудительно с 31 августа 2026 года). Тестовый контур и продакшен могут вести себя по-разному
  • Подорожания нет. Вчетверо дешевле стало только чтение кэша (0.025x базового входа). Выгода зависит от того, как часто перечитывается один и тот же префикс
  • Семь особенностей поведения меняются без единой правки кода. Особенно сокращение параллельных вызовов инструментов, которое напрямую бьёт по стоимости и времени

FAQ

Q1. Стоит ли мигрировать немедленно?

Вас никто не торопит. Fable 5 остаётся доступной как legacy, а вывод из обращения заявлен не раньше 1 сентября 2027 года. Повод переходить — деньги: чтение кэша дешевеет вчетверо, поэтому чем длиннее прогон и чем чаще он перечитывает один и тот же префикс, тем больше выигрыш. Если же трафик состоит в основном из коротких разовых вызовов, разница невелика.

Q2. Если я пользуюсь только Claude Code, затронут ли меня ломающие изменения?

Третье — нет. Anthropic прямо указывает, что Claude Code, claude.ai, Claude Managed Agents и Claude Agent SDK сделаны так, чтобы не ломать префикс. Затронут код, который сам собирает массив messages.

Q3. У нас модели переключаются динамически. Что нужно исправить?

Вот здесь и сидит суть второго изменения. Переключение с Fable 5.1 обратно на прошлое поколение теряет рассуждения этого хода. Хуже того, по умолчанию они выбрасываются молча и не появляются в счёте. Начните с бета-заголовка thinking-binding-controls-2026-08-01, логируйте input_transformations и измерьте, происходят ли отбрасывания на самом деле.

Q4. Opus 5 или Fable 5.1 — что выбрать?

Разумнее всего принять формулировку Anthropic как есть: сначала пробуйте Opus 5, а за Fable 5.1 беритесь, когда даже высокого effort не хватает. Цена вдвое выше, чем у Opus 5, и по входу, и по выходу, и лишь чтение кэша, наоборот, дешевле. Подробный разбор того, как делить работу, есть в руководстве по выбору модели.

Q5. Хочу удалять блоки размышления ради экономии контекста. Можно?

Есть условия на способ удаления. Удалять их подряд с начала, от самых старых, можно, но если вынуть один из середины, обнулятся все блоки размышления после него. Если пользоваться серверным редактированием контекста или компакцией, это не считается правкой.

Q6. Упоминается водяной знак. Он влияет на вывод?

Anthropic утверждает, что нет: смысл, качество и читаемость не меняются, лишних токенов и скрытых символов не добавляется, сведений о пользователе или организации там тоже нет. Менять запросы и ответы не требуется. Изображения и видео получают Content Credentials по стандарту C2PA через Files API.

Q7. Можно ли пользоваться Mythos 5.1?

По возможностям она совпадает с Fable 5.1, но доступ ограничен участниками Project Glasswing. Отличаются предохранители: например, на Terminal-Bench 4.0 Fable 5.1 набирает 55.8% против 60.9% у Mythos 5.1 — разрыв, который Anthropic объясняет тем, что это одна и та же модель с разными предохранителями.

Похожие статьи