Адаптивное и расширенное мышление Claude: что изменилось
То, как думает Claude, пережило смену поколений. Старое расширенное мышление требовало указывать бюджет токенов в каждом запросе — thinking: {"type": "enabled", "budget_tokens": N}, — но правильный бюджет зависит от задачи и заранее не угадывается, а его изменение инвалидирует кеш промптов. Текущее адаптивное мышление — одна строка, type: "adaptive": думать ли и насколько глубоко, модель решает сама, исходя из сложности запроса. Миграция шла поэтапно: budget_tokens объявлен устаревшим на Opus 4.6 / Sonnet 4.6, а начиная с Opus 4.7 отклоняется с ошибкой 400. В статье правила по моделям сведены в одну таблицу: Fable 5 думает всегда (отключить нельзя), у Opus 5 и Sonnet 5 мышление включено по умолчанию (на Opus 5 отключение допускается только при effort high и ниже), Opus 4.8 / 4.7 требуют явной настройки adaptive, а для устаревших моделей вроде Sonnet 4.5 / Haiku 4.5 budget_tokens остаётся единственным режимом. Управление глубиной переехало в output_config: {"effort": ...} с пятью уровнями (по умолчанию high), и смена effort сбрасывает кеш так же, как раньше смена бюджета. Видимость определяется полем display: умолчание нового поколения — "omitted" (пустые блоки мышления), при этом полный объём токенов мышления оплачивается в любом случае — измеряйте через usage.output_tokens_details.thinking_tokens; сырую цепочку рассуждений не возвращает ни одна настройка. У отключения мышления на Opus 5 есть задокументированные побочные эффекты (вызовы инструментов обычным текстом, утечка внутренних тегов), поэтому более безопасный рычаг экономии — снижение effort. Чередующееся мышление — рассуждения между вызовами инструментов — при adaptive работает автоматически, старый бета-заголовок больше не нужен. А когда нужна скорость, fast mode запускает тот же Opus примерно в 2.5 раза быстрее за двойную цену (только Opus 5/4.8, в Claude Code переключается через /fast). Всё опирается на официальную документацию Anthropic: Thinking, Extended thinking и Fast mode.