Расширенное мышление (extended thinking) у Claude означает, что модель сначала проговаривает решение «про себя», а уже потом пишет ответ. В 2026 году это перестало быть простым тумблером: глубину рассуждения задаёт шкала усилия, а на части моделей мышление вообще нельзя выключить. Ниже: чем такой ответ отличается от обычного, где режим включается, на каких задачах он помогает и почему из-за него быстрее заканчиваются лимиты.
Что это за режим и чем ответ отличается от обычного
Без рассуждения модель обязана попасть в цель с первой попытки: нет черновика, нет проверки, нет возможности передумать на середине. Когда мышление включено, Claude сначала выдаёт отдельный блок рассуждения: переформулирует задачу своими словами, пробует подходы, проверяет промежуточные результаты и отбрасывает те, что не сходятся. Только после этого появляется ответ, который опирается на этот черновик. Так описывает механику сама Anthropic.
Режим появился 24 февраля 2025 года вместе с моделью Claude 3.7 Sonnet, и тогда это был буквально переключатель «думать глубже» (анонс Anthropic). Важная деталь: в интерфейсе вы видите не сырой поток мыслей, а краткий пересказ. Полную цепочку Claude не отдаёт ни в одном режиме, а на новых моделях текст рассуждения по умолчанию скрыт: показывается только сам факт, что модель думает.
Настройки моделей становятся интересны, когда есть что собирать. На бесплатном вебинаре по вайбкодингу разбираем первый рабочий проект: от идеи до готовой ссылки.
Занять местоАдаптивное мышление и уровни усилия
Старый механизм выглядел так: разработчик задавал фиксированный бюджет токенов на рассуждение, и модель думала ровно столько на каждый запрос к API. Этот вариант считается устаревшим. На актуальных моделях работает адаптивное мышление: Claude сам решает, нужно ли думать над конкретным шагом и насколько глубоко.
Управляет этим не бюджет, а уровень усилия (effort). Документация Anthropic описывает пять ступеней:
- low: самый экономный вариант, для коротких и понятных задач, где важна скорость.
- medium: заметная экономия токенов ценой части глубины, разумный компромисс для рутины.
- high: значение по умолчанию, баланс качества и расхода.
- xhigh: более глубокое рассуждение и заметно больший расход, для сложного кода и длинных агентских задач.
- max: предельный вариант без ограничений на расход, но на простых задачах модель начинает передумывать саму себя.
Набор ступеней зависит от модели. На Opus 4.6 и Sonnet 4.6 доступны low, medium, high и max, а на Opus 5, Sonnet 5, Opus 4.8 и Opus 4.7 добавляется xhigh (документация Claude Code). Уровни калиброваны отдельно под каждую модель, поэтому high на одной и high на другой означают разный объём размышлений. Если вы ещё выбираете, с какой моделью работать, поможет наш разбор семейства моделей Claude.
Отдельный момент: мышление не везде отключается. В приложениях Claude режим рассуждений нельзя выключить на Opus 5, а попытка отключить его на максимальных уровнях усилия через API приводит к ошибке (справка Claude).
По теме: Claude Haiku: что за модель, цена и когда её выбирать в 2026
Где включается: чат, приложения, Claude Code, API
- Веб-чат и приложения. В claude.ai и в приложениях для компьютера и телефона нажмите на название модели рядом с кнопкой отправки. Там же находится переключатель Thinking и выбор уровня усилия. Когда режим активен, над ответом появляется таймер и раскрывающийся блок «Thinking» с пересказом рассуждения.
- Claude Code. Основной способ поставить его сегодня, десктопное приложение для Windows, macOS и Linux со страницы claude.com/product/claude-code; тем, кому привычнее терминал или редактор, доступны CLI и расширения для IDE. Мышление там включено по умолчанию. Уровень задаётся командой
/effortили стрелками на слайдере в/model, сам режим переключается сочетаниемOption+T(macOS) иAlt+T(Windows и Linux), а глобальное значение сохраняется через/config. Текст рассуждения свёрнут: чтобы его увидеть, нажмитеCtrl+O. - Разовое углубление в Claude Code. Если задача сложнее обычного, добавьте слово
ultrathinkв любое место промпта: Claude Code распознаёт его и просит модель подумать глубже только на этот ход, не меняя настройку сессии. Фразы вроде «подумай как следует» такого эффекта не дают, они уходят в промпт обычным текстом. - API. В запросе к API режим задаётся полем
thinkingсо значениемadaptive, а глубина отдельным параметромeffortвнутриoutput_config.
curl https://api.anthropic.com/v1/messages \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-opus-5",
"max_tokens": 16000,
"thinking": {"type": "adaptive", "display": "summarized"},
"output_config": {"effort": "high"},
"messages": [{"role": "user", "content": "Разбери задачу по шагам"}]
}'
Параметр display отвечает только за видимость: со значением summarized вернётся пересказ рассуждения, без него блок придёт пустым. На расход это не влияет, модель думает и тарифицируется одинаково. Практику работы с терминальной версией мы разбирали в гайде по Claude Code.
Умение выжимать из ИИ хороший результат окупается только на практике. На бесплатном вебинаре показываем, как собрать свой первый сайт или бота с нуля, и отдаём гайд в подарок.
Записаться на вебинарНа каких задачах рассуждение действительно помогает
Выигрыш появляется там, где качество ответа зависит от промежуточной работы, которую иначе пришлось бы пропустить или сжать в одну фразу.
- Математика и логика: задачи в несколько действий, где ошибка на втором шаге ломает весь результат.
- Разбор чужого кода и поиск бага, особенно когда причина не там, где симптом.
- Длинные агентские задачи: рефакторинг на несколько файлов, сборка проекта целиком, работа с инструментами в несколько кругов.
- Анализ большого документа или набора данных, где нужно сопоставить разные куски между собой.
- Планирование: разложить расплывчатую цель на шаги и заранее увидеть узкие места.
Хорошая привычка: держать средний уровень усилия как рабочий и поднимать его точечно, когда задача действительно тяжёлая. Разница между «подумал» и «подумал очень долго» на простых задачах почти незаметна в ответе, зато отлично видна в счётчике лимитов.
По теме: Claude: страны, где сервис работает официально в 2026 году
Где режим только тратит время и лимиты
Обратная сторона: на простых задачах рассуждение не улучшает ответ, но исправно съедает время и квоту.
- Короткие фактические вопросы и справки: ответ уже известен модели, думать не над чем.
- Редактура текста, смена тона, сокращение, перевод: качество ощутимо не растёт.
- Массовая однотипная классификация: там важнее скорость и предсказуемая цена.
- Быстрый обмен репликами, где пауза перед ответом раздражает сильнее, чем помогает точность.
Расход устроен так: токены рассуждения оплачиваются как выходные, даже если текст вам не показали, и они же засчитываются в общий потолок ответа. При тесном лимите на длину модель может потратить его на размышления и оборваться на середине. Подробнее про счёт токенов и контекстное окно мы писали в материале о токенах Claude.
На подписке эффект выражен в лимитах: уровень усилия официально указан среди факторов, от которых зависит скорость расхода квоты, вместе с длиной диалога, размером вложений и выбором модели (справка Claude). Если упираетесь в потолок чаще, чем хотелось бы, начните со снижения усилия на рутине, остальные приёмы собраны в разборе лимитов Claude. В Claude Code уровень опускается командой /effort прямо посреди сессии (документация по расходам).
На каких тарифах доступен режим
Хорошая новость: расширенное мышление не спрятано за платной стеной. На странице тарифов Claude оно указано прямо в составе бесплатного плана, разница между тарифами не в наличии режима, а в объёме доступной работы.
- Free: 0 долларов, расширенное мышление входит, но общий объём сообщений самый скромный.
- Pro: 20 долларов в месяц при помесячной оплате и 17 долларов в месяц при годовой.
- Max: от 100 долларов в месяц, с выбором между пятикратным и двадцатикратным объёмом относительно Pro.
- Team: 25 долларов за место в месяц при помесячной оплате и 20 долларов при годовой.
На бесплатном тарифе усилие стоит поднимать выборочно: одна задача на максимуме способна съесть заметную часть квоты. На Pro и Max разумнее держать высокий уровень по умолчанию и опускать его на рутине.
Частые вопросы
Можно ли увидеть полный ход мыслей Claude?
Нет. В интерфейсе и в ответе API приходит краткий пересказ рассуждения, а не исходная цепочка. Оплачиваются при этом все сгенерированные токены рассуждения, а не объём того пересказа, который вы прочитали.
Замедляет ли режим ответ?
Да, и это его основная цена. На высоких уровнях усилия пауза перед первым словом ответа заметно длиннее. Если модель тратит время там, где не нужно, снижайте уровень усилия, а не боритесь с этим формулировками промпта.
Что выбрать: включить мышление или взять модель посильнее?
Сначала уровень усилия, он дешевле. Более сильная модель на низком усилии часто проигрывает более простой на высоком, а стоит дороже. Переходить на старшую модель имеет смысл, когда даже на high результат стабильно не дотягивает.
Почему у меня нет переключателя Thinking?
Либо выбрана модель, которая не поддерживает настройку усилия, либо это модель, где мышление включено всегда и отключить его нельзя. Проверьте название модели рядом с кнопкой отправки: настройки живут там же.
Настройки моделей полезны ровно настолько, насколько есть на чём их применять. На бесплатном вебинаре по вайбкодингу показываем весь путь: от постановки задачи ИИ до собранного сайта или бота, который работает.
Записаться на вебинар