Нейросети для начинающих2026-08-058 минРедакция Submarine School

Claude thinking: режим рассуждений и как им управлять в 2026

Claude thinking: режим рассуждений и как им управлять в 2026

Расширенное мышление (extended thinking) у Claude означает, что модель сначала проговаривает решение «про себя», а уже потом пишет ответ. В 2026 году это перестало быть простым тумблером: глубину рассуждения задаёт шкала усилия, а на части моделей мышление вообще нельзя выключить. Ниже: чем такой ответ отличается от обычного, где режим включается, на каких задачах он помогает и почему из-за него быстрее заканчиваются лимиты.

Что это за режим и чем ответ отличается от обычного

Без рассуждения модель обязана попасть в цель с первой попытки: нет черновика, нет проверки, нет возможности передумать на середине. Когда мышление включено, Claude сначала выдаёт отдельный блок рассуждения: переформулирует задачу своими словами, пробует подходы, проверяет промежуточные результаты и отбрасывает те, что не сходятся. Только после этого появляется ответ, который опирается на этот черновик. Так описывает механику сама Anthropic.

Режим появился 24 февраля 2025 года вместе с моделью Claude 3.7 Sonnet, и тогда это был буквально переключатель «думать глубже» (анонс Anthropic). Важная деталь: в интерфейсе вы видите не сырой поток мыслей, а краткий пересказ. Полную цепочку Claude не отдаёт ни в одном режиме, а на новых моделях текст рассуждения по умолчанию скрыт: показывается только сам факт, что модель думает.

Настройки моделей становятся интересны, когда есть что собирать. На бесплатном вебинаре по вайбкодингу разбираем первый рабочий проект: от идеи до готовой ссылки.

Занять место

Адаптивное мышление и уровни усилия

Старый механизм выглядел так: разработчик задавал фиксированный бюджет токенов на рассуждение, и модель думала ровно столько на каждый запрос к API. Этот вариант считается устаревшим. На актуальных моделях работает адаптивное мышление: Claude сам решает, нужно ли думать над конкретным шагом и насколько глубоко.

Управляет этим не бюджет, а уровень усилия (effort). Документация Anthropic описывает пять ступеней:

  • low: самый экономный вариант, для коротких и понятных задач, где важна скорость.
  • medium: заметная экономия токенов ценой части глубины, разумный компромисс для рутины.
  • high: значение по умолчанию, баланс качества и расхода.
  • xhigh: более глубокое рассуждение и заметно больший расход, для сложного кода и длинных агентских задач.
  • max: предельный вариант без ограничений на расход, но на простых задачах модель начинает передумывать саму себя.

Набор ступеней зависит от модели. На Opus 4.6 и Sonnet 4.6 доступны low, medium, high и max, а на Opus 5, Sonnet 5, Opus 4.8 и Opus 4.7 добавляется xhigh (документация Claude Code). Уровни калиброваны отдельно под каждую модель, поэтому high на одной и high на другой означают разный объём размышлений. Если вы ещё выбираете, с какой моделью работать, поможет наш разбор семейства моделей Claude.

Отдельный момент: мышление не везде отключается. В приложениях Claude режим рассуждений нельзя выключить на Opus 5, а попытка отключить его на максимальных уровнях усилия через API приводит к ошибке (справка Claude).

По теме: Claude Haiku: что за модель, цена и когда её выбирать в 2026

Где включается: чат, приложения, Claude Code, API

  1. Веб-чат и приложения. В claude.ai и в приложениях для компьютера и телефона нажмите на название модели рядом с кнопкой отправки. Там же находится переключатель Thinking и выбор уровня усилия. Когда режим активен, над ответом появляется таймер и раскрывающийся блок «Thinking» с пересказом рассуждения.
  2. Claude Code. Основной способ поставить его сегодня, десктопное приложение для Windows, macOS и Linux со страницы claude.com/product/claude-code; тем, кому привычнее терминал или редактор, доступны CLI и расширения для IDE. Мышление там включено по умолчанию. Уровень задаётся командой /effort или стрелками на слайдере в /model, сам режим переключается сочетанием Option+T (macOS) и Alt+T (Windows и Linux), а глобальное значение сохраняется через /config. Текст рассуждения свёрнут: чтобы его увидеть, нажмите Ctrl+O.
  3. Разовое углубление в Claude Code. Если задача сложнее обычного, добавьте слово ultrathink в любое место промпта: Claude Code распознаёт его и просит модель подумать глубже только на этот ход, не меняя настройку сессии. Фразы вроде «подумай как следует» такого эффекта не дают, они уходят в промпт обычным текстом.
  4. API. В запросе к API режим задаётся полем thinking со значением adaptive, а глубина отдельным параметром effort внутри output_config.
curl https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-opus-5",
    "max_tokens": 16000,
    "thinking": {"type": "adaptive", "display": "summarized"},
    "output_config": {"effort": "high"},
    "messages": [{"role": "user", "content": "Разбери задачу по шагам"}]
  }'

Параметр display отвечает только за видимость: со значением summarized вернётся пересказ рассуждения, без него блок придёт пустым. На расход это не влияет, модель думает и тарифицируется одинаково. Практику работы с терминальной версией мы разбирали в гайде по Claude Code.

Умение выжимать из ИИ хороший результат окупается только на практике. На бесплатном вебинаре показываем, как собрать свой первый сайт или бота с нуля, и отдаём гайд в подарок.

Записаться на вебинар

На каких задачах рассуждение действительно помогает

Выигрыш появляется там, где качество ответа зависит от промежуточной работы, которую иначе пришлось бы пропустить или сжать в одну фразу.

  • Математика и логика: задачи в несколько действий, где ошибка на втором шаге ломает весь результат.
  • Разбор чужого кода и поиск бага, особенно когда причина не там, где симптом.
  • Длинные агентские задачи: рефакторинг на несколько файлов, сборка проекта целиком, работа с инструментами в несколько кругов.
  • Анализ большого документа или набора данных, где нужно сопоставить разные куски между собой.
  • Планирование: разложить расплывчатую цель на шаги и заранее увидеть узкие места.

Хорошая привычка: держать средний уровень усилия как рабочий и поднимать его точечно, когда задача действительно тяжёлая. Разница между «подумал» и «подумал очень долго» на простых задачах почти незаметна в ответе, зато отлично видна в счётчике лимитов.

По теме: Claude: страны, где сервис работает официально в 2026 году

Где режим только тратит время и лимиты

Обратная сторона: на простых задачах рассуждение не улучшает ответ, но исправно съедает время и квоту.

  • Короткие фактические вопросы и справки: ответ уже известен модели, думать не над чем.
  • Редактура текста, смена тона, сокращение, перевод: качество ощутимо не растёт.
  • Массовая однотипная классификация: там важнее скорость и предсказуемая цена.
  • Быстрый обмен репликами, где пауза перед ответом раздражает сильнее, чем помогает точность.

Расход устроен так: токены рассуждения оплачиваются как выходные, даже если текст вам не показали, и они же засчитываются в общий потолок ответа. При тесном лимите на длину модель может потратить его на размышления и оборваться на середине. Подробнее про счёт токенов и контекстное окно мы писали в материале о токенах Claude.

На подписке эффект выражен в лимитах: уровень усилия официально указан среди факторов, от которых зависит скорость расхода квоты, вместе с длиной диалога, размером вложений и выбором модели (справка Claude). Если упираетесь в потолок чаще, чем хотелось бы, начните со снижения усилия на рутине, остальные приёмы собраны в разборе лимитов Claude. В Claude Code уровень опускается командой /effort прямо посреди сессии (документация по расходам).

На каких тарифах доступен режим

Хорошая новость: расширенное мышление не спрятано за платной стеной. На странице тарифов Claude оно указано прямо в составе бесплатного плана, разница между тарифами не в наличии режима, а в объёме доступной работы.

  • Free: 0 долларов, расширенное мышление входит, но общий объём сообщений самый скромный.
  • Pro: 20 долларов в месяц при помесячной оплате и 17 долларов в месяц при годовой.
  • Max: от 100 долларов в месяц, с выбором между пятикратным и двадцатикратным объёмом относительно Pro.
  • Team: 25 долларов за место в месяц при помесячной оплате и 20 долларов при годовой.

На бесплатном тарифе усилие стоит поднимать выборочно: одна задача на максимуме способна съесть заметную часть квоты. На Pro и Max разумнее держать высокий уровень по умолчанию и опускать его на рутине.

Частые вопросы

Можно ли увидеть полный ход мыслей Claude?

Нет. В интерфейсе и в ответе API приходит краткий пересказ рассуждения, а не исходная цепочка. Оплачиваются при этом все сгенерированные токены рассуждения, а не объём того пересказа, который вы прочитали.

Замедляет ли режим ответ?

Да, и это его основная цена. На высоких уровнях усилия пауза перед первым словом ответа заметно длиннее. Если модель тратит время там, где не нужно, снижайте уровень усилия, а не боритесь с этим формулировками промпта.

Что выбрать: включить мышление или взять модель посильнее?

Сначала уровень усилия, он дешевле. Более сильная модель на низком усилии часто проигрывает более простой на высоком, а стоит дороже. Переходить на старшую модель имеет смысл, когда даже на high результат стабильно не дотягивает.

Почему у меня нет переключателя Thinking?

Либо выбрана модель, которая не поддерживает настройку усилия, либо это модель, где мышление включено всегда и отключить его нельзя. Проверьте название модели рядом с кнопкой отправки: настройки живут там же.

Настройки моделей полезны ровно настолько, насколько есть на чём их применять. На бесплатном вебинаре по вайбкодингу показываем весь путь: от постановки задачи ИИ до собранного сайта или бота, который работает.

Записаться на вебинар
Разборы, кейсы и фишки вайбкодинга каждую неделю в телеграм-канале «Яков вайбкодит».
Первый проект с ИИ: живой разбор, бесплатно Занять место