Нейросети для начинающих2026-07-288 минРедакция Submarine School

Сколько токенов в Claude: контекстное окно и лимиты в 2026

Сколько токенов в Claude: контекстное окно и лимиты в 2026

Токен это кусочек текста, которым нейросеть измеряет и ваш вопрос, и свой ответ. В Claude от токенов зависят сразу две вещи: сколько текста помещается в один диалог и как быстро вы упрётесь в ограничение тарифа. Ниже разбираем, сколько символов в токене, почему русский текст расходуется быстрее английского, какие контекстные окна у актуальных моделей и что делать, когда предел близко.

Что такое токен простыми словами

Модель не читает текст ни буквами, ни словами. Она разбивает его на токены: частые слова становятся одним токеном целиком, редкие и длинные разваливаются на несколько кусочков. В глоссарии Anthropic формулировка такая: один токен для Claude это примерно 3,5 английских символа, и точное число зависит от языка (глоссарий Anthropic).

В счёт идёт не только ваш вопрос.

  • Ваш вопрос, приложенные файлы и картинки, инструкция стиля или проекта.
  • Ответ модели: он тоже измеряется в токенах.
  • Рассуждения модели перед ответом. Они входят в общий счёт наравне с обычным текстом (документация Anthropic).

И ещё одна деталь, которая объясняет половину вопросов о расходе: при каждом новом сообщении модели заново отправляется вся переписка. Не только последняя реплика, а весь диалог целиком. Поэтому сотое сообщение в длинном чате стоит намного дороже первого.

Почему на русском токенов уходит больше

Разбиение на токены складывалось в основном на англоязычных текстах, поэтому английские слова чаще укладываются в один-два токена целиком. Кириллица дробится мельче: обычное русское слово с приставкой и окончанием легко превращается в три или четыре кусочка. Результат простой: один и тот же по смыслу текст на русском занимает в диалоге заметно больше места, чем его английский перевод, и до потолка окна вы доходите раньше.

Точного коэффициента для русского языка Anthropic не публикует, поэтому честнее держать в голове не цифру, а правило: запас окна на русском меньше, чем кажется по количеству знаков. На практике это значит, что длинный русский документ стоит класть в чат кусками, а не целиком, и не пересылать в переписке одно и то же по третьему разу.

Лимиты начинают мешать тогда, когда вы что-то делаете каждый день, а не пробуете раз в неделю. На бесплатном вебинаре показываем, как собрать с ИИ первый рабочий проект.

Занять место

Контекстное окно актуальных моделей

Контекстное окно это рабочая память модели: сколько текста она держит перед глазами прямо сейчас, вместе со своим ответом. На платных тарифах Claude размеры такие:

  • Claude Opus 5 и Claude Sonnet 5: 1 000 000 токенов.
  • Claude Opus 4.8, Opus 4.7, Opus 4.6 и Sonnet 4.6: 500 000 токенов.
  • Остальные модели: 200 000 токенов.

Цифры взяты из справки Anthropic о размере контекстного окна на платных тарифах (support.claude.com). Какую модель выбрать под конкретную задачу, мы сравнивали в разборе моделей Claude и их отличий.

Более понятный ориентир для документов: в одно обращение к модели с окном на миллион токенов помещается до 600 страниц PDF или картинок, а у моделей с окном 200 000 токенов предел ниже, 100 страниц (документация Anthropic).

Когда диалог подходит к границе окна, разговор не обрывается. Claude сам сворачивает более ранние сообщения в краткий пересказ и продолжает работу (справка Anthropic). Обратная сторона в том, что детали из начала переписки при этом могут потеряться, а сам такой диалог расходует лимит быстрее обычного.

По теме: Google и Claude в 2026: вход, интеграции и отличие от Gemini

Контекстное окно и лимит тарифа: это разные вещи

Их постоянно путают, хотя упираются в них по-разному. Окно это про один диалог: сколько текста модель видит сейчас. Лимит тарифа это про период: сколько вы в принципе можете сделать за отрезок времени.

  • Фиксированного числа сообщений нет. В справке сказано прямо: расход зависит от длины и сложности переписки, выбранной модели, включённых функций и уровня усилий модели.
  • Счёт идёт сессиями и неделями. У тарифа Max есть два недельных лимита, общий и отдельный для моделей Sonnet, а варианты 5x и 20x означают во столько раз больший расход за сессию по сравнению с Pro (справка о тарифе Max).
  • Лимит общий для всех поверхностей: чат на claude.ai, приложение на компьютере и Claude Code списывают из одного и того же запаса.

Остаток видно в настройках аккаунта, в разделе Usage: там показан расход за текущую сессию и за неделю (рекомендации Anthropic по лимитам). Где именно смотреть и как читать эти цифры, подробно показано в статье про расход и лимиты Claude, а общее устройство ограничений разобрано в материале как устроены лимиты Claude.

Самая частая причина жалобы «лимит кончился слишком быстро» это не количество сообщений, а один бесконечный чат, в который весь день дописывают новые вопросы. Переписка уходит модели заново с каждой репликой, и к вечеру простое «ещё один вопрос» стоит как небольшая книга.

Экономить токены имеет смысл ради результата: своего сайта, бота или небольшого сервиса, который вы собрали сами. На бесплатном вебинаре по вайбкодингу разбираем этот путь по шагам, участникам достаётся гайд в подарок.

Записаться на вебинар

Как понять, что лимит близко, и что делать

  1. Проверьте расход в настройках. Раздел Usage показывает, сколько израсходовано в текущей сессии и за неделю, это точнее любых ощущений.
  2. Оцените признаки перегруженного чата. Ответы приходят медленнее обычного, модель путает детали из начала переписки, появляется предупреждение о длине разговора.
  3. Начните новый чат под новую задачу. Именно это советует справка Anthropic, если вы приближаетесь к лимиту в длинной переписке.
  4. Перенесите контекст руками. В первое сообщение нового чата скопируйте только итог: требования, готовый кусок текста, принятые решения. Всю историю тащить не нужно.
  5. Прикладывайте файл вместо копипаста. Документ, вставленный в чат текстом, придётся пересылать модели заново с каждым сообщением, вложение в проекте так себя не ведёт.
  6. Для простых задач переключите модель. Модель поменьше отвечает быстрее и расходует лимит экономнее, а на пересказ письма или проверку текста её хватает с запасом.

По теме: Новый Claude: что нового в моделях и приложениях в 2026

Приёмы, которые экономят лимит

Часть советов ниже прямо описана в рекомендациях Anthropic по работе с лимитами, часть выведена из того, как устроен расход.

  • Собирайте несколько связанных вопросов в одно сообщение вместо цепочки коротких реплик.
  • Давайте полный контекст сразу: чем меньше уточняющих кругов, тем меньше расход.
  • Загружайте документы в проект. Файлы проекта кэшируются, и при повторных обращениях в счёт идёт только новая часть.
  • Отдавайте текст на правку целиком одним сообщением, а не по абзацам.
  • Отключайте лишнее в простых задачах: поиск в интернете, выполнение кода и длинные рассуждения тратят дополнительные токены.
  • Не копите в чате мусор. Старые версии текста, длинные логи и распечатки таблиц уходят модели заново с каждым сообщением.
  • Заводите отдельный чат под каждую тему. Это одновременно и экономия, и защита от того, что модель перепутает две задачи.

Отдельная история, если вы работаете с Claude не в чате, а в терминале, над кодом. Там своя механика расхода, своё сжатие контекста и свои команды для его очистки: всё это разобрано в статье про лимиты и токены Claude Code.

Частые вопросы

Сколько токенов даёт бесплатный тариф?

Точного числа Anthropic не публикует: объём использования на бесплатном тарифе описан качественно, как меньший по сравнению с платными, и зависит от нагрузки и выбранной модели. Реальный остаток всегда виден в разделе Usage в настройках аккаунта. Состав платных планов и цены собраны на странице тарифов Claude.

Сколько это в страницах текста?

Для документов есть официальный ориентир: до 600 страниц PDF или изображений в одном обращении к модели с окном на миллион токенов и до 100 страниц у моделей с окном 200 000 токенов. Для обычной переписки жёсткого перевода в страницы нет, потому что на длину диалога влияют ещё и ответы модели с её рассуждениями.

Что будет, если контекстное окно закончится?

В чате Claude сам свернёт ранние сообщения в пересказ и продолжит разговор. Ошибки вы не увидите, но подробности из начала переписки могут исчезнуть, поэтому ключевые требования полезно повторить в свежем сообщении или перенести в новый чат.

Считаются ли токены ответа модели?

Да. В контекстное окно и в расход входят и то, что вы отправили, и то, что модель сгенерировала, включая её внутренние рассуждения перед ответом. Поэтому просьба «напиши подробно, страниц на десять» стоит ощутимо дороже короткого ответа.

Как узнать, сколько токенов в моём тексте?

Счётчика токенов в интерфейсе чата нет. Точный подсчёт доступен разработчикам через отдельный метод API, а для повседневной работы достаточно раздела Usage: он показывает не абстрактные токены, а долю израсходованного лимита.

Разобраться с токенами полезно, но интереснее другое: что на этом можно собрать. На бесплатном вебинаре по вайбкодингу показываем, как без опыта в программировании сделать свой сайт или телеграм-бота с помощью ИИ.

Записаться на вебинар
Разборы, кейсы и фишки вайбкодинга каждую неделю в телеграм-канале «Яков вайбкодит».
Первый проект с ИИ: живой разбор, бесплатно Занять место