Токен это кусочек текста, которым нейросеть измеряет и ваш вопрос, и свой ответ. В Claude от токенов зависят сразу две вещи: сколько текста помещается в один диалог и как быстро вы упрётесь в ограничение тарифа. Ниже разбираем, сколько символов в токене, почему русский текст расходуется быстрее английского, какие контекстные окна у актуальных моделей и что делать, когда предел близко.
Что такое токен простыми словами
Модель не читает текст ни буквами, ни словами. Она разбивает его на токены: частые слова становятся одним токеном целиком, редкие и длинные разваливаются на несколько кусочков. В глоссарии Anthropic формулировка такая: один токен для Claude это примерно 3,5 английских символа, и точное число зависит от языка (глоссарий Anthropic).
В счёт идёт не только ваш вопрос.
- Ваш вопрос, приложенные файлы и картинки, инструкция стиля или проекта.
- Ответ модели: он тоже измеряется в токенах.
- Рассуждения модели перед ответом. Они входят в общий счёт наравне с обычным текстом (документация Anthropic).
И ещё одна деталь, которая объясняет половину вопросов о расходе: при каждом новом сообщении модели заново отправляется вся переписка. Не только последняя реплика, а весь диалог целиком. Поэтому сотое сообщение в длинном чате стоит намного дороже первого.
Почему на русском токенов уходит больше
Разбиение на токены складывалось в основном на англоязычных текстах, поэтому английские слова чаще укладываются в один-два токена целиком. Кириллица дробится мельче: обычное русское слово с приставкой и окончанием легко превращается в три или четыре кусочка. Результат простой: один и тот же по смыслу текст на русском занимает в диалоге заметно больше места, чем его английский перевод, и до потолка окна вы доходите раньше.
Точного коэффициента для русского языка Anthropic не публикует, поэтому честнее держать в голове не цифру, а правило: запас окна на русском меньше, чем кажется по количеству знаков. На практике это значит, что длинный русский документ стоит класть в чат кусками, а не целиком, и не пересылать в переписке одно и то же по третьему разу.
Лимиты начинают мешать тогда, когда вы что-то делаете каждый день, а не пробуете раз в неделю. На бесплатном вебинаре показываем, как собрать с ИИ первый рабочий проект.
Занять местоКонтекстное окно актуальных моделей
Контекстное окно это рабочая память модели: сколько текста она держит перед глазами прямо сейчас, вместе со своим ответом. На платных тарифах Claude размеры такие:
- Claude Opus 5 и Claude Sonnet 5: 1 000 000 токенов.
- Claude Opus 4.8, Opus 4.7, Opus 4.6 и Sonnet 4.6: 500 000 токенов.
- Остальные модели: 200 000 токенов.
Цифры взяты из справки Anthropic о размере контекстного окна на платных тарифах (support.claude.com). Какую модель выбрать под конкретную задачу, мы сравнивали в разборе моделей Claude и их отличий.
Более понятный ориентир для документов: в одно обращение к модели с окном на миллион токенов помещается до 600 страниц PDF или картинок, а у моделей с окном 200 000 токенов предел ниже, 100 страниц (документация Anthropic).
Когда диалог подходит к границе окна, разговор не обрывается. Claude сам сворачивает более ранние сообщения в краткий пересказ и продолжает работу (справка Anthropic). Обратная сторона в том, что детали из начала переписки при этом могут потеряться, а сам такой диалог расходует лимит быстрее обычного.
По теме: Google и Claude в 2026: вход, интеграции и отличие от Gemini
Контекстное окно и лимит тарифа: это разные вещи
Их постоянно путают, хотя упираются в них по-разному. Окно это про один диалог: сколько текста модель видит сейчас. Лимит тарифа это про период: сколько вы в принципе можете сделать за отрезок времени.
- Фиксированного числа сообщений нет. В справке сказано прямо: расход зависит от длины и сложности переписки, выбранной модели, включённых функций и уровня усилий модели.
- Счёт идёт сессиями и неделями. У тарифа Max есть два недельных лимита, общий и отдельный для моделей Sonnet, а варианты 5x и 20x означают во столько раз больший расход за сессию по сравнению с Pro (справка о тарифе Max).
- Лимит общий для всех поверхностей: чат на claude.ai, приложение на компьютере и Claude Code списывают из одного и того же запаса.
Остаток видно в настройках аккаунта, в разделе Usage: там показан расход за текущую сессию и за неделю (рекомендации Anthropic по лимитам). Где именно смотреть и как читать эти цифры, подробно показано в статье про расход и лимиты Claude, а общее устройство ограничений разобрано в материале как устроены лимиты Claude.
Самая частая причина жалобы «лимит кончился слишком быстро» это не количество сообщений, а один бесконечный чат, в который весь день дописывают новые вопросы. Переписка уходит модели заново с каждой репликой, и к вечеру простое «ещё один вопрос» стоит как небольшая книга.
Экономить токены имеет смысл ради результата: своего сайта, бота или небольшого сервиса, который вы собрали сами. На бесплатном вебинаре по вайбкодингу разбираем этот путь по шагам, участникам достаётся гайд в подарок.
Записаться на вебинарКак понять, что лимит близко, и что делать
- Проверьте расход в настройках. Раздел Usage показывает, сколько израсходовано в текущей сессии и за неделю, это точнее любых ощущений.
- Оцените признаки перегруженного чата. Ответы приходят медленнее обычного, модель путает детали из начала переписки, появляется предупреждение о длине разговора.
- Начните новый чат под новую задачу. Именно это советует справка Anthropic, если вы приближаетесь к лимиту в длинной переписке.
- Перенесите контекст руками. В первое сообщение нового чата скопируйте только итог: требования, готовый кусок текста, принятые решения. Всю историю тащить не нужно.
- Прикладывайте файл вместо копипаста. Документ, вставленный в чат текстом, придётся пересылать модели заново с каждым сообщением, вложение в проекте так себя не ведёт.
- Для простых задач переключите модель. Модель поменьше отвечает быстрее и расходует лимит экономнее, а на пересказ письма или проверку текста её хватает с запасом.
По теме: Новый Claude: что нового в моделях и приложениях в 2026
Приёмы, которые экономят лимит
Часть советов ниже прямо описана в рекомендациях Anthropic по работе с лимитами, часть выведена из того, как устроен расход.
- Собирайте несколько связанных вопросов в одно сообщение вместо цепочки коротких реплик.
- Давайте полный контекст сразу: чем меньше уточняющих кругов, тем меньше расход.
- Загружайте документы в проект. Файлы проекта кэшируются, и при повторных обращениях в счёт идёт только новая часть.
- Отдавайте текст на правку целиком одним сообщением, а не по абзацам.
- Отключайте лишнее в простых задачах: поиск в интернете, выполнение кода и длинные рассуждения тратят дополнительные токены.
- Не копите в чате мусор. Старые версии текста, длинные логи и распечатки таблиц уходят модели заново с каждым сообщением.
- Заводите отдельный чат под каждую тему. Это одновременно и экономия, и защита от того, что модель перепутает две задачи.
Отдельная история, если вы работаете с Claude не в чате, а в терминале, над кодом. Там своя механика расхода, своё сжатие контекста и свои команды для его очистки: всё это разобрано в статье про лимиты и токены Claude Code.
Частые вопросы
Сколько токенов даёт бесплатный тариф?
Точного числа Anthropic не публикует: объём использования на бесплатном тарифе описан качественно, как меньший по сравнению с платными, и зависит от нагрузки и выбранной модели. Реальный остаток всегда виден в разделе Usage в настройках аккаунта. Состав платных планов и цены собраны на странице тарифов Claude.
Сколько это в страницах текста?
Для документов есть официальный ориентир: до 600 страниц PDF или изображений в одном обращении к модели с окном на миллион токенов и до 100 страниц у моделей с окном 200 000 токенов. Для обычной переписки жёсткого перевода в страницы нет, потому что на длину диалога влияют ещё и ответы модели с её рассуждениями.
Что будет, если контекстное окно закончится?
В чате Claude сам свернёт ранние сообщения в пересказ и продолжит разговор. Ошибки вы не увидите, но подробности из начала переписки могут исчезнуть, поэтому ключевые требования полезно повторить в свежем сообщении или перенести в новый чат.
Считаются ли токены ответа модели?
Да. В контекстное окно и в расход входят и то, что вы отправили, и то, что модель сгенерировала, включая её внутренние рассуждения перед ответом. Поэтому просьба «напиши подробно, страниц на десять» стоит ощутимо дороже короткого ответа.
Как узнать, сколько токенов в моём тексте?
Счётчика токенов в интерфейсе чата нет. Точный подсчёт доступен разработчикам через отдельный метод API, а для повседневной работы достаточно раздела Usage: он показывает не абстрактные токены, а долю израсходованного лимита.
Разобраться с токенами полезно, но интереснее другое: что на этом можно собрать. На бесплатном вебинаре по вайбкодингу показываем, как без опыта в программировании сделать свой сайт или телеграм-бота с помощью ИИ.
Записаться на вебинар