Сообщение о достигнутом пределе приходит по двум разным причинам, и справка Anthropic разводит их прямо. Ограничение по использованию отвечает за то, сколько человек успевает сделать за отрезок времени, прежде чем ждать сброса, а ограничение по длине — за то, сколько помещается в один разговор. Здесь разобраны оба: от чего растёт расход, почему счёт общий для всех мест работы и какие приёмы называет сама справка.
Ограничение по использованию: от чего зависит расход
Ограничение по использованию считает вашу работу за отрезок времени. В справке «Как работают ограничения по использованию и длине?» определение дано так, а в английской версии той же справки, How do usage and length limits work? от 13 июля 2026 года, оно звучит дословно: «Usage limits control how much you can interact with Claude over a specific time period». Перевод наш: «Ограничения по использованию задают, сколько вы можете работать с Claude за определённый отрезок времени». При достижении предела приходит сообщение о сбросе — так это описано и в справке «Модели, использование и ограничения в Claude Code».
Расход при этом набегает неравномерно, и причины перечислены одной строкой: «Your usage is affected by several factors, including the length and complexity of your conversations, the features you use, which Claude model you’re chatting with, and the effort level you’ve selected». Перевод наш: «На ваш расход влияет несколько вещей: длина и сложность разговоров, используемые возможности, выбранная модель Claude и заданный уровень усилий».
Длина и сложность разговора весят больше прочего. Чем дольше идёт беседа и чем труднее задача внутри неё, тем тяжелее обходится каждый следующий ход.
Возможности и уровень усилий добавляются сверху. Чем больше инструментов задействовано в работе и чем подробнее агенту велено рассуждать, тем выше расход за тот же результат.
Подписка Claude Code задаёт сам размер предела. Справка говорит об этом так: «Different subscription plans (Pro, Max, Team, etc.) have different usage allowances, with paid plans offering higher limits». Перевод наш: «У разных планов подписки — Pro, Max, Team и прочих — своя доля использования, и платные планы дают более высокие пределы». Поэтому одинаковая работа упирается в сообщение о сбросе не у всех в один и тот же момент. Чем эти планы отличаются друг от друга по цене и составу, разобрано на странице тарифов с Claude Code.
Само окно сброса названо на странице тарифов: «Every plan has usage limits that reset on a rolling five-hour session window, and paid plans add weekly limits on top». Перевод наш: «У каждого плана есть ограничения по использованию, которые сбрасываются скользящим пятичасовым окном сеанса, а у платных планов сверху добавлены недельные ограничения».
Один предел на сайт, Claude Code и приложение
Счёт у Anthropic общий, и справка отмечает это отдельной строкой: «Note that your usage of all different Claude product surfaces (claude.ai, Claude Code, Claude Desktop) counts towards the same usage limit». Перевод наш: «Учтите, что работа на всех площадках Claude — claude.ai, Claude Code, Claude Desktop — считается в один и тот же предел использования».
Отсюда понятно, почему предел иногда кончается в неожиданный момент. Утренняя переписка в браузере и дневная работа с кодом тратят одно и то же, хотя выглядят как разные занятия на разных экранах.
Ограничение по длине разговора и контекстное окно
Второе ограничение касается одного разговора и измеряется токенами. Справка определяет его так: «Length limits relate to Claude’s context window—the amount of information Claude can work with in a single chat». Перевод наш: «Ограничения по длине относятся к окну контекста Claude — к объёму сведений, с которым Claude работает внутри одного разговора».
Размеры окна названы там же числами: «On paid plans, the newest models support up to a 1M token context window, while others support 500K or 200K tokens. A portion of the context window is always reserved for Claude’s response, so the longest possible conversation is slightly smaller than the full window». Перевод наш: «На платных планах новейшие модели поддерживают окно контекста до 1 млн токенов, остальные — 500 или 200 тысяч. Часть окна контекста всегда оставлена под ответ Claude, поэтому самый длинный возможный разговор чуть короче полного окна».
Claude Code сжимает разговор сам, когда тот подходит к пределу длины, и справка сразу называет цену такого сжатия: «Longer conversations that trigger automatic context management consume more of your usage limit». Перевод наш: «Длинные разговоры, в которых срабатывает автоматическое сжатие контекста, расходуют предел использования быстрее». Из-за автоматического сжатия в стену по длине человек упирается редко, и куда чаще он упирается в предел по использованию.
Что советует справка: /clear, /compact и выбор модели
Откуда берётся расход, справка Models, usage, and limits in Claude Code от 15 апреля 2026 года объясняет устройством каждого хода: «Every turn sends three things to the model: The conversation so far — every previous message in this session. Project context — your CLAUDE.md and any files Claude has read. Your new prompt». Перевод наш: «Каждый ход отправляет модели три вещи: разговор до этого момента — каждое прежнее сообщение в этом сеансе; контекст проекта — ваш CLAUDE.md и все файлы, которые Claude прочитал; ваш новый запрос». И сразу же: «Of these, the first item grows the fastest». Перевод наш: «Из них быстрее всего растёт первая».
Первый приём — команда /clear между несвязанными задачами: «/clear wipes the conversation and starts fresh. Your CLAUDE.md and project files remain available; only the chat history is removed. Use this whenever you switch tasks, as it is the single most effective lever for both quality and cost». Перевод наш: «/clear стирает разговор и начинает заново. Ваш CLAUDE.md и файлы проекта остаются доступными, убирается только история переписки. Пользуйтесь этим при каждой смене задачи: это самый действенный рычаг и для качества, и для расхода».
У /clear есть оговорка, о которой справка предупреждает отдельно: «One warning: /clear cannot be undone. If you might still need something from the history, copy it out first or run /compact instead, which preserves a summary rather than wiping everything». Перевод наш: «Одно предупреждение: /clear не отменяется. Если из истории ещё может что-то понадобиться, сначала скопируйте это или возьмите /compact, который оставляет краткое изложение вместо полной очистки».
Второй приём — команда /compact для длинной работы, которую вы продолжаете: «/compact summarizes the conversation so far into a short recap, freeing up space while preserving the essential context». Перевод наш: «/compact сводит разговор к короткому пересказу, освобождая место и сохраняя главное». Правило справка выводит одной фразой: «use /clear when starting a new task, and /compact when continuing a long one». Перевод наш: «Берите /clear в начале новой задачи и /compact при продолжении длинной».
Третий приём — подбор модели под задачу: «Opus costs several times more per turn than Sonnet, and Sonnet more than Haiku. Spending Opus on routine work is the fastest way to drain a daily limit». Перевод наш: «Ход на Opus стоит в несколько раз больше, чем на Sonnet, а Sonnet дороже Haiku. Тратить Opus на рутину — самый быстрый способ исчерпать дневной предел».
Разумный порядок справка называет сама: Sonnet на большую часть работы с кодом, Opus — на трудную отладку, сквозную перестройку и решения об устройстве, Haiku — на быструю механическую работу вроде переименований и шаблонного кода. Есть и готовая связка двух моделей: «This pattern is built in as /model opusplan, which uses Opus while planning and Sonnet for execution». Перевод наш: «Этот порядок встроен под именем /model opusplan: Opus на время планирования и Sonnet на выполнение». Как выбор выпуска сказывается на самой работе агента, разобрано в статье Claude Code или Codex.
Работа по ключу API и команда /cost
Работа по ключу API устроена иначе, и справка описывает её в таблице способов входа: оплата идёт «Pay-as-you-go, billed per token to that cloud or Console account», а конец предела выглядит как «No hard stop; the account is charged for what it uses». Перевод наш: «оплата по мере использования, счёт за токены выставляется этой облачной или консольной учётной записи» и «жёсткой остановки нет, со счёта списывается за то, что израсходовано».
Расход в сеансе показывает команда /cost: «If you are using an API key, the /cost command shows your running spend for the current session». Перевод наш: «Если вы работаете по ключу API, команда /cost показывает текущий расход за этот сеанс». Рядом в справке перечислены и остальные команды: /model переключает модель, /clear начинает разговор заново, /compact сжимает историю, /context показывает, что сейчас загружено в контекст.
Чем вообще считается счёт, Anthropic говорит на странице Manage costs effectively: «Claude Code charges by API token consumption». Перевод наш: «Claude Code считает расход по потреблению токенов API». Там же приведён замер по корпоративным внедрениям: «Across enterprise deployments, the average cost is around $13 per developer per active day and $150-250 per developer per month, with costs remaining below $30 per active day for 90% of users». Перевод наш: «По корпоративным внедрениям средний расход — около 13 долларов на разработчика за рабочий день и 150–250 долларов на разработчика в месяц, причём у 90% пользователей расход держится ниже 30 долларов за рабочий день».
Справочные страницы Anthropic с этими цитатами сняты 15 сентября 2026 года.
Claude code бесплатно: кому доступен Claude Code
Бесплатного доступа к Claude Code нет. В сводной таблице планов на странице тарифов строка «Claude Code» у плана Free помечена как «No», а у планов Pro, Max 5x и Max 20x — как «Yes». Про сам бесплатный план там сказано коротко: «Free covers everyday questions». Перевод наш: «Бесплатный план закрывает повседневные вопросы». Платная подписка даёт больше работы за то же окно: «Pro gives you at least 5x more usage per 5-hour session than Free». Перевод наш: «Pro даёт по меньшей мере в пять раз больше работы за пятичасовой сеанс, чем Free».
Claude Code включён и в места Team и Enterprise, и в доступ через Console по ключу API. Вход в этом случае выполняется рабочей учётной записью, а отказ с кодом 403 сразу после входа обычно означает, что администратор ещё не включил доступ для пользователя. Отдельно от планов стоит вопрос о месте работы: требования к стране и порядок входа для тех, кто запускает Claude Code из России, собраны в своей статье.
Что делать, когда предел кончился, названо на той же странице тарифов: «When you reach a limit, you can wait for it to reset, move to a higher plan, or, on paid plans, turn on usage credits to keep working at standard API rates». Перевод наш: «Когда вы упёрлись в предел, можно дождаться сброса, перейти на план выше или — на платных планах — включить кредиты использования и работать дальше по обычным ставкам API».
Замер расхода на живом проекте
Как это выглядит на длинной работе, показал разбор «5,75 миллиарда токенов за полгода: как я перестал жечь контекст в Claude Code» от 2 сентября 2026 года. Автор под именем D1MANYCH разобрал собственные записи сеансов и начинает с того, что его подтолкнуло: «Проблема, ради которой всё затевалось: лимиты подписки заканчивались к обеду. Не потому, что я много просил, а потому, что просил неправильно».
Замер по 169 сеансам и 28 649 запросам дал такое распределение: средний контекст одного запроса — 201 тысяча токенов, а «Сессий длиннее 300 запросов — 22 штуки — 67% всего расхода». Самый длинный сеанс у него занял 886 запросов.
Механику автор объясняет так же, как справка: «Каждый запрос к модели отправляет весь диалог заново: системный промпт, CLAUDE.md, все прочитанные файлы, все результаты команд, всю переписку». А следствие выводит числом: «Сессия на 800 запросов стоит не вдвое, а вчетверо дороже четырёх сессий по 200 при том же объёме сделанной работы».
Отдельно он называет, на что уходил объём внутри сеанса: «32% всего объёма чтения — повторные чтения одного и того же файла в одной сессии». Правило, к которому он в итоге пришёл, звучит как «150 запросов или 200k контекста — и сессию режем, даже посреди задачи».
Для вашей работы отсюда следует понятный порядок. Смотрите не на длину своих сообщений, а на длину сеанса: очистка разговора между задачами экономит больше, чем любое сокращение формулировок.
Что выносят из подписки
Пределы Anthropic остаются прежними, и GEN202 их не меняет. Меняется другое — какая работа вообще идёт внутри подписки, а какая оплачивается за сделанное.
Рутина вокруг проекта видна сразу. Картинка для README, кадр на лендинг, изображение в карточку товара — эти задачи возникают по ходу работы, а рисует их отдельная модель. Что Claude делает с изображениями сам, разобрано в статье Claude картинки.
GEN202 отдаёт эту работу навыком. Вы даёте своему агенту одну фразу — её текст целиком приведён на странице генерации изображений из Claude Code, — агент открывает описание навыка и настраивает по нему вызовы GEN202 API. Ключ он берёт из переменной окружения GEN202_KEY, а когда её нет, разбирает подключение вместе с вами.
Устройство такого навыка ничем не отличается от любого другого: каталог и текст с указаниями внутри, разобранные в статье про skills для Claude Code. Команда подключения ему не нужна, а чем навык отличается от внешней программы со своим адресом, показано в статье про MCP-серверы.
Счёт за такие картинки идёт за сделанное. На Nano Banana 2 в разрешении 1K готовое изображение стоит 7,2 ₽, на Nano Banana Pro в 4K — 21,6 ₽, и рядом в навыке доступен GPT Image 2. Полный перечень ставок собран в таблице на странице генерации изображений из Claude Code.
Частые вопросы
Почему предел кончился быстрее обычного? Причин обычно три, и все они названы в справке. Первая — длина и сложность разговоров: каждый ход отправляет модели весь разговор заново, поэтому долгая беседа обходится дороже короткой. Разбор на живом проекте показывает, насколько: у автора замера по 169 сеансам двадцать два сеанса длиннее трёхсот запросов дали 67% всего расхода. Вторая — выбранная модель и заданный уровень усилий: ход на Opus стоит в несколько раз дороже такого же хода на Sonnet, и рутина на старшей модели исчерпывает дневной предел быстрее всего остального. Третья — общий счёт: расход с сайта claude.ai, из Claude Code и из Claude Desktop складывается вместе, поэтому длинная переписка в браузере уменьшает то, что останется на работу с кодом.
Считается ли работа в приложении и на сайте вместе? Да, это один предел на всё. Справка «Как работают ограничения по использованию и длине?» говорит, что работа на всех площадках Claude считается в один и тот же предел использования: сайт claude.ai, Claude Code и настольное приложение Claude Desktop делят общий счёт. Развести их по отдельным пределам нельзя. Сбрасывается предел скользящим пятичасовым окном сеанса, а на платных планах сверху добавлены недельные ограничения.
Чем /clear отличается от /compact?
/clear очищает разговор целиком, а /compact оставляет от него краткое изложение. Правило справка формулирует одной строкой: /clear — в начале новой задачи, /compact — при продолжении длинной. Файлы проекта и CLAUDE.md в обоих случаях остаются на месте, убирается только история переписки. Разница есть и в обратимости: /clear не отменяется, поэтому нужное из разговора забирают заранее либо берут /compact, который сохраняет пересказ вместо полной очистки.
Что показывает /cost?
Команда /cost показывает расход в текущем сеансе — по справке, «running spend for the current session», то есть накопленную трату за этот разговор. Названа она рядом с разбором работы по ключу API, и это объяснимо: там оплата идёт по мере использования, счёт выставляется за токены, а жёсткой остановки нет, поэтому текущий расход стоит видеть своими глазами. По корпоративным внедрениям Anthropic приводит ориентир: около 13 долларов на разработчика за рабочий день и 150–250 долларов в месяц, причём у 90% пользователей расход держится ниже 30 долларов за рабочий день. В работе по подписке та же команда помогает сравнить задачи между собой и понять, какая из них тяжелее.