Skip to main content
Claude Code взимает плату в зависимости от потребления API токенов. Для информации о ценах плана подписки (Pro, Max, Team, Enterprise) см. claude.com/pricing. Затраты на разработчика сильно варьируются в зависимости от выбора модели, размера кодовой базы и паттернов использования, таких как запуск нескольких экземпляров или автоматизация. В масштабах корпоративных развёртываний средняя стоимость составляет около $13 на разработчика в активный день и $150-250 на разработчика в месяц, при этом затраты остаются ниже $30 в активный день для 90% пользователей. Чтобы оценить расходы для вашей команды, начните с небольшой пилотной группы и используйте инструменты отслеживания ниже для установления базовой линии перед более широким развёртыванием. На этой странице рассматривается, как отслеживать ваши затраты, управлять затратами для вашей организации и снижать использование токенов.

Отслеживание ваших затрат

Использование команды /usage

Блок Session в /usage показывает использование API токенов и предназначен для пользователей API. Подписчики Claude Max и Pro имеют использование, включённое в их подписку, поэтому цифра стоимости сессии не имеет отношения к целям выставления счётов. Подписчики видят полосы использования плана, статистику активности и разбивку использования на том же экране.
Блок Session в верхней части /usage показывает подробную статистику использования токенов для вашей текущей сессии. Claude Code вычисляет цифру в долларах локально на основе количества токенов по цене списка, если только таблица modelPricing не действует. Администратор устанавливает её в управляемых параметрах вашей организации, чтобы цифра использовала ваши договорные ставки, и пока таблица действует, строка Total cost содержит примечание at your organization's configured rates. Цифра является оценкой, поэтому для авторитетного выставления счётов см. страницу Usage в Claude Console.
Эти итоги сбрасываются, когда /clear начинает новую сессию, поэтому общая стоимость следующей сессии начинается с $0. До версии v2.1.211 они продолжали накапливаться в /clear на протяжении всего времени жизни процесса Claude Code. Для ответа от Claude API, выставленного по ставке резидентности данных 1,1×, Claude Code умножает цену списка токенов этого ответа на 1,1 в цифре стоимости сессии. Claude Code сообщает ту же сумму в поле стоимости строки состояния и сравнивает её с --max-budget-usd. До версии v2.1.239 Claude Code не применял 1,1× к этим ответам, поэтому цифра стоимости сессии была ниже счёта.

Статистика кэша подсказок

После первого ответа API основного разговора Claude Code также добавляет строку Prompt cache (main) в блок Session, суммируя использование кэша подсказок сессии: количество запросов, доля входных токенов, обслуживаемых из кэша, промахи кэша и находится ли кэш в горячем состоянии прямо сейчас. Требуется Claude Code v2.1.251 или более поздняя версия.
Промахи, ожидаемые перестроения и горячие или холодные части строки означают следующее:
  • Misses: запросы, которые повторно обработали содержимое, которое кэш уже содержал, с временем последнего промаха и количеством токенов, которые эти запросы записали обратно в кэш. Claude Code считает запрос промахом, когда запрос повторно обработал более 5% и по крайней мере 2000 токенов того, что он мог бы прочитать из кэша. Действия, которые инвалидируют кэш, перечисляют обычные причины. Когда Claude Code может определить вероятную причину последнего промаха, строка её называет, например likely cause: tool definitions changed. Текст вероятной причины требует Claude Code v2.1.260 или более поздней версии.
  • Expected rebuilds: когда Claude Code сам только что переписал разговор, путём компактирования или путём очистки старых результатов инструментов из контекста, он считает тот же вид промаха как ожидаемое перестроение вместо этого. Эта часть появляется только после того, как произошло по крайней мере одно ожидаемое перестроение.
  • Warm or cold: находится ли кэшированный префикс всё ещё в пределах своего времени жизни кэша, с действующим TTL. Когда кэш холодный, строка показывает, как долго сессия была неактивна. Когда ни один ответ не сообщил о токенах кэша, строка заканчивается no prompt caching reported by the API вместо этого.
Подсчёты поступают из полей токенов кэша в ответах API, поэтому строка работает на каждом поставщике и шлюзе. Она охватывает только основной разговор, а не подагентов. /clear сбрасывает её вместе с остальной частью блока Session. Скрипты строки состояния могут читать те же числа из объекта prompt_cache.

Разбивка использования плана

На плане Pro, Max, Team или Enterprise /usage также показывает разбивку того, что учитывается в пределах ваших лимитов плана:
  • Attribution: недавнее использование, отнесённое к skills, subagents, plugins и отдельным MCP серверам, каждый показан в процентах от общего объёма. Доля MCP сервера учитывает только запросы, которые потребили один из результатов его инструментов. До версии v2.1.222 после одного вызова MCP сервера Claude Code относил каждый последующий запрос к этому серверу, завышая его долю.
  • Behavior flags: поведения, такие как длинный контекст или промахи кэша, отмеченные, когда один из них составляет 10% или более недавнего использования.
  • Loops: строка для каждой из самых тяжёлых /loop или других запланированных задач, которые недавно выполнялись, упорядоченные по общему количеству токенов, с подсчётом остальных. Claude Code сообщает, как часто каждая задача срабатывает, сколько раз она выполнялась, её общее и среднее количество токенов, и когда она в последний раз выполнялась. Claude Code ключает строку по подсказке задачи, поэтому цикл, который вы остановили и пересоздали, остаётся одной строкой. Требуется Claude Code v2.1.242 или более поздняя версия.
Нажмите d или w для переключения между последними 24 часами и последними 7 днями. Цифры являются приблизительными и вычисляются из локальной истории сессии на этом устройстве, поэтому использование с других устройств или claude.ai не включено. В расширении VS Code доли атрибуции и флаги поведения появляются в диалоговом окне Account & usage с переключателем Day и Week, без строк Loops.

Проверка расходов кредитов использования

/usage также показывает строку кредитов использования, пока кредиты использования включены. То, что показывает строка, зависит от вашего плана:
  • Pro and Max: ваши расходы за текущий месяц, измеренные в сравнении с вашим ежемесячным лимитом расходов, когда вы установили один. Когда вы не установили лимит, строка показывает Unlimited и никакую цифру расходов.
  • Team and Enterprise: ваши собственные расходы за текущий месяц, измеренные в сравнении с любым лимитом, установленным вашей организацией, который к вам применяется. Лимит, который охватывает всю организацию, не появляется в строке. Когда у вас нет собственного лимита, строка показывает ваши расходы без лимита рядом с ним. Пока кредиты использования отключены для вас, /usage не показывает строку кредитов использования.
Когда у вас есть лимит расходов, строка появляется, как только кредиты использования включены, и показывает 0% до тех пор, пока вы не потратите кредиты использования в первый раз. До версии v2.1.236 /usage показывал строку только на планах Pro и Max, и строка с лимитом расходов оставалась скрытой до тех пор, пока вы не потратили что-то.

Когда запрос использования не удаётся

Когда запрос к пределам вашего плана не удаётся, чаще всего потому, что конечная точка использования имеет ограничение по частоте запросов, /usage показывает последние полосы использования, которые она загрузила на этом устройстве в течение последних 60 минут, вместе с примечанием Showing last-known usage, указывающим, как давно эти данные были получены. Нажмите r для повторной попытки; успешная повторная попытка заменяет последние известные полосы свежими данными. Без снимка из последних 60 минут /usage сообщает, что конечная точка использования имеет ограничение по частоте запросов и предлагает тот же ярлык повторной попытки. До версии v2.1.208 ограниченный по частоте запрос в сессии, которая ещё не загружала использование, всегда показывал ошибку без полос.

Анализ ваших моделей использования

Запустите /insights для отчёта о том, как вы работаете, а не о том, сколько токенов вы использовали. Он анализирует ваши недавние сессии на этом устройстве и пишет отчёт HTML, охватывающий то, над чем вы работаете, точки трения, такие как неправильно понятые запросы или ошибочный код, и предложения по более эффективному использованию Claude Code. Один запуск анализирует до 200 сессий, которые он ещё не видел, и пропускает очень короткие. Когда сессии исключены, заголовок отчёта показывает проанализированное количество с общим количеством в скобках, например 200 sessions (412 total). Claude Code пишет последний отчёт в ~/.claude/usage-data/report.html и сохраняет копию с временной меткой каждого запуска в том же каталоге, поэтому более ранние отчёты не перезаписываются. Claude Code удаляет отчёты по тому же расписанию, что и остальные данные вашей сессии: при запуске он удаляет файлы старше cleanupPeriodDays, 30 дней по умолчанию. Вы можете запустить /insights на любом плане и с любым поставщиком. Анализ выполняется через того же поставщика и аккаунт, что и ваши обычные сессии, и токены учитываются в вашем плане или использовании API. Сессии с других устройств и claude.ai не включены.

Добавление кредитов использования к вашей подписке

Кредиты использования позволяют вам продолжать работу после лимита использования вашего плана. Для управления ими запустите /usage-credits после входа с вашей подпиской claude.ai через /login; команда недоступна при аутентификации по ключу API. В самообслуживаемых организациях Enterprise, пробных версиях Enterprise и организациях Enterprise, выставленных через AWS Marketplace, команда требует Claude Code v2.1.248 или более поздней версии; более ранние версии отклоняют её с Unknown command: /usage-credits. То, что она открывает, зависит от вашей роли: Для членов Team и Enterprise без доступа к выставлению счётов подтверждение появляется только в интерактивных сессиях: в неинтерактивном режиме с флагом -p и из Remote Control команда не отправляет запрос и говорит вам запустить её в интерактивной сессии вместо этого. Если вы запустите /usage-credits снова, пока ваш более ранний запрос ожидает администратора, Claude Code говорит вам, что запрос уже был отправлен, а не отправляет дубликат. После того как администратор отклонит ваш запрос, запуск команды снова отправляет новый. До версии v2.1.222 отклонённый запрос также блокировал новые запросы. На планах Pro и Max, когда вы достигнете лимита расходов с доступными кредитами использования, Claude Code предлагает вам увеличить или удалить лимит без выхода из CLI. Если сервер отклоняет изменение, см. Could not update your spend limit.

Управление затратами для вашей организации

Какие элементы управления у вас есть, зависит от того, как ваша организация получает доступ к Claude Code: через план Claude for Teams или Enterprise, Claude Console или облачного провайдера. На планах Teams и Enterprise использование берётся из лимита каждого члена команды. На Console и у облачных провайдеров использование оплачивается за токен вашей организацией. Если ваша организация использует смешанные методы входа, каждый разработчик учитывается в соответствии с тем, с помощью которого он прошёл аутентификацию. В таблице указано, где вы видите расходы, где их ограничиваете и как получить данные по пользователям для каждой конфигурации. На индивидуальном плане Pro или Max у вас нет организации для управления, поэтому отслеживайте собственные расходы на кредиты использования, включая быстрый режим, в разделе Добавление кредитов использования в вашу подписку. Экспорт OpenTelemetry работает на каждой конфигурации и является единственным вариантом, который передаёт метрики токенов и затрат по пользователям в ваш собственный стек наблюдаемости практически в реальном времени.

Отчётность о расходах по вашим договорным ставкам

По умолчанию Claude Code вычисляет каждую цифру затрат, которую он показывает разработчикам, по прейскурантной цене, поэтому если ваша организация платит по договорным ставкам, цифры в /usage, строке статуса и OpenTelemetry не совпадают с вашим счётом. Чтобы они совпадали, установите управляемый параметр modelPricing на ваши ставки. Параметр изменяет то, что Claude Code сообщает, а не то, что Anthropic взимает. Требуется Claude Code v2.1.242 или позже.
1

Возьмите ставки из вашего контракта

Введите ставки за миллион токенов из вашего контракта. Claude Code не получает их из Claude Console, поэтому обновляйте параметр при изменении контракта.
2

Напишите параметр

Установите multiplier для фиксированного процента скидки от прейскурантной цены, перечислите четыре ставки за токен каждой модели в overrides или сделайте и то, и другое. Запись modelPricing содержит форму и готовый к вставке пример.
3

Разверните его через управляемые параметры

Доставьте его как управляемые параметры: параметры, управляемые сервером, политика MDM, managed-settings.json или помощник политики. Claude Code игнорирует ключ в параметрах пользователя, проекта и локальных параметрах и в --settings.
Чтобы подтвердить, что ставки действуют, запустите /usage в сеансе, который получил управляемые параметры: строка Total cost блока Session содержит примечание at your organization's configured rates. Цифры по-прежнему являются оценками, а не счётом. Цены за миллион токенов в средстве выбора /model остаются по прейскурантной цене.

Claude for Teams и Enterprise

На планах Claude for Teams и Enterprise использование Claude Code каждого члена команды берётся из лимита на одного пользователя, который сбрасывается в скользящем пятичасовом окне и еженедельном окне. Лимит совместно используется с Claude chat и Cowork, а его размер зависит от уровня места (Standard или Premium). Ваши элементы управления находятся в консоли администратора claude.ai, а не в Claude Console.
  • Просмотр расходов: отчёт о расходах в аналитике организации показывает предполагаемые расходы по пользователям и по моделям с экспортом CSV, обновляется ежедневно. Отчёт охватывает расходы кредитов использования и появляется после включения кредитов использования. Использование в пределах лимита на одного пользователя не учитывается в долларах.
  • Просмотр внедрения: панель аналитики показывает ежедневно активных пользователей, сеансы и метрики вклада с экспортом CSV данных о вкладе. См. отслеживание использования команды с помощью аналитики.
  • Ограничение расходов: лимит на одного пользователя является потолком по умолчанию. Чтобы позволить членам продолжить работу после его достижения, включите кредиты использования и установите лимиты расходов на уровне организации, группы или отдельного члена команды.
  • Получение данных по пользователям: на плане Enterprise Enterprise Analytics API возвращает отчёты об использовании и затратах по пользователям на всех поверхностях Claude, включая Claude Code. Основной владелец создаёт ключ с областью read:analytics на claude.ai/analytics/api-keys. На плане Teams экспортируйте CSV отчёт о расходах, который содержит использование токенов и предполагаемые расходы по пользователям и по моделям.
Руководство по потреблению Claude Enterprise является справочником по планированию для администраторов. Оно объясняет, как потребление отличается на Claude chat, Claude Code и Cowork, и даёт начальные точки в долларах на пользователя для бюджетирования. Выделите больше средств на место для кодирования, чем на место для чата: каждый ход Claude Code содержит содержимое файлов, вызовы инструментов и многошаговое рассуждение, поэтому один сеанс отладки может потребить больше, чем день чата.

Claude Console

Организации API управляют расходами Claude Code через рабочие пространства. Вы можете установить лимиты расходов рабочего пространства на общие расходы Claude Code и просмотреть отчёты о затратах и использовании в Console.
Когда вы впервые аутентифицируете Claude Code с помощью своей учётной записи Claude Console, автоматически создаётся рабочее пространство под названием “Claude Code”. Это рабочее пространство обеспечивает централизованное отслеживание и управление затратами для всего использования Claude Code в вашей организации. Вы не можете создавать API ключи для этого рабочего пространства; оно предназначено исключительно для аутентификации и использования Claude Code.Для организаций с пользовательскими ограничениями скорости трафик Claude Code в этом рабочем пространстве учитывается в общих ограничениях скорости API вашей организации. Вы можете установить ограничение скорости рабочего пространства на странице Limits этого рабочего пространства в Claude Console, чтобы ограничить долю Claude Code и защитить другие производственные рабочие нагрузки.
Для отчётности по пользователям панель управления Console показывает расходы и принятые строки на члена команды, а Claude Code Analytics API возвращает те же ежедневные метрики по пользователям программно с помощью Admin API ключа. См. аналитика для клиентов API.

Рекомендации по ограничению скорости

При настройке Claude Code для команд учитывайте эти рекомендации по Token Per Minute (TPM) и Request Per Minute (RPM) на пользователя в зависимости от размера вашей организации: Например, если у вас есть 200 пользователей, вы можете запросить 20k TPM для каждого пользователя, или 4 миллиона общего TPM (200*20,000 = 4 миллиона). TPM на пользователя уменьшается по мере роста размера команды, потому что в более крупных организациях меньше пользователей, как правило, используют Claude Code одновременно. Эти ограничения скорости применяются на уровне организации, а не для отдельного пользователя, что означает, что отдельные пользователи могут временно потреблять больше, чем их рассчитанная доля, когда другие не активно используют сервис.
Если вы предполагаете сценарии с необычно высоким одновременным использованием (такие как живые сеансы обучения с большими группами), вам может потребоваться более высокое распределение TPM на пользователя.

Облачные провайдеры

На Amazon Bedrock, Google Cloud’s Agent Platform и Microsoft Foundry Claude Code оплачивается за токен на ваш облачный счёт, и элементы управления расходами находятся в консоли биллинга вашего облачного провайдера. Claude Code не отправляет метрики из вашего облака обратно в Anthropic, поэтому панели аналитики и Claude Code Analytics API не охватывают это использование. Для атрибуции затрат по пользователям у вас есть три варианта:
  • OpenTelemetry: экспортируйте метрики с машины каждого разработчика в ваш собственный стек наблюдаемости. Это даёт вам подсчёты токенов по пользователям, затраты и активность инструментов независимо от провайдера.
  • Шлюз Claude apps: самостоятельно размещённый Claude apps gateway обеспечивает атрибуцию использования по пользователям, метрики OTLP с подсчётом токенов и лимиты расходов по пользователям на этих провайдерах.
  • LLM gateway: маршрутизируйте весь трафик Claude Code через прокси, который отслеживает расходы по ключу. Несколько крупных предприятий сообщили об использовании LiteLLM, инструмента с открытым исходным кодом, который отслеживает расходы по ключу. Этот проект не связан с Anthropic и не был проверен на безопасность.

Когда разработчик спрашивает об ограничении

Разработчики обычно обращаются к своему администратору с вопросами об ограничениях, поэтому полезно знать, какой потолок они достигли. Эти ситуации означают разные вещи:
  • “Вы достигли лимита сеанса” или “Вы достигли еженедельного лимита”: ограничение использования на основе места в окне подписки, совместно используемое на всех моделях, поэтому разработчик не может восстановить доступ, переключив модели с помощью /model. Сообщение показывает, когда окно сбросится. После сообщения “Вы достигли лимита Opus” или “Вы достигли лимита Sonnet”, переключение на модель вне этого семейства с помощью /model позволяет разработчику продолжить работу. См. ошибки лимита использования. Что разработчик может сделать в то же время:
  • “Вы достигли индивидуального лимита расходов”, “лимита ежемесячных расходов организации” или “общего бюджета команды”: запрос разработчика будет выставлен в счёт кредитам использования, и эти кредиты достигли лимита расходов, который вы установили. Чтобы позволить разработчику продолжить, перейдите в Параметры администратора > Использование и увеличьте лимит, который называет сообщение. Когда сообщение также называет время сброса плана, разработчик может вместо этого дождаться этого момента. См. справочник по ошибкам для каждого варианта.
  • Сообщение об ограничении расходов от Claude apps gateway: разработчик превысил лимит расходов, который вы установили на своём самостоятельно размещённом шлюзе, и шлюз блокирует его запросы до сброса периода или повышения лимита. См. лимиты расходов шлюза для лимитов, расписания сброса и сообщения, которое видит разработчик.
  • Предупреждение о контексте или auto-compact: не является лимитом использования. Разговор вырос близко к окну auto-compact сеанса, пороговому значению, где Claude Code суммирует более старую историю, чтобы освободить место. Направьте разработчика на снижение использования токенов.
  • Неожиданно высокие расходы на плане API или облачного провайдера: обычно восходит к длительным сеансам, которые никогда не были очищены, или к Opus, оставленному в качестве модели по умолчанию. Наиболее эффективные привычки для совместного использования — это очистка между несвязанными задачами и соответствие модели работе, оба охватываются в снижение использования токенов.

Затраты на токены команды агентов

Команды агентов запускают несколько экземпляров Claude Code, каждый со своим собственным контекстным окном. Использование токенов масштабируется в зависимости от количества активных товарищей по команде и того, как долго каждый из них работает. Чтобы сохранить затраты команды агентов управляемыми:
  • Используйте Sonnet для товарищей по команде. Он обеспечивает баланс между возможностями и стоимостью для задач координации.
  • Держите команды небольшими. Каждый товарищ по команде запускает своё собственное контекстное окно, поэтому использование токенов примерно пропорционально размеру команды.
  • Держите spawn prompts сфокусированными. Товарищи по команде автоматически загружают CLAUDE.md, MCP servers и skills, но всё в spawn prompt добавляется к их контексту с самого начала.
  • Очищайте команды после завершения работы. Активные товарищи по команде продолжают потреблять токены до тех пор, пока они не выйдут или сеанс не завершится.
  • Команды агентов отключены по умолчанию. Установите CLAUDE_CODE_EXPERIMENTAL_AGENT_TEAMS=1 в вашем settings.json или переменной окружения, чтобы включить их. См. включение команд агентов.

Снижение использования токенов

Затраты на токены масштабируются с размером контекста: чем больше контекста обрабатывает Claude, тем больше токенов вы используете. Claude Code автоматически оптимизирует затраты через prompt caching, что снижает затраты на повторяющееся содержимое, такое как системные prompts, и auto-compact, что суммирует историю разговора при приближении к лимитам контекста. Следующие стратегии помогают вам сохранять контекст небольшим и снижать затраты на сообщение.

Управление контекстом проактивно

Используйте /usage для проверки текущего использования токенов или настройте вашу строку состояния для непрерывного отображения.
  • Очищайте между задачами: Используйте /clear для начала с чистого листа при переходе на несвязанную работу. Устаревший контекст тратит токены на каждое последующее сообщение. Используйте /rename перед очисткой, чтобы вы могли легко найти сессию позже, затем /resume для возврата к ней.
  • Добавляйте пользовательские инструкции компактирования: /compact Focus on code samples and API usage говорит Claude, что сохранять во время суммирования. В новой сессии /compact выводит Not enough messages to compact., потому что еще нет истории разговора для суммирования.
Вы также можете настроить поведение компактирования в вашем CLAUDE.md файле в корне вашего проекта:

Выберите правильную модель

Sonnet хорошо справляется с большинством задач кодирования и стоит дешевле, чем Opus. Зарезервируйте Opus для сложных архитектурных решений или многошаговых рассуждений. Используйте /model для переключения моделей в середине сессии или установите значение по умолчанию в /config. Для простых задач subagent укажите model: haiku в вашей конфигурации subagent.

Снижение накладных расходов MCP server

Определения инструментов MCP отложены по умолчанию, поэтому только имена инструментов и инструкции сервера входят в контекст до тех пор, пока Claude не использует конкретный инструмент. Запустите /context для просмотра того, что потребляет пространство.
  • Предпочитайте CLI инструменты, когда доступны: Инструменты, такие как gh, aws, gcloud и sentry-cli, более эффективны по контексту, чем MCP servers, потому что они не добавляют никакой список инструментов. Claude может запускать CLI команды напрямую.
  • Отключайте неиспользуемые servers: Запустите /mcp для просмотра настроенных servers и отключите любые, которые вы не активно используете.

Установите плагины code intelligence для типизированных языков

Плагины code intelligence дают Claude точную навигацию по символам вместо поиска на основе текста, снижая ненужные чтения файлов при изучении незнакомого кода. Один вызов “go to definition” заменяет то, что в противном случае могло бы быть grep, за которым следует чтение нескольких файлов-кандидатов. Установленные языковые серверы также автоматически сообщают об ошибках типов после редактирования, поэтому Claude ловит ошибки без запуска компилятора.

Делегируйте обработку hooks и skills

Пользовательские hooks могут предварительно обрабатывать данные перед тем, как Claude их увидит. Вместо того, чтобы Claude читал файл логов из 10,000 строк для поиска ошибок, hook может выполнить grep для ERROR и вернуть только совпадающие строки, снижая контекст с десятков тысяч токенов до сотен. Skill может дать Claude знание предметной области, чтобы ему не пришлось исследовать. Например, skill “codebase-overview” может описать архитектуру вашего проекта, ключевые директории и соглашения об именовании. Когда Claude вызывает skill, он получает этот контекст немедленно вместо того, чтобы тратить токены на чтение нескольких файлов для понимания структуры. Например, этот hook PreToolUse фильтрует вывод тестов для отображения только сбоев:
Добавьте это в ваш settings.json для запуска hook перед каждой командой Bash:
Для проверки настройки запустите /hooks и проверьте, что hook появляется под PreToolUse. Вы также можете запустить Claude Code с помощью claude --debug-file ./claude-debug.txt и попросить Claude запустить npm test. Когда hook переписывает команду, этот файл логов содержит строку modified tool input keys, в которой указаны command и другие поля ввода Bash.

Переместите инструкции из CLAUDE.md в skills

Ваш файл CLAUDE.md загружается в контекст при запуске сессии. Если он содержит подробные инструкции для конкретных рабочих процессов (такие как PR reviews или миграции баз данных), эти токены присутствуют даже когда вы выполняете несвязанную работу. Skills загружаются по требованию только при вызове, поэтому перемещение специализированных инструкций в skills сохраняет ваш базовый контекст меньшим. Стремитесь сохранять CLAUDE.md под 200 строк, включая только необходимое.

Отрегулируйте расширенное мышление

Расширенное мышление включено по умолчанию, потому что оно значительно улучшает производительность на сложных задачах планирования и рассуждения. Токены мышления выставляются как выходные токены, и бюджет по умолчанию может быть десятки тысяч токенов на запрос в зависимости от модели. Для более простых задач, где глубокое рассуждение не требуется, вы можете снизить затраты, понизив уровень усилий с помощью /effort или в /model, или отключив мышление в /config. Вы не можете отключить мышление на Fable моделях, которые всегда используют расширенное мышление. На моделях с фиксированным бюджетом мышления, вы также можете понизить бюджет путём установки переменной окружения MAX_THINKING_TOKENS environment variable, например MAX_THINKING_TOKENS=8000. Модели адаптивного рассуждения игнорируют ненулевые бюджеты, поэтому используйте вместо этого уровни усилий.

Делегируйте многословные операции subagents

Запуск тестов, получение документации или обработка файлов логов может потребить значительный контекст. Делегируйте эти subagents, чтобы многословный вывод оставался в контексте subagent, в то время как только резюме возвращается в вашу основную беседу.

Управление затратами команды агентов

Команды агентов используют примерно в 7 раз больше токенов, чем стандартные сессии, когда товарищи по команде работают в plan mode, потому что каждый товарищ по команде поддерживает своё собственное контекстное окно и работает как отдельный экземпляр Claude. Держите задачи команды небольшими и самостоятельными, чтобы ограничить использование токенов на товарища по команде. См. команды агентов для деталей.

Пишите конкретные prompts

Расплывчатые запросы, такие как “улучшить эту кодовую базу”, запускают широкое сканирование. Конкретные запросы, такие как “добавить проверку входных данных в функцию входа в auth.ts”, позволяют Claude работать эффективно с минимальными чтениями файлов.

Работайте эффективно над сложными задачами

Для более длительной или сложной работы эти привычки помогают избежать потраченных впустую токенов от неправильного направления:
  • Используйте plan mode для сложных задач: Нажмите Shift+Tab для входа в plan mode перед реализацией. Claude исследует кодовую базу и предлагает подход для вашего одобрения, предотвращая дорогостоящую переделку, когда первоначальное направление неправильно.
  • Корректируйте курс рано: Если Claude начинает идти в неправильном направлении, нажмите Escape для немедленной остановки. Используйте /rewind или двойное нажатие Escape для восстановления разговора и кода к предыдущей контрольной точке.
  • Дайте цели проверки: Включите тестовые случаи, вставьте скриншоты или определите ожидаемый вывод в вашем prompt. Когда Claude может проверить свою собственную работу, он ловит проблемы перед тем, как вам нужно запросить исправления.
  • Тестируйте постепенно: Напишите один файл, протестируйте его, затем продолжайте. Это ловит проблемы рано, когда они дешевы в исправлении.

Использование токенов в фоновом режиме

Claude Code использует токены для некоторой фоновой функциональности даже когда неактивен:
  • Суммирование разговора: Фоновые задания, которые суммируют предыдущие разговоры для функции claude --resume
  • Обработка команд: Некоторые команды, такие как /usage, могут генерировать запросы для проверки статуса
Эти фоновые процессы потребляют небольшое количество токенов (обычно менее $0.04 за сессию) даже без активного взаимодействия.

Почему использование растёт в длительной сессии

Сессия, которая была открыта в течение часов, может использовать намного больше лимитов вашего плана, чем предполагает ваша активность, обычно по одной из этих причин:
  • Длинный контекст: Claude Code отправляет вашу полную беседу с каждым запросом, и каждый раз, когда Claude использует инструменты, он отправляет ещё один запрос с этой партией результатов инструментов. С prompt caching Claude Code перечитывает эту историю по кэшированному тарифу токенов, поэтому однострочный вопрос в сессии, которая была открыта весь день, всё равно потребляет использование для всей беседы. См. Управляйте контекстом проактивно для способов сохранения вашего контекста в малом размере
  • Промахи кэша: ваше первое сообщение после перерыва, превышающего время жизни кэша, промахивает кэш и переобрабатывает ваш полный контекст. Время жизни составляет один час на подписке и снижается до пяти минут, когда вы используете кредиты использования; на API ключе или облачном провайдере это пять минут по умолчанию. Чтобы сохранить время жизни в один час при использовании кредитов использования, выберите TTL самостоятельно. На планах Pro и Max, когда вы возобновляете большую сессию после длительного перерыва, Claude Code предлагает возобновить с резюме, чтобы более поздние запросы не несли полную историю
  • Запланированные задачи: запланированная задача срабатывает по своему интервалу даже во время простоя сессии, отправляя ваш полный контекст каждый раз
  • Сообщения между сессиями: Claude Code доставляет сообщение из другой вашей сессии как новый ход, когда эта сессия находится в режиме ожидания, отправляя ваш полный контекст каждый раз. Чтобы удерживать входящие сообщения вместо их доставки, установите crossSessionInbound на hold
  • Проверки целей: пока фоновая работа держит активную цель в ожидании, Claude Code просит Claude проверить эту работу даже когда сессия находится в режиме ожидания, начиная новый ход, который отправляет ваш полный контекст. Claude Code начинает максимум три проверки в режиме ожидания на цель между вашими подсказками. До версии v2.1.246 проверки в режиме ожидания были неограниченными. Чтобы отключить проверки, установите CLAUDE_CODE_GOAL_CHECKIN_MINUTES на 0. Проверки в режиме ожидания требуют Claude Code v2.1.236 или позже
  • Товарищи-агенты: каждый активный товарищ продолжает потреблять токены до выхода
  • Компактность: /compact читает беседу, которую он суммирует, поэтому компактирование большого контекста само по себе является большим запросом. Когда вы хотите свежее начало вместо непрерывности, /clear ничего не стоит
На плане Pro, Max, Team или Enterprise, разбор /usage отмечает поведения, которые составляют 10% или более вашего недавнего использования, такие как длинный контекст или промахи кэша, каждый с советом по его снижению.

Понимание изменений в поведении Claude Code

Claude Code регулярно получает обновления, которые могут изменить способ работы функций, включая отчетность о затратах. Запустите claude --version, чтобы проверить вашу текущую версию. По вопросам выставления счетов для вашего конкретного аккаунта обратитесь в службу поддержки Anthropic через встроенный мессенджер:
  • Планы подписки (Pro, Max, Team, Enterprise): войдите на claude.ai, нажмите на ваши инициалы в нижнем левом углу и выберите Get help
  • Выставление счетов Console (API): войдите на platform.claude.com, нажмите на ваши инициалы и выберите Get help
См. How to get support для полного процесса, включая информацию о том, кто может связаться с представителем поддержки на каждом плане.