Быстрый расход Claude Code нельзя объяснить одной цифрой. Индикатор подписки, локальная оценка стоимости сессии, счёт Claude Console и биллинг облачного провайдера относятся к разным договорам. Поэтому аудит начинается не с покупки более дорогого плана, а с ответа на вопрос: кто владеет этой метрикой?
Не закрывайте проблемную сессию. Запишите claude --version, выполните /usage, /context и /mcp, сохраните модель, effort, маршрут аутентификации, session ID, процент контекста, input/output, cache creation/read и точный текст лимита или ошибки. Не прикладывайте к тикету ключи, приватные диалоги и код клиента.
Факты сверены 4 августа 2026 года с официальными страницами о затратах, контекстном окне, prompt caching и MCP. Интерфейс зависит от версии, поэтому при расхождении ориентируйтесь на установленный клиент.
Определите владельца счётчика
Блок Session в /usage показывает токены текущей сессии и локально вычисленную стоимость по стандартным тарифам. Это хороший инструмент сравнения, но не окончательный счёт. Для Pro и Max расход включён в подписку, поэтому долларовая оценка не доказывает дополнительное списание.
| Поверхность | Что подтверждает | Чего не подтверждает |
|---|---|---|
/usage | Локальную структуру сессии, окна плана и недавнюю атрибуцию | Полную активность со всех устройств |
/context | Чем заполнено текущее окно | Какой провайдер выставил счёт |
| Statusline | Текущий контекст и оценку сессии | Финальный биллинг |
| Claude Console | API-расход рабочего пространства | Остаток подписки |
| Облачный счёт | Расход Bedrock, Google Cloud или Foundry | Расход Claude Pro/Max |
Если маршрут неясен, сначала проверьте логин, переменные окружения, base URL и провайдера. Для подробной развилки используйте руководство по API key и подписке.
Соберите компактный журнал аудита

Зафиксируйте время и часовой пояс, версию, модель, effort, маршрут, рабочий каталог, session ID, основные категории /context, token-классы и недавние изменения. Отдельно отметьте переключение модели, новый MCP, /compact, обновление, восстановление старой сессии или длительный перерыв.
Современный /usage умеет относить недавний расход к skills, subagents, plugins и отдельным MCP-серверам, а также помечать заметный длинный контекст или cache misses. Эти данные строятся по локальной истории. Используйте их как диагноз, а не как полный финансовый отчёт организации.
Разделите рост контекста и перестройку кэша
Claude Code переносит в следующий запрос инструкции, файлы, историю и результаты инструментов. Даже при исправном кэше длинная сессия с несколькими несвязанными задачами становится тяжелее. /context показывает, что занимает окно: CLAUDE.md, memory, имена MCP-инструментов, skills, файлы и сообщения.
Кэш лишь снижает цену неизменившегося префикса. cache_read_input_tokens означает дешёвое чтение существующего префикса, а cache_creation_input_tokens — запись или перестройку. Output остаётся отдельной генерацией.
Одна перестройка после смены модели или effort, изменения загруженных tools, /compact, обновления, смены маршрута или истечения TTL может быть нормальной. Подозрительна повторная высокая creation при низком read в похожих запросах с одинаковыми настройками. Детальная математика вынесена в руководство по cache miss.
Проверьте MCP в двух местах
Количество настроенных серверов само по себе ничего не доказывает. На поддерживаемых маршрутах Tool Search откладывает полные схемы и подгружает нужные инструменты по требованию. Но gateway, облачный провайдер, модель, настройка или alwaysLoad могут вернуть загрузку схем в начало сессии.
Проверьте через /mcp и /context, какие инструменты активны и как они загружены. Затем проверьте объём результатов: короткая схема может вернуть огромный лог или таблицу. Claude Code предупреждает после 10 000 токенов в одном результате MCP, а лимит по умолчанию — 25 000. Вместо повышения лимита применяйте фильтры, пагинацию, сводку или ссылку на файл. Подробная очистка описана в руководстве по MCP context overload.
Сравните с чистой сессией

Сохраните тот же проект, маршрут, модель, effort и версию. Откройте новую сессию, оставьте только необходимые MCP, снимите /usage и /context, выполните одну небольшую задачу и снова снимите показатели.
Если контроль заметно дешевле, причина почти наверняка в истории, больших tool results, смешанных задачах или параллельных контекстах. Разделяйте задачи через /clear, используйте /compact на естественной границе и сужайте ответы инструментов.
Если чистый контроль повторяет скачок, не тратьте лимит на серию повторов. Передайте один воспроизводимый пример: версия, маршрут, модель, effort, время, session ID без секретов, token-классы, MCP-состояние и точный текст ошибки.
Выберите исправление по доказательству
| Картина | Первый шаг | Ошибочный первый шаг |
|---|---|---|
| Растёт история несвязанных задач | Новая узкая сессия | Немедленный апгрейд плана |
| Постоянно высокая cache creation | Зафиксировать модель, effort, tools и маршрут | Делать compact после каждого ответа |
| Доминирует один MCP | Сузить запрос и результат | Отключить все интеграции навсегда |
| Доминирует output | Ограничить формат результата | Обвинить кэш |
| Доминируют агенты | Уменьшить число и сузить spawn prompt | Считать дочерние контексты бесплатными |
Точный 529 | Проверить статус и ограниченно повторить | Считать это личной квотой |
API 429 | Соблюдать Retry-After и лимиты провайдера | Считать исчерпанным Pro/Max |
| Чистый контроль всё ещё дорог | Эскалировать с журналом | Купить запас и скрыть симптом |
Аудит завершён, когда крупный расход получил владельца: перенесённый контекст, запись или чтение кэша, MCP-схема или результат, output, отдельный агент, окно подписки либо платный маршрут.



