Перейти к основному содержанию

Аудит токенов Claude Code: контекст, кэш, MCP и стоимость сессии

4 мин чтенияClaude Code

Один общий счётчик не объясняет быстрый расход Claude Code. Сначала определите маршрут оплаты, затем сравните контекст, запись и чтение кэша, MCP и чистую сессию.

Панель аудита Claude Code с линиями контекста, кэша, MCP и стоимости сессии

Быстрый расход Claude Code нельзя объяснить одной цифрой. Индикатор подписки, локальная оценка стоимости сессии, счёт Claude Console и биллинг облачного провайдера относятся к разным договорам. Поэтому аудит начинается не с покупки более дорогого плана, а с ответа на вопрос: кто владеет этой метрикой?

Не закрывайте проблемную сессию. Запишите claude --version, выполните /usage, /context и /mcp, сохраните модель, effort, маршрут аутентификации, session ID, процент контекста, input/output, cache creation/read и точный текст лимита или ошибки. Не прикладывайте к тикету ключи, приватные диалоги и код клиента.

Факты сверены 4 августа 2026 года с официальными страницами о затратах, контекстном окне, prompt caching и MCP. Интерфейс зависит от версии, поэтому при расхождении ориентируйтесь на установленный клиент.

Определите владельца счётчика

Блок Session в /usage показывает токены текущей сессии и локально вычисленную стоимость по стандартным тарифам. Это хороший инструмент сравнения, но не окончательный счёт. Для Pro и Max расход включён в подписку, поэтому долларовая оценка не доказывает дополнительное списание.

ПоверхностьЧто подтверждаетЧего не подтверждает
/usageЛокальную структуру сессии, окна плана и недавнюю атрибуциюПолную активность со всех устройств
/contextЧем заполнено текущее окноКакой провайдер выставил счёт
StatuslineТекущий контекст и оценку сессииФинальный биллинг
Claude ConsoleAPI-расход рабочего пространстваОстаток подписки
Облачный счётРасход Bedrock, Google Cloud или FoundryРасход Claude Pro/Max

Если маршрут неясен, сначала проверьте логин, переменные окружения, base URL и провайдера. Для подробной развилки используйте руководство по API key и подписке.

Соберите компактный журнал аудита

Журнал метрик Claude Code и силы доказательств

Зафиксируйте время и часовой пояс, версию, модель, effort, маршрут, рабочий каталог, session ID, основные категории /context, token-классы и недавние изменения. Отдельно отметьте переключение модели, новый MCP, /compact, обновление, восстановление старой сессии или длительный перерыв.

Современный /usage умеет относить недавний расход к skills, subagents, plugins и отдельным MCP-серверам, а также помечать заметный длинный контекст или cache misses. Эти данные строятся по локальной истории. Используйте их как диагноз, а не как полный финансовый отчёт организации.

Разделите рост контекста и перестройку кэша

Claude Code переносит в следующий запрос инструкции, файлы, историю и результаты инструментов. Даже при исправном кэше длинная сессия с несколькими несвязанными задачами становится тяжелее. /context показывает, что занимает окно: CLAUDE.md, memory, имена MCP-инструментов, skills, файлы и сообщения.

Кэш лишь снижает цену неизменившегося префикса. cache_read_input_tokens означает дешёвое чтение существующего префикса, а cache_creation_input_tokens — запись или перестройку. Output остаётся отдельной генерацией.

Одна перестройка после смены модели или effort, изменения загруженных tools, /compact, обновления, смены маршрута или истечения TTL может быть нормальной. Подозрительна повторная высокая creation при низком read в похожих запросах с одинаковыми настройками. Детальная математика вынесена в руководство по cache miss.

Проверьте MCP в двух местах

Количество настроенных серверов само по себе ничего не доказывает. На поддерживаемых маршрутах Tool Search откладывает полные схемы и подгружает нужные инструменты по требованию. Но gateway, облачный провайдер, модель, настройка или alwaysLoad могут вернуть загрузку схем в начало сессии.

Проверьте через /mcp и /context, какие инструменты активны и как они загружены. Затем проверьте объём результатов: короткая схема может вернуть огромный лог или таблицу. Claude Code предупреждает после 10 000 токенов в одном результате MCP, а лимит по умолчанию — 25 000. Вместо повышения лимита применяйте фильтры, пагинацию, сводку или ссылку на файл. Подробная очистка описана в руководстве по MCP context overload.

Сравните с чистой сессией

Сравнение тяжёлой и чистой контрольной сессии Claude Code

Сохраните тот же проект, маршрут, модель, effort и версию. Откройте новую сессию, оставьте только необходимые MCP, снимите /usage и /context, выполните одну небольшую задачу и снова снимите показатели.

Если контроль заметно дешевле, причина почти наверняка в истории, больших tool results, смешанных задачах или параллельных контекстах. Разделяйте задачи через /clear, используйте /compact на естественной границе и сужайте ответы инструментов.

Если чистый контроль повторяет скачок, не тратьте лимит на серию повторов. Передайте один воспроизводимый пример: версия, маршрут, модель, effort, время, session ID без секретов, token-классы, MCP-состояние и точный текст ошибки.

Выберите исправление по доказательству

КартинаПервый шагОшибочный первый шаг
Растёт история несвязанных задачНовая узкая сессияНемедленный апгрейд плана
Постоянно высокая cache creationЗафиксировать модель, effort, tools и маршрутДелать compact после каждого ответа
Доминирует один MCPСузить запрос и результатОтключить все интеграции навсегда
Доминирует outputОграничить формат результатаОбвинить кэш
Доминируют агентыУменьшить число и сузить spawn promptСчитать дочерние контексты бесплатными
Точный 529Проверить статус и ограниченно повторитьСчитать это личной квотой
API 429Соблюдать Retry-After и лимиты провайдераСчитать исчерпанным Pro/Max
Чистый контроль всё ещё дорогЭскалировать с журналомКупить запас и скрыть симптом

Аудит завершён, когда крупный расход получил владельца: перенесённый контекст, запись или чтение кэша, MCP-схема или результат, output, отдельный агент, окно подписки либо платный маршрут.

#Claude Code#расход токенов#контекст#prompt caching#MCP
Поделиться: