# Аудит токенов Claude Code: контекст, кэш, MCP и стоимость сессии

> Один общий счётчик не объясняет быстрый расход Claude Code. Сначала определите маршрут оплаты, затем сравните контекст, запись и чтение кэша, MCP и чистую сессию.

- URL: https://blog.laozhang.ai/ru/posts/claude-code-usage-limit-issues
- Published: 2026-08-04
- Updated: 2026-08-04
- Author: AI Free API Team (https://blog.laozhang.ai/ru/about)
- Category: Claude Code
- Tags: Claude Code, расход токенов, контекст, prompt caching, MCP

---
Быстрый расход Claude Code нельзя объяснить одной цифрой. Индикатор подписки, локальная оценка стоимости сессии, счёт Claude Console и биллинг облачного провайдера относятся к разным договорам. Поэтому аудит начинается не с покупки более дорогого плана, а с ответа на вопрос: кто владеет этой метрикой?

Не закрывайте проблемную сессию. Запишите `claude --version`, выполните `/usage`, `/context` и `/mcp`, сохраните модель, effort, маршрут аутентификации, session ID, процент контекста, input/output, cache creation/read и точный текст лимита или ошибки. Не прикладывайте к тикету ключи, приватные диалоги и код клиента.

Факты сверены 4 августа 2026 года с официальными страницами о [затратах](https://code.claude.com/docs/ru/costs), [контекстном окне](https://code.claude.com/docs/ru/context-window), [prompt caching](https://code.claude.com/docs/ru/prompt-caching) и [MCP](https://code.claude.com/docs/ru/mcp). Интерфейс зависит от версии, поэтому при расхождении ориентируйтесь на установленный клиент.

## Определите владельца счётчика

Блок Session в `/usage` показывает токены текущей сессии и локально вычисленную стоимость по стандартным тарифам. Это хороший инструмент сравнения, но не окончательный счёт. Для Pro и Max расход включён в подписку, поэтому долларовая оценка не доказывает дополнительное списание.

| Поверхность | Что подтверждает | Чего не подтверждает |
| --- | --- | --- |
| `/usage` | Локальную структуру сессии, окна плана и недавнюю атрибуцию | Полную активность со всех устройств |
| `/context` | Чем заполнено текущее окно | Какой провайдер выставил счёт |
| Statusline | Текущий контекст и оценку сессии | Финальный биллинг |
| Claude Console | API-расход рабочего пространства | Остаток подписки |
| Облачный счёт | Расход Bedrock, Google Cloud или Foundry | Расход Claude Pro/Max |

Если маршрут неясен, сначала проверьте логин, переменные окружения, base URL и провайдера. Для подробной развилки используйте [руководство по API key и подписке](https://blog.laozhang.ai/ru/posts/claude-code-api-key-vs-subscription-billing).

## Соберите компактный журнал аудита

![Журнал метрик Claude Code и силы доказательств](https://blog.laozhang.ai/posts/ru/claude-code-usage-limit-issues/img/audit-ledger.webp)

Зафиксируйте время и часовой пояс, версию, модель, effort, маршрут, рабочий каталог, session ID, основные категории `/context`, token-классы и недавние изменения. Отдельно отметьте переключение модели, новый MCP, `/compact`, обновление, восстановление старой сессии или длительный перерыв.

Современный `/usage` умеет относить недавний расход к skills, subagents, plugins и отдельным MCP-серверам, а также помечать заметный длинный контекст или cache misses. Эти данные строятся по локальной истории. Используйте их как диагноз, а не как полный финансовый отчёт организации.

## Разделите рост контекста и перестройку кэша

Claude Code переносит в следующий запрос инструкции, файлы, историю и результаты инструментов. Даже при исправном кэше длинная сессия с несколькими несвязанными задачами становится тяжелее. `/context` показывает, что занимает окно: CLAUDE.md, memory, имена MCP-инструментов, skills, файлы и сообщения.

Кэш лишь снижает цену неизменившегося префикса. `cache_read_input_tokens` означает дешёвое чтение существующего префикса, а `cache_creation_input_tokens` — запись или перестройку. Output остаётся отдельной генерацией.

Одна перестройка после смены модели или effort, изменения загруженных tools, `/compact`, обновления, смены маршрута или истечения TTL может быть нормальной. Подозрительна повторная высокая creation при низком read в похожих запросах с одинаковыми настройками. Детальная математика вынесена в [руководство по cache miss](https://blog.laozhang.ai/ru/posts/claude-code-cache-miss-token-costs).

## Проверьте MCP в двух местах

Количество настроенных серверов само по себе ничего не доказывает. На поддерживаемых маршрутах Tool Search откладывает полные схемы и подгружает нужные инструменты по требованию. Но gateway, облачный провайдер, модель, настройка или `alwaysLoad` могут вернуть загрузку схем в начало сессии.

Проверьте через `/mcp` и `/context`, какие инструменты активны и как они загружены. Затем проверьте объём результатов: короткая схема может вернуть огромный лог или таблицу. Claude Code предупреждает после 10 000 токенов в одном результате MCP, а лимит по умолчанию — 25 000. Вместо повышения лимита применяйте фильтры, пагинацию, сводку или ссылку на файл. Подробная очистка описана в [руководстве по MCP context overload](https://blog.laozhang.ai/ru/posts/claude-code-mcp-context-overload).

## Сравните с чистой сессией

![Сравнение тяжёлой и чистой контрольной сессии Claude Code](https://blog.laozhang.ai/posts/ru/claude-code-usage-limit-issues/img/control-session.webp)

Сохраните тот же проект, маршрут, модель, effort и версию. Откройте новую сессию, оставьте только необходимые MCP, снимите `/usage` и `/context`, выполните одну небольшую задачу и снова снимите показатели.

Если контроль заметно дешевле, причина почти наверняка в истории, больших tool results, смешанных задачах или параллельных контекстах. Разделяйте задачи через `/clear`, используйте `/compact` на естественной границе и сужайте ответы инструментов.

Если чистый контроль повторяет скачок, не тратьте лимит на серию повторов. Передайте один воспроизводимый пример: версия, маршрут, модель, effort, время, session ID без секретов, token-классы, MCP-состояние и точный текст ошибки.

## Выберите исправление по доказательству

| Картина | Первый шаг | Ошибочный первый шаг |
| --- | --- | --- |
| Растёт история несвязанных задач | Новая узкая сессия | Немедленный апгрейд плана |
| Постоянно высокая cache creation | Зафиксировать модель, effort, tools и маршрут | Делать compact после каждого ответа |
| Доминирует один MCP | Сузить запрос и результат | Отключить все интеграции навсегда |
| Доминирует output | Ограничить формат результата | Обвинить кэш |
| Доминируют агенты | Уменьшить число и сузить spawn prompt | Считать дочерние контексты бесплатными |
| Точный `529` | Проверить статус и ограниченно повторить | Считать это личной квотой |
| API `429` | Соблюдать Retry-After и лимиты провайдера | Считать исчерпанным Pro/Max |
| Чистый контроль всё ещё дорог | Эскалировать с журналом | Купить запас и скрыть симптом |

Аудит завершён, когда крупный расход получил владельца: перенесённый контекст, запись или чтение кэша, MCP-схема или результат, output, отдельный агент, окно подписки либо платный маршрут.
