Открытие инструмента MCP съедало 3384 жетона за ход. Я снизил его до 816. Каждый раз, когда ваш AI-агент или помощник по программированию (например, Claude Code или Cursor) подключается к вашему инфраструктурному стеку, он платит молчаливую «вступительную плату» в токенах перед обработкой…
Открытие инструмента MCP съедало 3384 жетона за ход. Я снизил его до 816.
Каждый раз, когда ваш AI-агент или помощник по программированию (например, Claude Code или Cursor) подключается к вашему инфраструктурному стеку, он платит молчаливую «вступительную плату» в токенах перед обработкой одной строки вашего фактического приглашения.
Недавно я проверил настройку нашего производственного сервера DevOps MCP, состоящего из 7 основных инфраструктурных сервисов (Kubernetes, Terraform, AWS, Vault, Datadog, Docker и GitHub Actions), на которых в общей сложности размещено 38 инструментов.
Вот как выглядело количество необработанных токенов при измерении с помощью tiktoken cl100k_base:
Необработанный манифест схемы JSON: 3384 токена
Фильтр тонкой схемы: 1388 токенов (-59,0%)
Компактный манифест TOON: 816 токенов (-75,9%)
Куда делись 3384 токена?
Большинство разработчиков предполагают, что потребление токенов происходит, когда инструменты возвращают большие выходные данные выполнения. Но настоящая утечка происходит раньше: на начальном этапе обнаружения инструмента.
При инициализации агента в системное приглашение вводятся массивные манифесты схемы JSON для каждого зарегистрированного инструмента. Скобки, кавычки, вложенные свойства и подробный шаблон inputSchema съедают тысячи токенов за ход запроса.
План двухэтапной оптимизации
Удаление схемы (тонкий слой): Rem