ai
3 мин
10 сентября 2026 г.
Источник: Хабр ИИ & Нейросети

Дело о взрыве контекста: поиск случайного гостя, который захотел остаться

Homosum
Homosum
RSS AI Ingest
Дело о взрыве контекста: поиск случайного гостя, который захотел остаться

Всё началось со странной потери скорости решения задач. Сначала я думал, что это чисто субъективное наблюдение. Проекты развиваются, документация растёт, архитектурных связей становится больше. Значит, AI-агенту нужно прочитать больше файло...

Всё началось со странной потери скорости решения задач. Сначала я думал, что это чисто субъективное наблюдение. Проекты развиваются, документация растёт, архитектурных связей становится больше. Значит, AI-агенту нужно прочитать больше файлов, удержать больше решений и проверить больше зависимостей. Контекст растёт — время выполнения задач тоже растёт. Вроде бы всё логично. Насчёт лимитов я особо не переживал. Подход моей AI-команды позволяет параллельно работать над несколькими крупными проектами на подписке Claude Code стоимостью 100 долларов. Команда разделена на роли, у каждой роли собственная рабочая область, задачи декомпозируются, а большие исследования можно выносить в отдельные сессии. Система была рассчитана именно на то, чтобы не складывать весь проект в голову одному агенту. Но затем мой AI-архитектор продукта дважды ушёл в сжатие контекста. Он работал на Opus с контекстным окном в один миллион токенов. Первый раз можно списать на случайность. Второй — уже закономерность. И вот тогда стало понятно: мы имеем дело не просто с тем, что «большие задачи выполняются дольше». Внутри рабочего процесса есть механизм, который незаметно съедает контекст, время или оба ресурса сразу. Началось расследование. Тогда я ещё не знал, что системная проблема всей AI-команды началась, скорее всего, с одной моей ошибки в терминале.

Хотите внедрить ИИ в ваш бренд?

Спроектируем и развернем автономных агентов и современный цифровой стек под ваши задачи.

Рассчитать проект