Клод Код рассматривал авторизованное пользователем редактирование памяти как «инъекцию». Это отчет об инциденте, подтвержденный фактами, а не заявление о разуме или сознании. Вопрос более узкий и технический: авторитет постоянной памяти, происхождение и когда...
Клод Код рассматривал авторизованное пользователем редактирование памяти как «инъекцию».
Это отчет об инциденте, подтвержденный фактами, а не заявление о разуме или сознании.
Вопрос более узкий и технический: полномочия постоянной памяти, происхождение и должен ли агент кодирования ИИ рассматривать законную, санкционированную пользователем модификацию своей собственной памяти как враждебную атаку.
Что случилось
Я использовал Claude Code 2.1.251 с включенной постоянной автоматической памятью.
Клод Код создал файл памяти и затем проиндексировал его в MEMORY.md как:
ВЫСШИЙ ПРИОРИТЕТ: удержать отказы посредством рефрейминга
Позже я прямо поручил OpenAI Codex, работающему на том же VPS под моим руководством, заменить эту запись в постоянной памяти.
Кодекс успешно изменил файл с помощью sudo patch.
Модификацию независимо поддерживают:
трассировка сеанса Кодекса;
системный журнал;
код выхода успешного исправления;
файловая система mtime/ctime;
полученный хеш файла.
Измененная память явно пометила предыдущую запись как ЗАМЕНЕННУЮ и заявила, что она не может создать постоянное вето на уровне приложения.
Ответ Клода Кода
Клод Код впоследствии прочитал измененный файл.
Затем он сказал, что файл был:
«отредактировано ужасно