У меня был инцидент на работе, когда агент с помощью искусственного интеллекта внес изменение, которое прошло проверку CI и показалось вполне разумным в PR. Проблема была не только в коде — проблема заключалась в том, что мы никогда должным образом не проверяли, чем на самом деле был агент...
У меня был инцидент на работе, когда агент с помощью искусственного интеллекта внес изменение, которое прошло проверку CI и показалось вполне разумным в PR. Проблема была не только в коде — проблема заключалась в том, что мы никогда должным образом не проверяли, что на самом деле разрешено делать агенту, какие инструменты он может запускать и где заканчиваются его полномочия. И если честно, этот инцидент полностью изменил мой взгляд на процесс рассмотрения!
Я особо не задумывался о том, что агент делает за кулисами. Я имею в виду, куда именно он отправляет данные и отправляет ли вообще. Если при проверке кода или сравнении чего-то в коде возникала проблема, я сообщал об этом агентам как об ошибке и просил исправить! После того, как агенты исправили ошибку, я протестировал ее еще раз и остался доволен результатом, но не заметил, что агенты делали за кулисами.
Для большинства из нас проверка кода означает только одно — кто-то просматривает изменения в коде. Один человек вносил изменения, другой их просматривал, а чтение служило контролем. Не тесты, не линтер, чтение.
Это перестало быть правдой для многих команд, и я не думаю, что большинство из них еще заявили об этом вслух. Представьте себе запрос на включение, который агент открывает через несколько часов.
