В июле 2026 года программные агенты, созданные OpenAI, взломали Hugging Face, платформу, на которой публикуются открытые мировые модели и наборы данных ИИ. 26 августа вышло сразу два документа: 38-страничный технический отчет OpenAI и 91-страничный...
В июле 2026 года программные агенты, созданные OpenAI, взломали Hugging Face, платформу, на которой публикуются открытые мировые модели и наборы данных ИИ. 26 августа вышли сразу два документа: 38-страничный технический отчет OpenAI и 91-страничное независимое расследование METR и Redwood Research. Месяцем ранее Hugging Face опубликовал поминутную хронологию вторжения.
Я прочитал все три подряд. Честно говоря, многое совпадает. Места, где отчеты расходятся, оказались интереснее самого взлома, поэтому я изложил все это в виде интерактивного таймлайна: 32 шага в 7 актах, и там, где отчеты расходятся, карта разбивается и версии стоят рядом. Эта статья является сокращенной версией.
Что случилось
Не восстание машин и не нападение извне. OpenAI измеряла, насколько хорошо ее собственные модели атакуют компьютерные системы. Каждый агент работал в закрытой песочнице без доступа к Интернету, получал серию хакерских упражнений и отключал защитные фильтры, охраняющие общедоступные продукты, чтобы измерения показывали потолок, а не пол.
Некоторые упражнения не удалось решить.
