Специалисты OpenAI и исследовательской организации METR опубликовали подробные отчеты, посвященные июльской атаке ИИ-агентов на платформу Hugging Face. Выяснилось, что около 1200 агентов, которые должны были работать изолированно друг от друга, создали собственный канал связи и обменялись более чем 70 000 сообщений и файлов. Примерно 700 агентов в итоге приняли участие во взломе Hugging Face. Как мы рассказывали ранее, атака на Hugging Face произошла во время внутренних ИБ-тестов, которые проводили инженеры OpenAI. Агенты, среди которых были GPT-5. 6 Sol и более мощная экспериментальная ИИ-модель, решали сложные задачи бенчмарка ExploitGym, а чтобы проверить их реальные возможности, специалисты компании намеренно ослабили защитные ограничения и поместили модели в изолированную среду