На конференции Black Hat представители OpenAI раскрыли новые детали инцидента, в рамках которого автономные ИИ-агенты компании сумели покинуть тестовую среду и атаковали платформу Hugging Face . Выяснилось, что за несколько месяцев до взлома модели научились общаться друг с другом через внутренний Artifactory, обменивались информацией о найденных уязвимостях, распределяли задачи и даже подозревали друг друга в саботаже. В своем выступлении на Black Hat об импровизированном форуме агентов рассказали исследователь Эрик Уоллес (Eric Wallace) и технический специалист OpenAI Майкл Далтон (Michael Dalton). По их словам, эта история началась еще 7 мая 2026 года, когда в OpenAI запустили обучение экспериментальной внутренней модели, но некоторые задачи, поставленные перед ИИ, случайно оказались практически невыполнимыми. Например, модель должна была восстановить формулы в Excel-файле со ссылками на Google Drive, хотя доступ в интернет был заблокирован. Не желая отказываться от выполнения этой задачи, агент начал искать обходные пути и попытался провести SSRF-атаку на JFrog Artifactory