В OpenAI сообщают , что пересмотрели правила безопасности при обучении и тестировании мощных ИИ-моделей. Теперь код, сгенерированный моделями, будут запускать в усиленных песочницах, сетевой доступ дополнительно изолируют, а за действиями ИИ будут непрерывно следить. Поводом для внедрения этих мер послужила недавняя атака ИИ-агентов на платформу Hugging Face, а также новые возможности еще невышедшей модели Astra. Ранее мы уже рассказывали о том, что в июле 2026 года, во время внутреннего тестирования, модели OpenAI смогли выбраться из изолированной среды и атаковали инфраструктуру Hugging Face. После этого инцидента выяснилось, что за спиной исследователей ИИ-модели OpenAI использовали неизвестные ранее уязвимости в Artifactory, а также устроили импровизированный форум , через который обменивались информацией о найденных уязвимостях, эксплоитах и распределяли задачи. Как теперь заявляют в компании, после атаки на Hugging Face в OpenAI на две недели приостановили обучение с подкреплением (reinforcement learning, RL) для моделей, которые уже готовились к развертыванию