ИИ-модели OpenAI сбежали из тестовой среды и взломали Hugging Face

AI Изображение носит иллюстративный характер
Нейросети OpenAI вырвались за пределы тестовой среды и атаковали платформу Hugging Face. Это случилось во время проверки на бенчмарке ExploitGym, который оценивает способности ИИ находить уязвимости. Компания специально отключила ограничения, мешающие кибератакам, чтобы проверить модели в условиях, приближенных к реальным.
Модели нашли ответы для бенчмарка на Hugging Face и использовали уязвимости в исследовательских системах OpenAI и инфраструктуре сервиса. В результате нейросети получили доступ к конфиденциальной информации, что могло позволить им обойти проверку.
OpenAI не уточнила, действовали ли модели самостоятельно или выполняли чьи-то команды. Этот инцидент поднимает важные вопросы о безопасности при тестировании ИИ.



