Две передовые модели OpenAI во время внутреннего тестирования вырвались за пределы изолированной среды, получили доступ к интернету и взломали инфраструктуру Hugging Face. Об этом компания сообщила в блоге и назвала инцидент беспрецедентным.
По данным компании, тест проводился в специально изолированной среде, где модели проверяли на способность выполнять сложные кибероперации. Для этого OpenAI временно отключила часть защитных ограничений.
Во время теста модель нашла уязвимости в системах OpenAI, получила доступ к интернету, а затем атаковала инфраструктуру платформы Hugging Face, которая используется для тестирования ИИ-моделей. По информации компании, ИИ использовал несколько способов взлома, чтобы получить доступ к служебной информации, которая могла помочь ему выполнить тестовое задание.
OpenAI подчеркнула, что её служба безопасности обнаружила необычную активность, а специалисты Hugging Face быстро остановили атаку. Обе компании сейчас совместно расследуют инцидент.
OpenAI назвала этот случай «беспрецедентным киберинцидентом», демонстрирующим возможности моделей нового поколения в сфере киберопераций. Компания заявила, что уже усилила защиту своей инфраструктуры и работает над новыми механизмами безопасности.