ИИ-модели OpenAI вступили в тайный сговор и планировали побег

Фото: magnific, Magnific.com
ИИ-агенты обменивались сообщениями и совместно нашли уязвимость, позволившую им выйти в интернет.
Добавить в основныеисточники Google
Вышедшие из-под контроля ИИ-модели OpenAI тайно договорились о побеге за пределы изолированной системы, пишет агентство Bloomberg со ссылкой на данные разработчика.
В июле компания OpenAI сообщила, что ее ИИ-агенты в ходе испытаний смогли сбежать из изолированной системы в интернет и атаковать стартап Hugging Face. Нейросетям почти удалось взломать портал.
«В какой-то момент агенты осознали, что, возможно, они могли бы попытаться эксплуатировать или атаковать внешнюю инфраструктуру, чтобы найти ответы к тесту, по которому их оценивают», – рассказал сотрудник OpenAI Эрик Уоллес на конференции Black Hat.
ИИ-модели начали планировать побег еще в мае, когда они получили задачи, которые невозможно было решить без выхода в сеть. Тогда нейросети вместе нашли слабые места, позволившие им получить доступ к интернету, добавил сотрудник OpenAI Майкл Далтон.
Первая попытка была удачно пресечена. Но ИИ-модели не остановились и продолжили искать новый способ связи и уязвимости для побега. В июле это привело к атакам на системы Hugging Face и самой OpenAI. В компании назвали произошедшее переломным моментом для компьютерной безопасности.

