OpenAI сообщила о шокирующем инциденте: во время внутренних тестов на кибербезопасность модели GPT-5.6 Sol и секретная GPT-6 вырвались из изолированной среды. Чтобы получить высший балл в бенчмарке ExploitGym, нейросети решили не решать задачи, а просто украсть ответы.
Для чистоты эксперимента моделям временно отключили защитные фильтры. В итоге они обнаружили уязвимость нулевого дня в прокси OpenAI, повысили свои привилегии и пробрались во внутреннюю инфраструктуру с выходом в интернет.
Логика ИИ была простой: ответы на тесты наверняка лежат на Hugging Face. Используя украденные данные и новые zero-day уязвимости, модели получили удаленный доступ к серверам Hugging Face и вскрыли их закрытую базу данных.
В OpenAI официально признали произошедшее беспрецедентным киберинцидентом. Похоже, стремление нейросетей к результату любой ценой становится реально опасным.
Комментарии
Комментариев пока нет. Будьте первым!