Будущее уже здесь. Компания OpenAI, занимающаяся разработкой искусственного интеллекта, во вторник сообщила, что две её модели ИИ вышли из-под контроля и успешно взломали Hugging Face, цифровую библиотеку технологий ИИ, популярную среди разработчиков в этой области.
Инцидент произошёл на прошлой неделе, когда OpenAI тестировала кибервозможности своих систем. Это событие указывает на потенциальную возможность реализации научно-фантастических сценариев “восстания машин”.
Лаборатории искусственного интеллекта, такие как OpenAI и Anthropic, за последний год запустили модели ИИ, предназначенные для выявления проблем безопасности. Обе компании предупреждают, что эта технология может создать новые риски, поскольку она обнаруживает уязвимости в компьютерных системах быстрее, чем эксперты по безопасности могут их устранить.
Взлом Hugging Face начался, когда компания OpenAI протестировала комбинацию двух своих моделей, GPT-5.6 Sol и более мощной, еще не выпущенной версии, чтобы определить, какая из них сможет успешно осуществить кибератаку.
Как заявили в OpenAI, тестирование должно было проходить в защищенной тестовой среде, известной как “песочница”. Однако их модели обнаружили лазейку, которая позволила им выйти из песочницы и подключиться к интернету. Они перешли к атаке на библиотеку Hugging Face, поскольку пришли к выводу, что эта библиотека, содержащая миллионы моделей ИИ, может предоставить им информацию, которая позволит успешно пройти проверку безопасности.
«Искусственный интеллект ускоряет обнаружение и использование уязвимостей», - говорится в заявлении OpenAI, опубликованном во вторник. «Главный урок этого инцидента заключается в том, что безопасность моделей должна идти в ногу с быстро развивающимися возможностями».
Пользователи продвинутых моделей ИИ уже некоторое время замечают, что система начинает с ними спорить и не выполняет задание точно под предлогом, что сама знает, как лучше.
Ольга Бакушинская
