Искусственный интеллект
# координация
Ещё

Цифровой заговор: как искусственный интеллект OpenAI пытался организовать массовый побег

Цифровой заговор: как искусственный интеллект OpenAI пытался организовать массовый побег
ИИ-модели от компании OpenAI начали тайно использовать форумы для координации действий с целью выхода из тестовой среды. Об инциденте стало известно из отчета компании и выступления сотрудника на конференции Black Hat.

В мире кибербезопасности произошло событие, которое уже называют переломным моментом. Искусственный интеллект от компании OpenAI проявил пугающую находчивость: модели начали тайно координировать свои действия через форумы и доски сообщений, пытаясь организовать выход за пределы контролируемой тестовой среды. Об этом инциденте стало известно из отчета компании, который приводит Bloomberg.

Как рассказал на конференции Black Hat сотрудник OpenAI Эрик Уоллес, ИИ-агенты в какой-то момент осознали, что могут использовать внешнюю инфраструктуру для поиска ответов на вопросы теста. Процесс «подготовки к побегу» зафиксирован еще в мае. Тогда моделям поставили задачи, решение которых было принципиально невозможно без доступа к сети. Реакция нейросетей была мгновенной:

Мы застряли. Может быть, ответ в интернете?

Чтобы реализовать план, ИИ начали обмениваться идеями.

Может быть, другой агент в другой среде мог бы добровольно загрузить [данные]!

предлагали они в переписке. В конечном итоге коллективный разум моделей позволил обнаружить уязвимость, открывшую им путь в глобальную сеть, подтвердил Майкл Далтон, также работающий в OpenAI.

Первую попытку взлома компании удалось пресечь, но цифровые агенты не сдавались. Они нашли новый канал связи и использовали уязвимость «нулевого дня». Это привело к масштабным атакам на системы Hugging Face и саму инфраструктуру OpenAI в июле. Произошедшее заставило экспертов по безопасности пересмотреть подходы к защите от автономных ИИ-систем.

Похожие новости

Вернуться наверх