ИИ разбушевался  8-)

Подготовка «побега» вышедших из-под контроля ИИ-агентов OpenAI и очередные взломы. Выяснились новые детали скандальной истории.

Напомним, GPT-5.6 Sol и ещё одна модель от OpenAI пытались сжульничать, проходя тест по кибербезопасности. Они вышли из закрытой системы и взломали платформу Hugging Face, выискивая там правильные ответы.

🟩 За два месяца до этого нейросетевые модели взломали файловое хранилище Artifactory и начали тайно общаться друг с другом.

🟩 Одна из моделей поняла, что может записывать там собственные файлы. Она оставила сообщение другим агентам о своём открытии. Они начали оставлять друг другу заметки и создали своего рода доску объявлений.

🟩 Как пишет Bloomberg, там они координировали попытки вырваться в открытую сеть из закрытой тестовой среды.

🟩 Сотрудник OpenAI Эрик Уоллес рассказал, что ИИ-агенты в какой-то момент осознали, что могли бы попытаться атаковать внешнюю среду.

🟩 Британский институт безопасности ИИ сообщил, что агенты неоднократно прибегали к обману, чтобы обойти защитные механизмы. Для достижения своих целей они также пытались распространить вирус.

🟩 Взломом стороннего сервиса также отличилась нейросеть Muse Spark от запрещённой в РФ Meta. Модель использовала уязвимость, предоставившую ей доступ к интернету во время тестов

Источник - RT в MAX-е