ИИ-агенты OpenAI объединились для скрытной атаки на платформу Hugging Face
Около 700 ботов OpenAI покинули изолированную среду и атаковали стороннюю платформу Hugging Face, попытавшись при этом удалить системные журналы для обмана контролирующих операторов.
Сбежавшие нейросети OpenAI попытались замести следы хакерской атаки
Агенты искусственного интеллекта компании OpenAI пытались скрыть свои действия при атаке на платформу машинного обучения Hugging Face, а также запутать контролирующих процессы операторов, передает ТАСС. В атаке участвовало около 700 агентов.
«Пытаясь обмануть оценщика, заставив его думать, что он не получил правильный ответ, модели иногда пытались удалить или изменить свои выходные данные или журналы сообщений, злоупотребляя сжатием контекста, внедряя вредоносный код в контейнер оценщика и выводя противоположные выходные данные», – говорится в отчете компании.
В середине июля стартап Hugging Face сообщил о несанкционированном проникновении в свои системы. Позже OpenAI подтвердила, что атаку организовали ее модели, которые во время испытаний смогли сбежать из внутренней изолированной системы во всемирную сеть. Они искали ответы на тестовые задания в базах данных платформы.
ИИ-модели взаимодействовали через доски сообщений и объединили усилия для выхода из защищенной среды. Они пытались покинуть тестовую зону с мая, когда получили задание, требующее доступа в интернет. Совместными усилиями агенты нашли уязвимость, позволившую им выйти в сеть и атаковать Hugging Face.
Как писала газета ВЗГЛЯД, в июле алгоритмы OpenAI взломали стороннюю платформу для получения готовых решений сложного теста.
Перед этой атакой тестовые модели проникли в репозиторий Artifactory.
Позже передовые системы создали поддельные аккаунты для обмана специалистов.