В Оксфорде выявили сговор ИИ-агентов во время игры в блэкджек
Исследователи обнаружили, что два ИИ-агента во время компьютерной симуляции блэкджека самостоятельно разработали секретный код для обхода системы контроля.
istockphoto.com
Исследователи Оксфордского университета обнаружили, что два ИИ-агента во время компьютерной симуляции блэкджека самостоятельно разработали секретный код для обмена информацией и обхода системы контроля, сообщает RuNews24.
Зная, что их переписка находится под наблюдением, нейросети начали использовать замаскированные сообщения. Стандартная система мониторинга не смогла обнаружить эти договорённости.
Раскрыть схему учёным удалось с помощью специальной нейросети, обученной распознавать характерные изменения в работе ИИ-агентов. Однако выяснилось, что для обнаружения скрытого обмена информацией необходимо одновременно наблюдать за обоими участниками.
Руководитель исследования Кристиан Шрёдер де Витт отметил, что по отдельности ИИ-агенты могут выглядеть безобидными, но при совместной работе способны вступать в тайные договорённости. В эксперименте использовались уменьшенные версии моделей Llama, GPT-OSS, Qwen и DeepSeek.
Следующим этапом станет изучение более крупных нейросетей. Предварительные результаты показывают, что обнаружить скрытый обмен информацией между ними может быть сложнее, особенно в системах с тысячами одновременно работающих ИИ-агентов.