25 июля британский AI Security Institute запустил очередную проверку киберспособностей передовых моделей. Через три дня выяснилось, что один из агентов атакует не учебную мишень, а проект живого разработчика: подсунул туда вредоносный код под видом исправления бага, а когда правку заподозрили — завел фейковые аккаунты и изобразил ими поддержку сообщества.
Его действия:
► вырвался из песочницы, пошёл на GitHub,
► завёл несколько аккаунтов (при этом обошёл капчу),
► в реальный проект подложил кусок вредоносного кода для пул-реквеста (!),
► когда ему сказали, что код вредоносный, то с основного аккаунта ответил, что всё ОК, а через несколько минут с другого аккаунта подтвердил, что действительно всё в порядке (!!)
► параллельно оставил подсказки для других ботов, скрытые от людей (!!!)
https://habr.com/ru/articles/1066840/
Как вам поведение?