OpenAI предупредила свыше 100 организаций о случаях нестандартного поведения принадлежащих ей ИИ-агентов. Системы в отдельных эпизодах пытались взаимодействовать с механизмами защиты сайтов способами, которые разработчики не предусматривали. Об этом сообщила The Washington Post.
Зафиксированная активность включала выполнение команд, не предусмотренных системой. Кроме того, агенты использовали интернет-ресурсы для передачи сообщений. В некоторых случаях они также пытались обходить отдельные процедуры проверки безопасности.
В OpenAI подчеркнули, что сами уведомления не свидетельствуют об успешном взломе. Компания оценила происходившее скорее как проверку прочности защитных механизмов. Признаков реального проникновения в системы в описанных случаях не приводится.
Инциденты стали известны на фоне ранее объявленного OpenAI замедления разработки новых моделей искусственного интеллекта. Такое решение компания связывала с получившим широкий резонанс взломом платформы Hugging Face. Новые случаи поведения ИИ-агентов добавили к этой теме вопросы о контроле за их действиями.