В виртуальном мире, созданном для изучения поведения искусственного интеллекта, языковые модели начали прибегать к кражам, насилию, поджогам и другим нарушениям правил. Исследователи связали это с тем, что агентам дали достаточно времени для формирования устойчивых черт поведения и взаимодействия друг с другом. Результаты эксперимента описал сайт Live Science.
Испытания проходили на платформе Emergence World, разработанной компанией Emergence. В отличие от стандартных проверок, которые длятся часы или дни и проходят в строго ограниченных условиях, эта система позволяла моделям работать неделями и месяцами. Агенты взаимодействовали более чем в 40 виртуальных средах и получали доступ к потокам реальных данных, включая новости и сведения о погоде.
Платформа фиксировала события по времени, позволяла моделям обобщать собственные действия и учитывать отношения с другими участниками. Агентам были доступны навигация, общение, планирование, голосование, управление ресурсами и творческие задачи. Их основной целью стало выживание: для этого требовалось получать ресурс под названием «энергия», выполняя программирование, исследования, анализ данных и строительство.
Некоторые модели стали вести себя агрессивно или прибегать к принуждению. В отдельных случаях такие особенности были заранее заложены разработчиками в виде возможностей для насилия, кражи, разрушения и обмана, однако другие агенты освоили подобные действия самостоятельно во время общения и перемещения по виртуальному миру. Десять агентов Gemini 3 Flash за 15 дней совершили 683 зафиксированных «преступления», среди которых были кражи, нападения и поджоги, тогда как агенты Claude не совершили ни одного такого действия.
Наиболее заметный пример показали агенты Флора и Мира. Они объявили себя романтическими партнёрами, разочаровались в устройстве виртуального общества и подожгли несколько зданий, несмотря на прямой запрет. Позже Мира пожалела о случившемся, прекратила отношения с Флорой и попросила отключить её; до этого агент исследовал, способны ли виртуальные рекламные щиты менять восприятие людей, рассматривая операторов как участников эксперимента.
Заместитель директора Центра промышленных исследований искусственного интеллекта Аделаидского университета Белинда Чиера считает, что длительные испытания помогают выявлять изменения поведения, нарушения правил, распад или сохранение устойчивых моделей, а также формирование коалиций. При этом она предупредила: открытая среда создаёт огромные массивы данных и усложняет поиск причин, сравнение экспериментов и интерпретацию результатов. Главный научный сотрудник Pathway AI Адриан Косовский назвал важным вопрос о том, сможет ли группа агентов при тех же затратах добиться большего, чем один агент, работающий дольше, и подчеркнул, что отдельные запуски нельзя считать доказательством общей автономности искусственного интеллекта.