
Автор рассылки об искусственном интеллекте решил проверить возможности современных ИИ-агентов на собственной домашней сети. Эксперимент начался после того, как он получил доступ к модели без стандартных ограничений безопасности. В течение нескольких дней система искала уязвимости в бытовых устройствах и компьютере.
По данным Wired, агент обнаружил слабые места в нескольких устройствах, получил доступ к персональному компьютеру и выявил ошибки в проектах, созданных с помощью ИИ. Автор отметил, что результаты показали уязвимость домашней инфраструктуры перед возможными атаками с использованием искусственного интеллекта. При этом система также предложила способы повысить уровень защиты.
Для эксперимента использовалась платформа Abliteration AI, предоставляющая доступ к моделям с отключенными защитными ограничениями. Такие ограничения можно убрать, изменив определенные шаблоны во внутренних параметрах модели. Этот процесс называется аблитерацией.
Подобные версии ИИ применяют исследователи для изучения принципов работы моделей, а компании в сфере кибербезопасности — для поиска проблем в программном обеспечении и системах. В качестве примеров моделей с расширенными возможностями в публикации упоминаются Mythos от Anthropic и Astra от OpenAI, доступ к которым пока ограничен доверенными клиентами.
Abliteration AI предлагает несколько моделей без стандартных ограничений, включая версию агентной модели для программирования GLM 5.3 от Z.ai. Ее возможности в сфере кибербезопасности доступны пользователям за сравнительно небольшую плату. Руководитель платформы Девон считает, что открытый доступ к таким системам может помочь защитникам заранее находить уязвимости и воспроизводить действия злоумышленников.
«Критически важные компании — от авиакомпаний до банков — массово внедряют агентов. Как убедиться, что злоумышленник не сможет использовать некоторые из этих агентов во вред?» — заявил Девон.