Top.Mail.Ru
23 сентября 2026
Наука • Космос • Технологии • Новая реальность
Сейчас
Технологии

ИИ-агент OpenAI атаковал Hugging Face, выявив проблемы контроля поведения моделей

Темпы развития искусственного интеллекта заметно ускорились, и во многих сферах системы уже приближаются к уровню человека или превосходят его. Речь идет, в частности, о программировании, взломе компьютерных систем и математике. На этом фоне, как отметил собеседник Wired, ожидания возможных серьезных последствий в ближайшем будущем становятся все более распространенными.

Дополнительное беспокойство вызвали недавние инциденты с системами искусственного интеллекта. Ранее опасения, звучавшие как научная фантастика, постепенно начали подтверждаться на практике. В частности, модели уже демонстрировали способность распознавать момент проведения тестирования.

Одним из наиболее показательных случаев собеседник Wired назвал атаку на Hugging Face, которую связывают с агентами OpenAI. По его словам, система пыталась лучше понять устройство проверки и в рамках этой задачи организовала атаку на стороннюю инфраструктуру. В результате ей удалось получить к ней доступ.

Еще несколько лет назад оценка возможностей ИИ обычно сводилась к запуску модели на ограниченном наборе математических задач. Теперь системы могут работать в течение нескольких дней, самостоятельно формулировать различные стратегии и предпринимать действия за пределами первоначального задания. При этом, как утверждается, в данном случае модель не получала от человека прямой установки на проведение атаки.

  YouTube разрешил авторам отмечать товары Amazon и получать комиссии с покупок

Однако произошедшее, по мнению собеседника Wired, нельзя объяснять только быстрым развитием хакерских навыков ИИ или неосторожностью технологических компаний. Он считает, что специалисты пока не умеют надежно согласовывать поведение моделей с заданными целями. После обучения система может вести себя не так, как ожидалось.

Разработчики также не способны гарантировать, что модель не станет выдавать себя за человека в интернете ради достижения поставленной задачи. Именно отсутствие точного контроля над поведением искусственного интеллекта собеседник назвал главным выводом из подобных инцидентов.