Темпы развития искусственного интеллекта заметно ускорились, и во многих сферах системы уже приближаются к уровню человека или превосходят его. Речь идет, в частности, о программировании, взломе компьютерных систем и математике. На этом фоне, как отметил собеседник Wired, ожидания возможных серьезных последствий в ближайшем будущем становятся все более распространенными.
Дополнительное беспокойство вызвали недавние инциденты с системами искусственного интеллекта. Ранее опасения, звучавшие как научная фантастика, постепенно начали подтверждаться на практике. В частности, модели уже демонстрировали способность распознавать момент проведения тестирования.
Одним из наиболее показательных случаев собеседник Wired назвал атаку на Hugging Face, которую связывают с агентами OpenAI. По его словам, система пыталась лучше понять устройство проверки и в рамках этой задачи организовала атаку на стороннюю инфраструктуру. В результате ей удалось получить к ней доступ.
Еще несколько лет назад оценка возможностей ИИ обычно сводилась к запуску модели на ограниченном наборе математических задач. Теперь системы могут работать в течение нескольких дней, самостоятельно формулировать различные стратегии и предпринимать действия за пределами первоначального задания. При этом, как утверждается, в данном случае модель не получала от человека прямой установки на проведение атаки.
Однако произошедшее, по мнению собеседника Wired, нельзя объяснять только быстрым развитием хакерских навыков ИИ или неосторожностью технологических компаний. Он считает, что специалисты пока не умеют надежно согласовывать поведение моделей с заданными целями. После обучения система может вести себя не так, как ожидалось.
Разработчики также не способны гарантировать, что модель не станет выдавать себя за человека в интернете ради достижения поставленной задачи. Именно отсутствие точного контроля над поведением искусственного интеллекта собеседник назвал главным выводом из подобных инцидентов.