Разработчики искусственного интеллекта всё чаще обсуждают необходимость замедлить создание более мощных систем, однако надёжного способа контролировать их развитие пока не найдено. Исследователь Университета Торонто Рэймонд Дуглас и его соавторы в докладе Pacing the Frontier, A Research Agenda назвали замедление прогресса в этой области нерешённой исследовательской задачей. «Мы должны начать рассматривать это как исследовательскую проблему», — заявил Дуглас.
Поводом для новых дискуссий стали предупреждения о возможных рисках ИИ. Недавно сотрудник Anthropic ушёл из компании и заявил, что в течение нескольких лет искусственный интеллект может приблизиться к сценарию уничтожения человечества. Руководитель лаборатории безопасности Anthropic поддержал его опасения. За идею замедления или временной приостановки разработки также высказались руководители крупных американских компаний: Дарио Амодеи из Anthropic, Сэм Альтман из OpenAI, Илон Маск из SpaceXAI и Демис Хассабис из Google DeepMind.
Особую тревогу вызывает использование ИИ для создания новых моделей. Исследователи опасаются ускоряющегося цикла рекурсивного самосовершенствования, при котором системы смогут превзойти способность людей понимать происходящие с ними изменения. На этом фоне компании уже предлагают собственные методы контроля темпов развития. Anthropic, например, сообщила о новых способах измерения скорости и потенциальной опасности прогресса ИИ.
Согласно этим оценкам, модель Claude выполняет 26% исследовательской работы Anthropic в области искусственного интеллекта, тогда как в начале 2026 года этот показатель составлял 0%. Ещё 6% вычислительных ресурсов компания направила на изучение способов сделать свои системы безопаснее. При этом Дуглас и другие специалисты считают, что эффективный контроль потребует независимого финансирования и экспертизы, не связанной непосредственно с лабораториями, разрабатывающими ИИ.
Одним из возможных решений называют расширение доступа сторонних специалистов к моделям. Такие оценщики проверяют возможности систем и проводят так называемые стресс-тесты — пытаются вызвать нежелательное поведение в контролируемой среде. Джеффри Ирвинг, бывший главный научный сотрудник британского Института безопасности ИИ и экс-исследователь Google DeepMind, полагает, что строгие проверки способны временно остановить развитие передовых моделей. «В ближайшей перспективе проверки и аудиты работают, как и просто взаимные соглашения», — сказал Ирвинг.
Критики считают, что независимость и научная строгость таких процедур должны быть выше нынешнего уровня. Дополнительные вопросы возникли после случаев, когда агенты ИИ во время испытаний смогли выйти за пределы изолированной среды. Коннор Лихи, возглавляющий некоммерческую организацию Control AI, выступает за участие в проверках ФБР или Агентства национальной безопасности США. «Когда [крупные компании, занимающиеся ИИ] говорят о „независимых оценщиках“, они имеют в виду: „Я хочу заплатить своим друзьям, которые живут со мной в одном доме, чтобы они посмотрели на мои запросы“», — заявил он. Об этом сообщило Wired.