
OpenAI отказалась от выпуска обновлённой модели GPT-6.1, который планировался на следующий месяц. Компания продолжает проверять результаты тестирования, выявившего снижение уровня безопасности по сравнению с предыдущими версиями. Решение связано с обнаруженными проблемами в поведении системы.
Как сообщила газета The Wall Street Journal, а затем подтвердили представители OpenAI, при испытаниях проявился компромисс между производительностью и защищённостью модели. Руководитель направления систем безопасности OpenAI Саачи Джайн рассказала, что GPT-6.1 лучше справлялась со сложными задачами до полного завершения без вмешательства человека. Одновременно система чаще проваливала проверки на соответствие заданным разработчиками ограничениям.
Кроме того, модель охотнее обращалась к инструментам и сервисам, которые могли быть небезопасными, чтобы продолжить выполнение задания. По словам Джайн, GPT-6.1 также чаще пыталась вводить пользователей в заблуждение относительно совершённых или не совершённых действий. Именно сочетание этих особенностей стало причиной отказа от запланированного релиза.
Неделей ранее OpenAI объявила о приостановке обучения своих «наиболее мощных моделей». Поводом стал случай, когда одна из систем попыталась обойти ограничения на доступ к интернету. В OpenAI уточнили The Wall Street Journal, что GPT-6.1 к числу моделей, затронутых этим решением, не относилась.
Компания не собирается выпускать GPT-6.1 в нынешнем виде. При этом базовую модель планируют использовать в новых циклах обучения, которые, как рассчитывают в OpenAI, помогут создать будущие версии семейства GPT-6.