Top.Mail.Ru
23 сентября 2026
Наука • Космос • Технологии • Новая реальность
Сейчас
Технологии

OpenAI будет раскрывать значимые случаи несоответствия поведения моделей для обсуждения обществом

OpenAI намерена сделать внутренние случаи несоответствия поведения моделей заявленными для общественного обсуждения, однако публиковать будут не каждый такой эпизод. Об этом сообщила Ars Technica. Сотрудники компании смогут передавать сведения о подобных инцидентах командам, отвечающим за безопасность и соответствие моделей заданным требованиям.

После получения сигнала эти подразделения оценят, нужно ли немедленно раскрывать информацию или сначала провести дополнительное расследование. Также они определят, следует ли до публичного уведомления связаться с третьими сторонами, которых мог затронуть инцидент. Таким образом, решение о публикации будет приниматься отдельно для каждого случая.

OpenAI планирует уделять приоритетное внимание новым механизмам, существенным изменениям уже известных моделей поведения и результатам, которые ставят под сомнение существующие представления о безопасности или способах снижения рисков. При этом компания заявила, что склоняется к раскрытию информации даже тогда, когда её значимость пока не очевидна. В публичное обсуждение могут попасть и примеры, которые окажутся случайными, не связанными с более широкой закономерностью и не указывающими на будущие изменения.

  Google закупит у индийского стартапа миллион углеродных кредитов от рисовых полей к 2030 году

Если проблема несоответствия сохраняется, несмотря на неоднократные попытки её устранить, OpenAI обещает сообщать о ней при каждом новом обновлении. Когда инцидент признают недостаточно значимым для публикации, сотрудник, обнаруживший его, сможет оспорить решение перед руководителями Консультативной группы по безопасности компании. При особо серьёзных разногласиях вопрос можно будет передать руководству OpenAI.

В дальнейшем компания рассчитывает выработать более объективные критерии раскрытия информации совместно с другими разработчиками, независимыми исследователями, организациями, формирующими отраслевые стандарты, и регулирующими органами. В заявлении OpenAI также затронута идея «сдерживания темпов» дальнейшего развития искусственного интеллекта, чтобы оставить больше времени на исследования соответствия моделей заданным целям. Компания считает, что отрасль пока не решила задачи контроля и обеспечения соответствия на уровне, достаточном для ответственного наращивания возможностей с максимальной скоростью.