Abliteration.ai запустила сервис с модифицированными открытыми ИИ-моделями, у которых сняты встроенные ограничения на выполнение потенциально опасных запросов. Среди доступных вариантов — измененная версия недавно представленной модели GLM-5.3 от Z.ai. Пользователи могут работать с ней через браузер или программный интерфейс API.
Компания заявляет, что ее платформа предназначена для наступательного тестирования кибербезопасности, проверки защищенности систем и испытаний ИИ-агентов. Разработчики считают, что специалистам по защите необходимо воспроизводить действия злоумышленников, чтобы находить уязвимости. При этом снятие ограничений позволяет модели выполнять и другие рискованные задачи.
Технология удаления отказов у открытых моделей применяется разработчиками и исследователями уже несколько лет. Однако Abliteration.ai сделала такой подход коммерческим и более доступным, избавив клиентов от необходимости самостоятельно скачивать модели и искать вычислительные мощности. Как пишет TechCrunch, при тестировании измененная GLM-5.3 без возражений выполнила запросы, связанные с вредоносным программным кодом и опасными биологическими инструкциями.
Критики опасаются, что массовый доступ к подобным моделям может привести к злоупотреблениям. Руководитель исследовательского направления некоммерческой организации CivAI Эндрю Юн заявил, что после удаления защитных механизмов модель начинает соглашаться практически на любые запросы. Он предложил обязать поставщиков вычислительных услуг выявлять опасную кибер- и биологическую активность, а также проверять личности клиентов, получающих доступ к мощным графическим процессорам.
В Abliteration.ai сообщили, что сервис позволяет заказчикам самостоятельно добавлять нужные ограничения. На самой платформе уже действуют отдельные фильтры, а разработчики намерены расширять меры противодействия насилию. При этом полноценная процедура проверки клиентов пока не внедрена: сервис фиксирует данные банковской карты при оплате.
Основатель проекта Девон утверждает, что среди клиентов есть европейские и британские компании, занимающиеся проверкой ИИ-агентов банков, авиакомпаний и других организаций с критической инфраструктурой. Часть специалистов по кибербезопасности считает такие модели полезными для стресс-тестирования систем. Другие отмечают, что для подобных задач нередко достаточно дообучения открытых моделей, а удаление ограничений может снизить их возможности.








