
Компания Musubi представила модель PolicyLM-1.7B для модерации контента в реальном времени. Как сообщает TechCrunch, решение распространяется с открытыми весами и рассчитано на обработку сообщений менее чем за 50 миллисекунд. Модель относится к классу систем принятия решений и должна работать с сопоставимыми скоростью и стоимостью с классификаторами, которые применяют социальные платформы.
PolicyLM-1.7B может использовать правила, сформулированные обычным английским языком. Для изменения политики модерации ей не требуется дополнительное обучение, поэтому специалисты могут оперативно корректировать критерии оценки. При этом модель способна обрабатывать сложные правила благодаря архитектуре, характерной для современных больших языковых моделей.
Результатом работы становится бинарная оценка: система определяет, относится ли сообщение к заданной категории. Ограниченный набор возможных ответов позволяет ускорить обработку и снизить расходы по сравнению с большими языковыми моделями. Одновременно сохраняется гибкость трансформерной архитектуры.
Сооснователь Musubi и директор компании по искусственному интеллекту Филип Янкович считает, что такой инструмент поможет администраторам платформ заранее размечать публикации. «Product teams just want a better understanding of what’s happening on their platform, especially as the amount of content is exponentially increasing», — сказал он. По словам Янковича, масштабируемая и настраиваемая маркировка всего объёма материалов особенно полезна при быстром росте числа публикаций.
Интерес к моделям принятия решений заметно усилился после выхода в сентябре Jev от TypeSafe AI. Вскоре собственные аналогичные решения представили OpenAI и Amazon. Одним из первых направлений их применения стала борьба с нежелательным поведением ИИ-агентов, а Musubi предлагает использовать тот же подход для контроля нарушений со стороны людей.
Янкович утверждает, что заинтересовался этой технологией ещё до появления Jev — после проекта GLiNER (универсальная модель для распознавания именованных сущностей), созданного в 2024 году. В Musubi не избегают сравнения с более известными решениями и рассчитывают привлечь внимание к модерации контента. В анонсе продукта PolicyLM-1.7B названа моделью того же типа, что и Jev, но специально обученной для модерации и доступной для самостоятельного запуска.