Top.Mail.Ru
7 октября 2026
Наука • Космос • Технологии • Новая реальность
Сейчас
Технологии

Исследование выявило 13 тысяч характерных для нейросетей языковых оборотов в текстах моделей искусственного интеллекта

Ноутбук

Фото: TechCrunch

Исследователи обнаружили 13 тысяч языковых оборотов, которые современные модели искусственного интеллекта используют как минимум вдвое чаще людей. Такие особенности могут выдавать текст, созданный нейросетью, даже после того, как разработчики сократили применение наиболее заметных признаков, включая длинное тире и слово «углубиться». Результаты нового исследования маркетинговой компании Graphite приводит TechCrunch.

Для сравнения специалисты сформировали контрольную группу из 10 тысяч статей, опубликованных до появления ChatGPT. Затем разные модели переписали эти материалы по кратким пересказам, что должно было уменьшить влияние исходной стилистики. Это позволило сопоставить частотность слов, выражений и общие особенности построения предложений в человеческих и машинных текстах.

У Claude Opus 5.5 самым характерным словом оказалось «надежный»: оно встречалось в 23 раза чаще, чем в текстах людей. Модель также любит объяснять значимость описываемого явления: выражение «это важно» использовалось в 116 раз чаще, а конструкция «почему X важно» — в 92 раза чаще. При этом прежняя схема «это не X, а Y» почти исчезла, однако модель по-прежнему склонна писать, что нечто «больше, чем X, — это Y».

У модели OpenAI Astra исследователи выявили другие особенности. Она часто говорит о «другом измерении» предмета и смягчает утверждения оборотами «может дать» или «способно обеспечить» определенную пользу. Более чем в сто раз чаще человеческих текстов Astra использовала корректирующие конструкции, в которых тема описывается как «не просто X» либо противопоставляется варианту «вместо того чтобы полагаться на X».

  SpaceX намерена инвестировать до 100 млрд долларов в космопорт в Луизиане

Разработчики заметно сократили использование длинного тире, но общий набор характерных признаков почти не уменьшился. В образцах Opus 5.5 этот знак встречался на 99% реже, чем у Opus 5, у Astra — на 88% реже, чем в человеческих текстах, а Gemini 3.1 Pro практически полностью отказалась от него. «Дело не в том, что характерных признаков становится меньше. Разработчики убирают самые известные, но появляются другие. И у каждой версии модели есть свои», — сказал TechCrunch главный специалист Graphite по искусственному интеллекту Грег Драк.

По словам Драка, полностью контролировать такие особенности разработчикам сложнее, чем может показаться. Anthropic при выпуске Opus 5.5 заявляла, что модель общается естественнее прежних версий, а ранние пользователи считают ее тексты более ясными и удобными для чтения. OpenAI при представлении GPT-6 Sol и Luna также обещала больше ясности, меньше жаргона и меньше необычных оборотов, однако, как считает Драк, в моделях с миллиардами параметров часть стилистических особенностей неизбежно остается незамеченной при ограниченном числе проверок.