Сегодня 03 октября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

ИИ научился писать более по-человечески — но обзавёлся новыми словами-паразитами

Тексты, созданные большими языковыми моделями искусственного интеллекта, сейчас встречаются повсеместно, и у людей появилось желание научиться их распознавать. Ранее ИИ часто использовал длинное тире или предлагал нечто «исследовать глубже» — эти маркеры уже ушли в прошлое, но чат-боты сохранили некоторые речевые пристрастия, показало исследование маркетинговой компании Graphite.

 Источник изображения: Igor Omilaev / unsplash.com

Источник изображения: Igor Omilaev / unsplash.com

Сейчас у каждой модели ИИ отмечаются собственные уникальные особенности. Специалисты Graphite выделили 13 000 фраз, которые встречались в созданном ИИ контенте как минимум вдвое чаще, чем в написанных человеком текстах — такие фразы исследователи определили как маркеры. Примечательно, что модели Anthropic Claude всё больше генерируют похожий на человеческий текст, а системы OpenAI GPT напротив, отдаляются от естественного для человека распределения слов.

В качестве контрольной группы исследователи взяли массив из 10 000 статей, опубликованных до выхода ChatGPT — их явно писали люди. Авторы проекта поручили различным моделям ИИ переписать эти статьи на основе кратких аннотаций, чтобы исключить влияние исходного текста. Получив сопоставимые образцы текста от людей и каждой из моделей, в Graphite сравнили частоту употребления определённых слов и фраз и начали выявлять общие закономерности построения предложений.

Характерным маркером модели Anthropic Claude Opus 5.5 оказалось слово «надёжный» («dependable») — у неё оно встречается в 23 раза чаще, чем в написанных людьми текстах. Она стала избегать конструкции «это не X, а Y» (it’s not X, it’s Y), но всё ещё использует вариант «это больше, чем X — это Y» (is more than an X, it’s a Y). Фраза «это важно» (this matters) встречается в 116 раз чаще, чем у человека, а оборот «почему X важно» (why X matters) — в 92 раза чаще.

 Источник изображения: Milad Fakurian / unsplash.com

Источник изображения: Milad Fakurian / unsplash.com

Собственный набор отличительных признаков есть у OpenAI GPT-6 Astra. Эта модель любит описывать «другое измерение» (another dimension) обсуждаемого предмета и отмечать, что какое-либо действие «может обеспечить» (may provide) или «способно дать» (can provide) определённое преимущество. Наиболее ярким маркером модели исследователи считают «корректирующую формулировку»: когда некий предмет определяется как «не просто X» (not simply X) или подаётся как альтернатива — «вместо того, чтобы полагаться на X» (rather than relying on X). Подобные формулировки в текстах Astra встречаются более чем в сто раз чаще, чем у людей.

Ранее характерным признаком составленных ИИ текстов было обилие длинного тире. Разработчики учли это, и в изученных Graphite образцах текстов модель Claude Opus 5.5 использовала данный знак препинания на 99 % реже, чем Opus 5. OpenAI GPT-6 Astra употребляет его на 88 % реже, чем люди, а Google Gemini 3.1 Pro отказалась от длинного тире почти полностью. В целом число речевых маркеров не снижается — на смену одним приходят другие, «и у каждой версии модели они свои», говорят исследователи.

Разработчики действительно стремятся добиться у ИИ максимально приближенного к человеческому стиля письма — такие заявления делала Anthropic с выпуском Opus 5.5 и OpenAI, когда представила GPT-6 Sol и Luna. Но едва ли у ИИ-лабораторий получится полностью искоренить подобные речевые предпочтения, считают в Graphite. Примечательно, что если ИИ-модели стремятся общаться более по-человечески, то язык человека становится всё более похожим на генерируемый чат-ботами текст — недавно на это пожаловались представители сразу нескольких профессий.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Apple ужесточит контроль над «полным доступом к диску» в macOS из-за рисков, связанных с ИИ-агентами 3 ч.
Уязвимость в приложении ChatGPT для macOS позволяла хакерам получить доступ к конфиденциальным данным 5 ч.
Новая статья: Silent Hill: Townfall — бутафорский туман. Рецензия 11 ч.
Новая студия сооснователя Rockstar делает комедийную игру в открытом мире и не будет оглядываться на GTA VI 12 ч.
Сооснователь студии-разработчика Kingdom Come: Deliverance выразил надежду, что GTA VI «проложит путь» к играм за $80 14 ч.
Баскетбольный клуб «Майами Хит» на одну игру станет «Вайс-Сити» в рамках «исторического партнёрства» с разработчиками GTA VI 15 ч.
ИИ угрожает самому существованию «Википедии» — глава открытой энциклопедии бьёт тревогу 16 ч.
Американский суд впервые признал незаконным обучение ИИ на чужих материалах 16 ч.
2XKO была обречена на провал с самого запуска — для выживания файтингу по League of Legends нужны были «сотни тысяч, а то и миллионы» игроков 17 ч.
С появлением Anthropic Mythos японские банки стали выявлять вдвое больше уязвимостей 18 ч.
Meta предложила всем желающим создавать собственные гаджеты с ИИ-агентом Muse 2 ч.
Роботы лишь через 40 лет смогут конкурировать с людьми всего за 10 % рабочих мест в США 2 ч.
Lian Li выпустила L-образные блоки питания Edge Platinum V2 и Edge Gold V2 мощностью до 1350 Вт, а также концентраторы Edge Hub 3 ч.
Личное благосостояние основателя Nvidia выросло до $204 млрд, сделав его седьмым среди богатейших людей планеты 3 ч.
QNAP представила управляемые 10GbE-коммутаторы QSW-M5218 с портами 25GbE SFP28 8 ч.
Легендарный Kingpin вернётся к экстремальному разгону — оверклокер намекнул на совместный проект с Asus 11 ч.
Дурной пример заразителен: Google начала поднимать цены на смартфоны вслед за Samsung 11 ч.
Tencent арендовала 100 тыс. чипов у Oracle чтобы ускорить развитие своих ИИ-систем 13 ч.
Восстановление Tesla замедлилось — квартальные продажи снова упали, но не слишком сильно 15 ч.
Внезапная жертва кризиса памяти: семилетняя приставка Nvidia Shield TV Pro подорожала на $100 16 ч.