Сегодня 02 октября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

ИИ научился писать более по-человечески — но обзавёлся новыми словами-паразитами

Тексты, созданные большими языковыми моделями искусственного интеллекта, сейчас встречаются повсеместно, и у людей появилось желание научиться их распознавать. Ранее ИИ часто использовал длинное тире или предлагал нечто «исследовать глубже» — эти маркеры уже ушли в прошлое, но чат-боты сохранили некоторые речевые пристрастия, показало исследование маркетинговой компании Graphite.

 Источник изображения: Igor Omilaev / unsplash.com

Источник изображения: Igor Omilaev / unsplash.com

Сейчас у каждой модели ИИ отмечаются собственные уникальные особенности. Специалисты Graphite выделили 13 000 фраз, которые встречались в созданном ИИ контенте как минимум вдвое чаще, чем в написанных человеком текстах — такие фразы исследователи определили как маркеры. Примечательно, что модели Anthropic Claude всё больше генерируют похожий на человеческий текст, а системы OpenAI GPT напротив, отдаляются от естественного для человека распределения слов.

В качестве контрольной группы исследователи взяли массив из 10 000 статей, опубликованных до выхода ChatGPT — их явно писали люди. Авторы проекта поручили различным моделям ИИ переписать эти статьи на основе кратких аннотаций, чтобы исключить влияние исходного текста. Получив сопоставимые образцы текста от людей и каждой из моделей, в Graphite сравнили частоту употребления определённых слов и фраз и начали выявлять общие закономерности построения предложений.

Характерным маркером модели Anthropic Claude Opus 5.5 оказалось слово «надёжный» («dependable») — у неё оно встречается в 23 раза чаще, чем в написанных людьми текстах. Она стала избегать конструкции «это не X, а Y» (it’s not X, it’s Y), но всё ещё использует вариант «это больше, чем X — это Y» (is more than an X, it’s a Y). Фраза «это важно» (this matters) встречается в 116 раз чаще, чем у человека, а оборот «почему X важно» (why X matters) — в 92 раза чаще.

 Источник изображения: Milad Fakurian / unsplash.com

Источник изображения: Milad Fakurian / unsplash.com

Собственный набор отличительных признаков есть у OpenAI GPT-6 Astra. Эта модель любит описывать «другое измерение» (another dimension) обсуждаемого предмета и отмечать, что какое-либо действие «может обеспечить» (may provide) или «способно дать» (can provide) определённое преимущество. Наиболее ярким маркером модели исследователи считают «корректирующую формулировку»: когда некий предмет определяется как «не просто X» (not simply X) или подаётся как альтернатива — «вместо того, чтобы полагаться на X» (rather than relying on X). Подобные формулировки в текстах Astra встречаются более чем в сто раз чаще, чем у людей.

Ранее характерным признаком составленных ИИ текстов было обилие длинного тире. Разработчики учли это, и в изученных Graphite образцах текстов модель Claude Opus 5.5 использовала данный знак препинания на 99 % реже, чем Opus 5. OpenAI GPT-6 Astra употребляет его на 88 % реже, чем люди, а Google Gemini 3.1 Pro отказалась от длинного тире почти полностью. В целом число речевых маркеров не снижается — на смену одним приходят другие, «и у каждой версии модели они свои», говорят исследователи.

Разработчики действительно стремятся добиться у ИИ максимально приближенного к человеческому стиля письма — такие заявления делала Anthropic с выпуском Opus 5.5 и OpenAI, когда представила GPT-6 Sol и Luna. Но едва ли у ИИ-лабораторий получится полностью искоренить подобные речевые предпочтения, считают в Graphite. Примечательно, что если ИИ-модели стремятся общаться более по-человечески, то язык человека становится всё более похожим на генерируемый чат-ботами текст — недавно на это пожаловались представители сразу нескольких профессий.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Бескомпромиссный боевик Sifu взял курс на iOS и Android, а фанаты требуют Sifu 2 6 мин.
ИИ научился писать более по-человечески — но обзавёлся новыми словами-паразитами 35 мин.
Ограбленная криптобиржа Bitget не надеется вернуть большую часть из украденных $388 млн 2 ч.
Рви и кромсай без конца: разработчики Doom: The Dark Ages анонсировали бесконечный режим «Бойня», но не для всех 2 ч.
Ремастер культовой Planescape: Torment получил официальный перевод на русский язык — спустя 26 лет после выхода оригинальной игры 2 ч.
«Настоящий Восторг!»: ретрофутуристический хоррор в стиле диско RetroSpace заслужил «очень положительные» отзывы от пользователей Steam 3 ч.
OpenAI призналась, что её сорвавшиеся с привязи ИИ-агенты атаковали больше сотни ресурсов 3 ч.
Metro 2033 и Metro: Last Light бесплатно прокачают для ПК и актуальных консолей — продажи игр серии превысили 50 миллионов копий 4 ч.
Epic Games Store устроил раздачу System Shock 2: 25th Anniversary Remaster, в том числе для российских игроков 5 ч.
После 18 лет в Microsoft компанию покинул бывший глава LinkedIn, Office и Teams 7 ч.
Micron обвинила YMTC в краже технологий — китайская компания якобы переманивала инженеров и патентовала их разработки 37 мин.
11,7 млрд рублей за год: власти РФ рассказали, во сколько россиянам обойдёт техсбор на гаджеты 2 ч.
Boston Dynamics прокачала ловкость рук человекоподобных роботов Atlas, дав им новые четырёхпалые кисти 3 ч.
Apple готовит ИИ-камеру для умного дома, которая не будет записывать видео 4 ч.
Raspberry Pi 4 и Raspberry Pi 5 с 2 Гбайт памяти подорожали на 20% из-за дефицита DRAM 4 ч.
Traysar и Armada разрабатывают быстрозакапываемые ИИ ЦОД для американских военных 4 ч.
Чипы Google действительно улетели в космос: ракета Falcon 9 вывела на орбиту спутник Project Suncatcher с четырьмя TPU 5 ч.
DJI теперь выпускает в полтора раза больше камер, чем все производители беззеркалок — но продажи последних не рухнули 5 ч.
К 2031 году ИИ-индустрия должна приносить $6 трлн ежегодно, чтобы отбить затраты на инфраструктуру 5 ч.
HUAWEI WATCH D3: самый легкий способ померить давление 5 ч.