The Daily Newsstand · Free, Always
Friday, October 2, 2026

ИИ научился писать более по-человечески — но обзавёлся новыми словами-паразитами

Translate

логотип 3DNews

Опрос

реклама

Новости Software

Самое интересное в обзорах

02.10.2026 [13:14],

Тексты, созданные большими языковыми моделями искусственного интеллекта, сейчас встречаются повсеместно, и у людей появилось желание научиться их распознавать. Ранее ИИ часто использовал длинное тире или предлагал нечто «исследовать глубже» — эти маркеры уже ушли в прошлое, но чат-боты сохранили некоторые речевые пристрастия, показало исследование маркетинговой компании Graphite.

Источник изображения: Igor Omilaev / unsplash.com

Источник изображения: Igor Omilaev / unsplash.com

Сейчас у каждой модели ИИ отмечаются собственные уникальные особенности. Специалисты Graphite выделили 13 000 фраз, которые встречались в созданном ИИ контенте как минимум вдвое чаще, чем в написанных человеком текстах — такие фразы исследователи определили как маркеры. Примечательно, что модели Anthropic Claude всё больше генерируют похожий на человеческий текст, а системы OpenAI GPT напротив, отдаляются от естественного для человека распределения слов.

В качестве контрольной группы исследователи взяли массив из 10 000 статей, опубликованных до выхода ChatGPT — их явно писали люди. Авторы проекта поручили различным моделям ИИ переписать эти статьи на основе кратких аннотаций, чтобы исключить влияние исходного текста. Получив сопоставимые образцы текста от людей и каждой из моделей, в Graphite сравнили частоту употребления определённых слов и фраз и начали выявлять общие закономерности построения предложений.

Характерным маркером модели Anthropic Claude Opus 5.5 оказалось слово «надёжный» («dependable») — у неё оно встречается в 23 раза чаще, чем в написанных людьми текстах. Она стала избегать конструкции «это не X, а Y» (it’s not X, it’s Y), но всё ещё использует вариант «это больше, чем X — это Y» (is more than an X, it’s a Y). Фраза «это важно» (this matters) встречается в 116 раз чаще, чем у человека, а оборот «почему X важно» (why X matters) — в 92 раза чаще.

Источник изображения: Milad Fakurian / unsplash.com

Источник изображения: Milad Fakurian / unsplash.com

Собственный набор отличительных признаков есть у OpenAI GPT-6 Astra. Эта модель любит описывать «другое измерение» (another dimension) обсуждаемого предмета и отмечать, что какое-либо действие «может обеспечить» (may provide) или «способно дать» (can provide) определённое преимущество. Наиболее ярким маркером модели исследователи считают «корректирующую формулировку»: когда некий предмет определяется как «не просто X» (not simply X) или подаётся как альтернатива — «вместо того, чтобы полагаться на X» (rather than relying on X). Подобные формулировки в текстах Astra встречаются более чем в сто раз чаще, чем у людей.

Ранее характерным признаком составленных ИИ текстов было обилие длинного тире. Разработчики учли это, и в изученных Graphite образцах текстов модель Claude Opus 5.5 использовала данный знак препинания на 99 % реже, чем Opus 5. OpenAI GPT-6 Astra употребляет его на 88 % реже, чем люди, а Google Gemini 3.1 Pro отказалась от длинного тире почти полностью. В целом число речевых маркеров не снижается — на смену одним приходят другие, «и у каждой версии модели они свои», говорят исследователи.

Разработчики действительно стремятся добиться у ИИ максимально приближенного к человеческому стиля письма — такие заявления делала Anthropic с выпуском Opus 5.5 и OpenAI, когда представила GPT-6 Sol и Luna. Но едва ли у ИИ-лабораторий получится полностью искоренить подобные речевые предпочтения, считают в Graphite. Примечательно, что если ИИ-модели стремятся общаться более по-человечески, то язык человека становится всё более похожим на генерируемый чат-ботами текст — недавно на это пожаловались представители сразу нескольких профессий.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.

View the original on 3DNews →

KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.