Письмо

Нейросети лишают письменную речь стилистического разнообразия

Анализ сотен тысяч текстов в сети показал, что распространение нейросетей делает человеческую речь более шаблонной. Искусственный интеллект часто использует специфические речевые конструкции и слова-маркеры. При этом существующие программы пока не умеют безошибочно распознавать машинную генерацию.
Автор Наука Mail
Письмо
Искусственный интеллект начал незаметно менять саму структуру привычного письменного языкаИсточник: Unsplash

Ученые из США проанализировали сотни тысяч текстов в интернете. Оказалось, что повсеместное использование нейросетей приводит к деградации языкового разнообразия. Статья опубликована в журнале Nature Human Behaviour.

Искусственный интеллект начал незаметно менять саму структуру привычного письменного языка. Сгенерированные тексты массово появляются на новостных сайтах, в соцсетях и даже в книжных работах. Так, недавно крупное издательство отменило контракт на несколько миллионов долларов из-за подозрений в машинном авторстве романа.

До появления продвинутых алгоритмов можно было с уверенностью предполагать, что текст написан живым человеком. Теперь экспертам приходится искать специфические паттерны, выдающие работу языковых моделей. Одним из главных признаков машинного стиля стало нетипично частое использование слов «тщательный», «подчеркивать» и «замысловатый».

Такие маркеры стали массово появляться даже в аннотациях к строгим научным статьям с 2022 года. Сами по себе эти слова ничего не доказывают, но их сочетание с идеальным построением фраз выдает работу алгоритма. Нейросети также любят использовать правило трех (прием, когда идея или сюжет строятся на трех элементах) и часто делают излишне длинные вступления.

Написание текста
Одним из главных признаков машинного стиля стало нетипично частое использование слов «тщательный», «подчеркивать» и «замысловатый»Источник: Nedim/Unsplash

Иллюзия старательности

Еще одной подсказкой при поиске следа ИИ являются объем и структура сообщений. Алгоритмы снимают с человека бремя временных затрат на формулирование мыслей. Там, где занятой человек ответил бы парой коротких фраз, бот выдает подробный абзац.

В тоже время полагаться на специальные программы для распознавания машинного текста пока нельзя. Проверка показала, что детекторы выдают ложные срабатывания в 61% случаев при анализе эссе, написанных иностранцами. Один из популярных инструментов и вовсе ошибочно забраковал 97% текстов от неносителей языка.

В целом же масштабный анализ более 880 тыс. сообщений на форумах и новостных порталах выявил тревожную тенденцию. Распространение нейросетей напрямую связано с уменьшением вариативности стиля письма в сети. Если тенденция сохранится, люди могут утратить индивидуальность и нюансы письменного общения.

Ранее ученые выяснили, что 26% пользователей нейросетей теряют продуктивность.