Ученые опровергли теорию языка, существовавшую 70 лет, сделав удивительное открытие
Новое исследование ставит под сомнение широко распространенное мнение о том, что значения слов организованы вокруг эмоций. Проанализировав миллиарды слов, ученые обнаружили, что язык может формироваться чем-то более фундаментальным: потребностью в безопасности.
Исследователи из Университета Вермонта нашли новый способ понимания языка, бросив вызов главному предположению в психологии, лингвистике и искусственном интеллекте, которое определяло исследования более 70 лет.
Их исследование, опубликованное в журнале Science Advances, представляет собой «узиометрию» — количественный подход к изучению сущностного значения. Работа предполагает, что язык организован не столько вокруг эмоций, сколько вокруг более глубокой модели, сформированной властью, опасностью и порядком.
Главный вывод поразителен: в языке люди неизменно склоняются к безопасности.
Скрытая предвзятость в языке
На протяжении десятилетий многие исследователи описывали значение через три эмоциональных измерения: валентность (положительная против отрицательной), возбуждение (возбужденное против спокойного) и доминирование (контролирующее против подчиненного) — модель, известная как структура VAD. Этот подход развился из влиятельных работ Чарльза Осгуда и других в 1950-х годах и широко используется в психологии, лингвистике и системах искусственного интеллекта, анализирующих настроение.
Новый анализ, основанный на миллиардах случаев использования более 20 000 слов в различных реальных текстах, показывает, что эта давно используемая структура имеет существенные недостатки. При поддержке Национального научного фонда США, Google, MassMutual и других спонсоров исследователи использовали современные вычислительные методы для выявления другого набора основных измерений смысла. Они обнаружили, что измерения VAD не являются по-настоящему независимыми и могут скрывать более фундаментальную структуру в языке.
Исследователи утверждают, что смысл лучше отражается тремя независимыми измерениями: сила (слабое против сильного), опасность (безопасное против опасного) и структура (упорядоченное против хаотичного).
Исследователи из Университета Вермонта разработали «усиометр» — инструмент для измерения смысла в больших текстах — и выделили три ключевых измерения смысла: сила, опасность и структура. На примере «Отверженных» они показали, как язык повествования меняется по этим измерениям с течением времени, продемонстрировав способность инструмента отображать смысл в больших текстах. (Источник: Университет Вермонта)
Это важно сейчас, потому что языковые технологии все больше влияют на то, как люди общаются, от больших языковых моделей до автоматической модерации контента. Понимание структуры смысла стало более актуальным. Новая модель объясняет более 90% вариаций смысла, по сравнению с примерно 72% для традиционной модели VAD.
Когда исследователи изучали использование слов в книгах, новостях, социальных сетях и устной речи, одна закономерность повторялась снова и снова. Язык явно отдает предпочтение словам, связанным с безопасностью, перед словами, связанными с опасностью.
Этот перекос в сторону безопасности предлагает новую интерпретацию принципа Поллианны — давно известной в лингвистике идеи о том, что язык, как правило, имеет положительную направленность. Новая работа предполагает, что эта закономерность не сводится просто к позитивным эмоциям. Вместо этого она отражает более глубокую склонность к безопасности. «Позитивная предвзятость принципа Поллианны, — заключает исследование, — на самом деле является одномерной проекцией лежащей в основе предвзятости к безопасности».
«Это важное наблюдение, которое следует из этой работы, — сказал Питер Доддс, директор Института сложных систем UVM и старший автор исследования. — Выражения безопасности имеют решающее значение для любого языка».
За пределами позитивности: язык как система выживания
Полученные результаты имеют широкие последствия. Если язык ориентирован на безопасность, то коммуникация, возможно, формировалась под влиянием эволюционных факторов, связанных с выживанием. Слова делают больше, чем просто выражают эмоции. Они помогают людям оценивать риск, выявлять угрозы и координировать поведение в условиях неопределенности.
Эта точка зрения помогает объяснить, почему люди так часто сообщают о том, чувствуют ли они себя в безопасности или в опасности. В разных культурах и ситуациях люди регулярно сигнализируют об уровне риска мест, действий, людей и событий. Исследование предполагает, что это измерение безопасности не является второстепенным по отношению к эмоциям. Это может быть одной из основ смысла.
С этой точки зрения, позитивность в языке связана не только со счастьем, одобрением или оптимизмом. Она также может сигнализировать о предсказуемости и безопасности в общей среде. Джулия Циммерман, научный сотрудник лаборатории вычислительных историй в Вермонтском университете и соавтор исследования, говорит, что эта концепция указывает на базовую особенность человеческого опыта. «Власть, опасность и структура, — сказала она, — актуальны для каждого человека, когда-либо жившего на Земле».
Лингвисты также давно отмечают, что язык отдает предпочтение выражениям добра и низкой агрессии. «Теперь мы понимаем, — пишет команда, — что это «тени лежащей в основе лингвистической предвзятости к безопасности».
Переосмысление значения в разных дисциплинах
Результаты исследования ставят под сомнение предположения в нескольких областях.
Для искусственного интеллекта последствия очевидны. Многие системы обработки естественного языка зависят от анализа настроений, основанного на моделях, подобных VAD. Если эти модели не отражают более глубокую структуру значения, системы ИИ могут систематически неправильно интерпретировать человеческий язык. Добавление в эти системы понятий силы, опасности и структуры может сделать их более точными и простыми для интерпретации, особенно в задачах, связанных с риском, доверием и принятием решений.
Для лингвистики исследование меняет представление исследователей о базовой организации значения. Вместо того чтобы рассматривать эмоциональный тон как основную структуру слов, работа указывает на различия, связанные с выживанием, включая то, что является сильным, что является опасным и что является упорядоченным.
Для психологии результаты исследования ставят под сомнение десятилетия исследований, построенных вокруг модели VAD. Если основные измерения значения отличаются от того, что предполагали многие исследователи, то некоторые интерпретации эмоций, восприятия и поведения, возможно, потребуется пересмотреть.
С точки зрения нейробиологии, результаты согласуются с уже известными данными о сильной чувствительности мозга к угрозе и безопасности. Предвзятость в отношении безопасности в языке может отражать биологические приоритеты в символической коммуникации, помогая связать нейронные процессы с тем, как люди используют слова.
Новая научная концепция: узиометрия
Для выявления этих закономерностей исследователи разработали новые инструменты для измерения смысла в больших масштабах. Одним из ключевых инструментов является «узиометр» — прибор, предназначенный для быстрого измерения основного смысла больших объемов текста и получения среднего балла смысла. (Слово «ouisa» происходит из древнегреческого языка и является корнем английского слова «essence» — сущность). Основываясь на ранее разработанном командой «гедонометре» (измерителе счастья), новый инструмент может выявлять общие закономерности смысла в текстах, начиная от романов Джейн Остин и рассказов Артура Конан Дойла о Шерлоке Холмсе и заканчивая газетой New York Times, Википедией, стенограммами радиопередач и Twitter.
В одном из примеров исследования рассматривается «узиометрическая траектория» английского перевода романа Виктора Гюго «Отверженные». Подобно разноцветному белку, запутанный путь книги извивается по сетке, определяемой четырьмя противоположными парами: опасный и безопасный, слабый и сильный, нежный и агрессивный, злой и добрый. Такой подход позволяет сжать основной смысл различных разделов романа по мере развития сюжета.
В исследовании также проводится важное различие между словами как категориями, известными как «типы», и словами в том виде, в котором они фактически используются, известными как «токены». (Например, как категория, «яблоко» — это тип, и каждое использование слова «яблоко» в предложении — это токен.) В более ранних работах слова часто рассматривались так, как если бы они имели одинаковое значение, независимо от того, как часто они встречаются.
Учитывая частоту использования, группа из 10 ученых под руководством Питера Доддса и Криса Данфорта, профессоров Колледжа инженерных и математических наук Вермонтского университета, совместно с коллегами из Института Санта-Фе, Центра сложных наук в Австрии, Медицинского центра Говарда Хьюза, Калифорнийского университета в Беркли, Университета Аделаиды и MassMutual Data Science, смогла выявить закономерности, которые проявляются только в реальном использовании языка, включая предвзятость в отношении безопасности.
Почему это важно сейчас
Если язык постоянно склоняется к безопасности, это открытие может повлиять на то, как исследователи понимают распространение информации, построение нарративов и то, как люди интерпретируют мир. Это может иметь значение для политического дискурса, коммуникации в сфере психического здоровья и проектирования систем искусственного интеллекта, реагирующих на человеческий язык.
В более широком смысле, исследование предполагает сдвиг в понимании смысла. Смысл — это не только вопрос эмоций или чувств. Он также коренится в необходимости ориентироваться в рисках, отношениях и социальном порядке. Раскрывая более глубокую геометрию смысла, команда предлагает новый взгляд на язык не только как на систему символов, но и как на свидетельство того, что необходимо людям для выживания в социальном и опасном мире.
