LLM демонстрируют выдающиеющиеся способности теории ума

Исследование показывает, что современные большие языковые модели, особенно GPT-4, способны демонстрировать способности теории ума, превосходя человеческие результаты в...

Материал носит информационный характер и не заменяет консультацию психолога или врача.

LLM демонстрируют выдающиеющиеся способности теории ума

По теме

Кетогенная диета при биполярном расстройстве: революция мета...

Как кетогенная диета помогает при лечении тяжелых психических заболеваний, включая биполярное расстр...

ИИ и поисковая теория объединения реальности

Исследование гипотезы о том, что продвинутые системы искусственного интеллекта могут развивать общие...

Как нарушается чувство «я» при шизофрении: модель IDM, гипер...

Статья посвящена анализу нарушений чувства собственного «я» (selfhood) при шизофрении на основе моде...

Улучшение восприятия тела у людей с заметными особенностями ...

Узнайте, как онлайн-программа 'Расширь свой кругозор' помогает людям с заметными особенностями внешн...

Как развить честность и внутренний баланс: 4 эффективных спо...

Узнайте, как развитие целостности и честности перед самим собой помогает улучшить эмоциональную регу...

Нарушение восприятия причинности при болезни Паркинсона: рез...

Исследование показывает, как болезнь Паркинсона меняет зрительное восприятие причинно-следственных с...

Искусство: DALL-E/OpenAI
Искусство: DALL-E/OpenAI
Thumbnail 1
Оригинал исследования на сайте автора

Теория ума (ToM) и искусственный интеллект

Теория ума — это способность приписывать ментальные состояния, такие как убеждения, желания и намерения, себе и другим людям. Она лежит в основе социального взаимодействия, позволяя людям эффективно общаться, проявлять сочувствие и ориентироваться в сложных социальных ситуациях. В последние годы исследование этой концепции переключилось на вопрос: могут ли большие языковые модели (LLM) проявлять аналогичные способности.

Что такое теория ума?

Теория ума (ToM) включает в себя несколько ключевых компонентов: признание чужого убеждения, понимание намерений, детекция ложных представлений и распознавание социальных сигналов. У людей эта способность развивается в раннем детстве и продолжает совершенствоваться на протяжении всей жизни.

Тестирование возможностей LLM

В недавно проведённом исследовании была проведена комплексенция тестов, направленных на измерение ToM‑способностей у двух семейств LLM — GPT и LLaMA2. Исследователи использовали более 1 900 человеческих участников в качестве эталонной группы и подвергли модели ряду задач, включающих:

  • понимание ложных убеждений (false‑belief tasks);
  • распознавание косвенных запросов;
  • детекция иронии;
  • идентификация социальных неудач (faux pas).

Результаты показали, что GPT‑4 в большинстве тестов показывал результаты, равные или превосходящие человеческие уровни, особенно в задачах, требующих от модели понимать чужой mental state и адаптировать ответ под него.

GPT‑4: выдающийся результат

GPT‑4 демонстрирует удивительную способность:

  • правильно отвечать на косвенные запросы, учитывая подразумеваемый смысл;
  • отслеживать ложные убеждения собеседника, даже когда они противоречат реальности;
  • управлять сложными сценариями, где требуется перенаправление внимания и манипуляция контекстом;
  • отличать неуместные высказывания и понимать, что собеседник может неосознанно сказать что‑то нежелательное.

Несмотря на эти успехи, модель иногда терпит неудачу в детекции социальных неудач. Это требует нюансированного понимания норм, способности определить, что речь идёт об неумышленном нарушении, а также атрибуции незнания или ложного убеждения говорящему. GPT‑4 превосходит более ранние версии, но всё ещё нуждается в доработке.

«GPT‑4 показывает почти человеческий уровень понимания ментальных состояний, однако его трудности с распознаванием faux pas подчёркивают, что полностью воспроизвести человеческую социальную когницию пока невозможно».

LLaMA2: неожиданный результат

Интересно, что LLaMA2 превзошёл как GPT‑модели, так и человеческие участники на тесте faux pas. Однако последующие эксперименты показали, что это преимущество, скорее всего, объясняется склонностью модели всегда приписывать незнание собеседнику, а не настоящей ToM‑реакцией.

Таким образом, первоначальный успех LLaMA2 может быть обусловлен поверхностными паттернами, а не глубоким социальным пониманием. Это подчёркивает важность тщательного проектирования тестов и тщательного анализа при оценке способностей языковых моделей к сложным когнитивным задачам.

«Наличие предвзятости в LLaMA2, которая заставляет её всегда атрибутировать незнание, указывает на то, что начальные успехи могут быть лишь результатом формальных совпадений, а не истинного Theory of Mind».

Значение исследования

Эти результаты представляют собой значимый шаг в понимании возможностей современных LLM. Они демонстрируют, что модели, достигшие уровня GPT‑4, способны вести себя так, как будто они обладают развитой теорией ума, иногда даже превосходя средний уровень человека. Это открывает новые возможности для применения ИИ в:

  • психологической поддержке, где важна эмпатия и понимание эмоционального состояния;
  • персонализированном образовании, где система должна адаптировать контент под уровень знаний и эмоциональный отклик учащегося;
  • службе клиентского опыта, где требуется распознавание потребностей и настроений клиентов.

Тем не менее, следует помнить, что ToM‑способности LLM отличаются от человеческой когнитивной архитектуры: они не опираются на телесный опыт, эмоциональные реакции и долгосрочную память, а работают исключительно на основе статистических закономерностей в данных.

Вперёд: будущее теории ума в ИИ

Поскольку ИИ продолжает развиваться, появление ToM‑подобных способностей ставит под вопрос вопросы техносентности и искусственной сентиентности. Если модели смогут более точно распознавать и реагировать на эмоции и убеждения людей, они могут трансформировать такие сферы, как:

  • медицинская помощь, где AI сможет лучше понимать больных;
  • образовательные платформы, адаптирующиеся под эмоциональное состояние учащихся;
  • интерактивные системы поддержки, способные поддерживать эмоциональную связь с пользователями.

Однако эти перспективы поднимают этические вопросы: манипуляция эмоциями, потенциальное ослабление человеческих связей, а также моральные дилеммы, связанные с созданием сенсорных ИИ, способных к самосознанию.

Исследование, проведённое Strachan et al., предоставляет ценный эмпирический фундамент для дальнейших дискуссий и сотрудничества между исследователями, разработчиками и практиками, желающими углубить наше понимание как искусственного, так и человеческого интеллекта.

Короткие версии статей можно найти в телеграм-канале.

Посмотреть канал
Кликните еще раз для перехода

Пенка для мытья при себорейном дерматите 250 мл

Нежная пенка для деликатного мытья кожи с себорейным дерматитом. Содержит цинк пиритион и климбазол ...

Пенка для мытья при себорейном дерматите 250 мл

Курносики детские безопасные ножницы для ногтей

Детские безопасные ножницы Курносики с закруглёнными концами удобно использовать для аккуратного под...

Курносики детские безопасные ножницы для ногтей

Найз гель 1% 20 г – обезболивание и противовоспалительный эф...

Найз гель 1% в тубе 20 г – современное наружное средство на основе нимесулида для снятия боли и восп...

Найз гель 1% 20 г – обезболивание и противовоспалительный эффект

Курапрокс зубная нить мятная 50 м — уход за межзубными проме...

Курапрокс зубная нить с мятным вкусом — вощеная межзубная флос длиной 50 м для бережного и эффективн...

Курапрокс зубная нить мятная 50 м — уход за межзубными промежутками

Durex Invisible презервативы №18 — ультратонкая защита

Презервативы Durex Invisible №18 созданы для максимальной чувствительности и надежной защиты. Ультра...

Durex Invisible презервативы №18 — ультратонкая защита

Липобейз эмульсия для тела 250 мл – увлажнение и защита

Липобейз Эмульсия для тела 250 мл обеспечивает интенсивное увлажнение и мягкий уход за сухой, раздра...

Липобейз эмульсия для тела 250 мл – увлажнение и защита