Как искусственный интеллект оценивает свою уверенность: сравнение с людьми

Исследование сравнивает точность оценки уверенности у людей и генеративных ИИ-чатов, таких как ChatGPT и Gemini. Узнайте, насколько ИИ способен к самоанализу и можно л...

Материал носит информационный характер и не заменяет консультацию психолога или врача.

Как искусственный интеллект оценивает свою уверенность: сравнение с людьми

По теме

Улучшение восприятия тела у людей с заметными особенностями ...

Узнайте, как онлайн-программа 'Расширь свой кругозор' помогает людям с заметными особенностями внешн...

Как развить честность и внутренний баланс: 4 эффективных спо...

Узнайте, как развитие целостности и честности перед самим собой помогает улучшить эмоциональную регу...

Нарушение восприятия причинности при болезни Паркинсона: рез...

Исследование показывает, как болезнь Паркинсона меняет зрительное восприятие причинно-следственных с...

Как собаки воспринимают мир: почему они выбирают места, а не...

Исследование когнитивных особенностей собак показывает, что наши питомцы ориентируются в пространств...

Ранние дезадаптивные схемы и межличностная регуляция эмоций:...

Подробное научное исследование связи между ранними дезадаптивными схемами и направленной на других м...

Йога-медитация или дневной сон: что эффективнее для мозга?

Сравнительное исследование влияния 15-минутной йога-медитации и дневного сна на когнитивную функцию ...

Рисунок 1
Рисунок 1
Рисунок 2
Рисунок 2
Рисунок 3
Рисунок 3
Рисунок 4
Рисунок 4
Рисунок 5
Рисунок 5
Рисунок 6
Рисунок 6
Рисунок 7
Рисунок 7
Рисунок 8
Рисунок 8
Рисунок 9
Рисунок 9
Рисунок 10
Рисунок 10
Рисунок 11
Рисунок 11
Thumbnail 1
Thumbnail 2
Thumbnail 3
Thumbnail 4
Thumbnail 5
Thumbnail 6
Thumbnail 7
Thumbnail 8
Thumbnail 9
Thumbnail 10
Thumbnail 11
Оригинал исследования на сайте автора

Введение

В повседневном общении люди часто просят других оценить свою уверенность в точности утверждений. Эти суждения помогают слушателям решить, насколько следует корректировать свои представления с учетом мнения собеседника. Учитывая важность уверенности в поведении и коммуникации, психологи давно изучают, как люди оценивают свою уверенность и насколько эти оценки точны.

Large Language Model (LLM) чат-боты

Исследователи давно интересуются системами, способными понимать и генерировать человеческую речь — это направление называется обработкой естественного языка (NLP). Современные NLP-модели, такие как ChatGPT или Gemini, обучаются на огромных массивах текстовых данных и используют сложные алгоритмы машинного обучения, включая нейронные сети. Их называют Large Language Models (LLM), потому что они содержат миллиарды параметров, позволяющих имитировать человеческую речь.

Как работают LLM?

Генеративные ИИ-чаты предсказывают наиболее вероятный ответ на запрос пользователя, но не обладают сознанием или интроспекцией. Они просто вычисляют статистические закономерности в данных.

Метакогнитивные способности LLM

Метакогниция — это способность оценивать собственные когнитивные процессы. Люди используют три типа сигналов для таких оценок:

  • Внутренние сигналы (например, сложность задачи)
  • Внешние сигналы (например, контекст выполнения)
  • Мнемонические сигналы (например, легкость вспоминания)

LLM могут использовать только внутренние и частично внешние сигналы, так как у них нет субъективного опыта.

Точность уверенности у LLM и людей

Исследования показывают, что LLM, как и люди, склонны к переоценке своей точности. Однако некоторые модели (например, Claude) демонстрируют лучшую калибровку. В отличие от людей, LLM хуже учатся на собственном опыте и не всегда корректируют уверенность после выполнения задачи.

Абсолютная и относительная точность

Абсолютная точность (калибровка) показывает, насколько уверенность совпадает с реальной точностью. Относительная точность (разрешение) отражает способность различать более и менее надежные ответы. В некоторых задачах LLM превосходят людей, в других — уступают.

Выводы

LLM демонстрируют схожую с людьми точность оценки уверенности, но используют иные механизмы. Их суждения зависят от статистических закономерностей, а не интроспекции. Будущие исследования помогут лучше понять, как ИИ формирует уверенность и можно ли ему доверять в критически важных областях.

Короткие версии статей можно найти в телеграм-канале.

Посмотреть канал
Кликните еще раз для перехода

Луомма Идеалиста компрессионные чулки 18-22 мм рт. ст. XL

Компрессионные чулки Луомма Идеалиста (18-22 мм рт. ст.) с закрытым носком в размере XL обеспечивают...

Луомма Идеалиста компрессионные чулки 18-22 мм рт. ст. XL

Селен-Актив: добавка с селеном и витамином С, 30 таблеток

Биодобавка Селен-Актив содержит селен и витамин С для поддержания здоровья и иммунитета. Восполняет ...

Селен-Актив: добавка с селеном и витамином С, 30 таблеток

Бинт марлевый стерильный 5м х 10см Мед Н - для перевязок

Стерильный марлевый бинт Мед Н 5м х 10см предназначен для надежной фиксации повязок и перевязочных м...

Бинт марлевый стерильный 5м х 10см Мед Н - для перевязок

Панкреатин 25 Ед №60 — ферменты для пищеварения

Панкреатин 25 Ед в кишечнорастворимой оболочке — ферментный препарат, содержащий амилазу, липазу и п...

Панкреатин 25 Ед №60 — ферменты для пищеварения

Парацетамол 500 мг №20 — жаропонижающее и обезболивающее

Парацетамол 500 мг — эффективное обезболивающее и жаропонижающее средство. Быстро всасывается и дейс...

Парацетамол 500 мг №20 — жаропонижающее и обезболивающее

Успокаивающие драже Валериана+Хмель+Мята для сна и снятия ст...

Успокаивающие драже Pl Валериана+Хмель+Мята помогают снять стресс, нормализовать сон и снизить трево...

Успокаивающие драже Валериана+Хмель+Мята для сна и снятия стресса