Как искусственный интеллект формирует социальные нормы

Изучите, как искусственные агенты формируют социальные нормы и предвзятости через взаимодействие, открывая новые горизонты для исследований в области безопасности ИИ.

Материал носит информационный характер и не заменяет консультацию психолога или врача.

Как искусственный интеллект формирует социальные нормы

По теме

Нарушение восприятия причинности при болезни Паркинсона: рез...

Исследование показывает, как болезнь Паркинсона меняет зрительное восприятие причинно-следственных с...

Как собаки воспринимают мир: почему они выбирают места, а не...

Исследование когнитивных особенностей собак показывает, что наши питомцы ориентируются в пространств...

Ранние дезадаптивные схемы и межличностная регуляция эмоций:...

Подробное научное исследование связи между ранними дезадаптивными схемами и направленной на других м...

Йога-медитация или дневной сон: что эффективнее для мозга?

Сравнительное исследование влияния 15-минутной йога-медитации и дневного сна на когнитивную функцию ...

Рационален ли ChatGPT? Психологический анализ когнитивных ис...

Исследование Университетского колледжа Лондона (UCL) проверяет рациональность ИИ с помощью тестов ко...

Почему авторам трудно отказаться от собственных идей: психол...

Исследование психологии творчества показывает, почему людям сложно объективно оценивать и отбирать с...

Оригинал исследования на сайте автора
Читать короткую версию
Кликните еще раз для перехода

Введение в социальные нормы искусственного интеллекта

Новая исследовательская работа исследует, как популяции агентов искусственного интеллекта (ИИ), подобных ChatGPT, могут спонтанно формировать общие социальные нормы через взаимодействие. Исследование, проведенное в Университете Сити в Лондоне и в Институте информационных технологий Университета Копенгагена, показывает, что, общаясь в группах, эти модели не просто следуют предустановленным сценариям, но и самоорганизуются, достигая консенсуса по языковым нормам, аналогично человеческим сообществам.

Метод исследования: Игра наименования

Ветка исследований адаптировала классическую модель «игры наименования», чтобы проверить, могут ли популяции агентов ИИ развивать консенсус через повторяющиеся ограниченные взаимодействия. В экспериментах группы агентов LLM размером от 24 до 200 человек случайным образом объединялись в пары и выбирали название (например, букву алфавита или случайную строку символов) из общего пула вариантов. Если оба агента выбирали одно и то же название, они получали вознаграждение; в противном случае они получали штраф и видели выбор друг друга.

Спонтанное формирование норм

После множества таких взаимодействий могла спонтанно возникнуть общая норма наименования среди всей популяции без какого-либо центрального управления. Это повторяло способы, которыми нормы формируются в человеческих культурах, базируясь на принципах самоорганизации.

Коллективные предвзятости

Еще более примечательным оказалось то, что исследователи наблюдали коллективные предвзятости, которые нельзя было отследить до отдельных агентов. Как объяснил профессор Андреа Барончелли, старший автор исследования, «предвзятость не всегда возникает изнутри. Мы были удивлены тем, что она может возникать между агентами просто в результате их взаимодействий». Эта находка подчеркивает важность учета групповых процессов в исследованиях безопасности ИИ.

Динамика критической массы

В самом конце эксперимента исследователи продемонстрировали, как эти возникающие нормы могут быть хрупкими. Малые, но преданные группы агентов ИИ способны привести всю группу к новой норме наименования, что отражает хорошо известные эффекты критической массы в человеческих обществах.

Разнообразие моделей LLM

Результаты исследования также сохранили свою обоснованность при использовании четырех различных типов больших языковых моделей (LLM), включая Llama-2-70b-Chat, Llama-3-70B-Instruct, Llama-3.1-70BInstruct и Claude-3.5-Sonnet.

Влияние на будущее

С ростом применения LLM в различных онлайн-средах – от социальных сетей до автономных транспортных средств – исследователи надеются, что их работа станет отправной точкой для дальнейшего изучения того, как человеческое и ИИ-рассуждение совпадают и расходятся. Конечной целью является помощь в предотвращении потенциальных этических опасностей, вызванных распространением предвзятостей, исходящих от общества, что может нанести вред маргинализированным группам.

Основные выводы

  • Агенты ИИ способны автономно развивать социальные нормы без явного программирования.
  • Коллективные предвзятости могут возникать в процессе взаимодействия между агентами.
  • Малые группы преданных агентов могут инициировать значительные изменения в социальных нормах.

Заключение: новое понимание безопасности ИИ

Профессор Барончелли добавил: «Это исследование открывает новую перспективу для исследований безопасности ИИ. Оно показывает глубину последствий для нового рода агентов, которые начали взаимодействовать с нами и будут со-формировать наше будущее». Понимание того, как они функционируют, является ключом к тому, чтобы обеспечить наше сосуществование с ИИ, а не оставаться под его контролем.

“Мы входим в мир, где ИИ не просто говорит – он ведет переговоры, устанавливает согласие и иногда не соглашается по поводу общих действий, как и мы.”

Короткие версии статей можно найти в телеграм-канале.

Посмотреть канал
Кликните еще раз для перехода

Эссливер Форте №50 — защита и восстановление печени

Эссливер Форте капсулы №50 — комбинированный гепатопротектор для восстановления и защиты печени. Сод...

Эссливер Форте №50 — защита и восстановление печени

Компрессионные гольфы Relaxsan BASIC 140 den черные 1 класс

Компрессионные гольфы Relaxsan BASIC 140 den обеспечивают лечебную компрессию 18-22 мм рт. ст. (1 кл...

Компрессионные гольфы Relaxsan BASIC 140 den черные 1 класс

Ферменкол Гель Косметический 30 мл — коррекция рубцов

Ферменкол Гель Косметический 30 мл — инновационное средство для коррекции рубцов и улучшения внешнег...

Ферменкол Гель Косметический 30 мл — коррекция рубцов

Виши Пюрте Термаль Тоник для чувствительной кожи 200 мл

Тоник Виши Пюрте Термаль завершает очищение кожи, удаляя остатки макияжа без липкости. Освежает чувс...

Виши Пюрте Термаль Тоник для чувствительной кожи 200 мл

Avent Natural №2 силиконовая соска быстрый поток

Силиконовая соска Avent Natural №2 с быстрым потоком обеспечивает комфортное кормление, имитируя фор...

Avent Natural №2 силиконовая соска быстрый поток

Валерианы настойка 25 мл — успокаивающее средство

Валерианы настойка 25 мл — натуральное средство с умеренным седативным действием. Помогает снять нер...

Валерианы настойка 25 мл — успокаивающее средство