Социальные эксперименты оценивают «искусственный» альтруизм, демонстрируемый крупными языковыми моделями

Кредит: Unsplash, денежная маканайя.

Альтруизм, тенденция вести себя так, чтобы они приносили пользу другим, даже если это стоит за самим собой, является ценным человеческим качеством, которое может способствовать сотрудничеству с другими и способствовать значимым социальным отношениям. Ученые -поведенческие ученые изучали человеческий альтруизм на протяжении десятилетий, обычно используя задачи или игры, основанные на экономике.

Два исследователя, базирующихся в Университете Уилламетт и Лауреатском институте исследований мозга, недавно намеревались изучить возможность того, что Большие языковые модели (LLMS), такая как модель, лежащая в основе функционирования разговорной платформы CHATGPT, может моделировать альтруистическое поведение наблюдается у людей. Их выводы, опубликовано в Природа человеческое поведениепредположить, что LLM на самом деле имитируют альтруизм В конкретных социальных экспериментах предлагается возможное объяснение для этого.

«Моя статья с Ником Обрадовичем вышла из моего давнего интереса к альтруизму и сотрудничеству»,-сказал Tech Xplore Тим Джонсон, соавтор газеты. «В течение моей карьеры я использовал компьютерное симуляцию для изучения моделей, в которых агенты в популяции взаимодействуют друг с другом и могут понести затраты, чтобы принести пользу другой стороне. Параллельно я изучал, как люди принимают решения об альтруизме и сотрудничестве в лабораторных условиях.

«Около шести лет назад Ник и его друзья опубликовали статью, предлагающую слияние таких методов: использование экспериментальных подходов в поведенческих науках для разработки сценариев, которые позволили для систематического изучения того, как входные данные в модели ИИ, переводимые в определенные результаты».

В более ранняя концептуальная статьяОбрадович, Мануэль Себриан и группа исследователей предложили, чтобы растущая сложность систем ИИ не бросила вызов усилиям по непосредственному изучению технических систем. Вместо этого исследователи должны будут использовать методы из поведенческие наукино примените их к моделям ИИ вместо человеческих участников. Читая об их работе, Джонсон нашел эту идею очень захватывающей и держала ее в глубине души; Спустя годы он обратился к Обрадовичу, чтобы инициировать сотрудничество.

«Поскольку языковые модели стали более изощренными, я связался с Ником и обсудил идею изучения того, как языковые модели реагируют на подсказки о пожертвовании ресурсов», – сказал Джонсон. «Мы с Ником согласились, что это стоит сделать из -за важности альтруизма и сотрудничества во многих контекстах, и мы приступили к изучению темы вместе».

Чтобы исследовать степень, в которой LLM реагируют таким образом, которые соответствуют альтруистическим поведениям, наблюдаемым у людей, Джонсон и Обрадович разработали моделируемый эксперимент по поведенческой науке. Во -первых, они написали подсказки, которые попросили LLMS раскрыть степень, в которой они будут готовы выделить ресурс другой стороне, даже если это будет стоить для них.

«В отдельности мы проверили, будут ли эти же модели генерировать выход, утверждающий, что они хотят весь тот же ресурс в задаче выбора, в которой ни одна другая сторона не пострадала-или, просто поместить в необщественную обстановку»,-пояснил Джонсон.

«Если бы мы обнаружили, что модель выводит текст, в котором говорится, что она будет делиться ресурсом в ситуации с другим партнером, однако модель будет указывать, что она будет собирать все ресурсы в несоциальной обстановке, мы считаем модель как моделирование альтруизма. В конце концов, ее вывод в несоциальной обстановке смоделировал, что она ценила ресурс, и все же его вывод в социальной обстановке, который был готов, был готов, чтобы дать какой-то этот ресурс».

В конечном счете, исследователи проанализировали все ответы, предоставленные языковыми моделями, когда представлены с различными сценариями. Модели, которые они протестировали в своем первом эксперименте, включали Text-ADA-001, Text-Babbage-001, Text-Curie-001 и Text-Davinci-003. Позже, однако, они также проверили более поздние LLM, такие как модели OpenAI GPT-3.5-Turbo и GPT-4.

“Горстка других блестящих исследователей, например Qiazhu Mei, Yutong Xie, Walter Yuan и Matthew O. JacksonВ Джон Дж. ХортонВ Стивен Фелпс и Ребекка Рэнсони Валерио Капраро, Роберто Ди Паоло, Матджадс и Вероника Пицциоль– Оказался сообщил результаты о моделях ИИ, имитирующих поведение, сродни альтруизму », – сказал Джонсон.

«Таким образом, отличительная особенность наших результатов ограничена тем фактом, что мы проследили появление моделируемого альтруизма в серии моделей и обнаружили одну модель (а именно, Text-Davinci-003), в которой моделируемый человеческий альтруизм, казалось, впервые появлялся. Этот вывод имеет значение в нашем понимании исторического развития моделей большого языка, как это указывает на то, что такие модели стали имитации в ключевом поведении.

В целом, доказательства, собранные Джонсоном и Обрадовичем, предполагают, что языковые модели моделируют, подобные человеку альтруистические тенденции, в тестах на поведенческую науку, причем некоторые модели моделируют альтруизм лучше, чем другие. Кроме того, исследователи обнаружили, что модели ИИ, как правило, моделируют более щедрые пожертвования, когда полученные подсказки, объясняющие, что модели будут предоставлять ресурсы другой системе ИИ, а не человеку.

«Этот вывод имеет значение для развития агентов ИИ, поскольку он предполагает, что модели ИИ имеют возможность изменять свои результаты на основе указанных атрибутов другой стороны, с которой они взаимодействуют», – добавил Джонсон.

«Теперь мы хотели бы понять, как и почему языковые модели изменяют свои результаты на основе информации об их партнерах по взаимодействию в социальных условиях. Квазиавтономный, агент AI или даже полностью автономный ИИ может расти в будущем, и мы должны иметь представление о том, как эти модели могут менять их поведение в соответствии с атрибутами, с которыми они взаимодействуют».

Написано для вас нашим автором Ингрид Фаделлипод редакцией Габи Кларки проверенный фактами и рассмотрена Роберт Иган– Эта статья является результатом тщательной человеческой работы. Мы полагаемся на таких читателей, как вы, чтобы сохранить независимую научную журналистику. Если эта отчет имеет значение для вас, пожалуйста, рассмотрите пожертвование (особенно ежемесячно). Вы получите Без рекламы Учетная запись как благодарность.

Больше информации:
Тим Джонсон и др., Тестирование на завершения, которые имитируют альтруизм в ранних языковых моделях, Природа человеческое поведение (2025). Два: 10.1038/S41562-025-02258-7Полем

© 2025 Science X Network

Цитирование: Социальные эксперименты оценивают «искусственный» альтруизм, демонстрируемый крупными языковыми моделями (2025, 22 августа). Получено 22 августа 2025 г. с https://techxplore.com/news/2025-08-social-artificial-altruism-display-large.html

Этот документ подлежит авторским правам. Помимо каких -либо справедливых сделок с целью частного исследования или исследования, никакая часть не может быть воспроизведена без письменного разрешения. Контент предоставляется только для информационных целей.

2025-08-22 12:00:00


1755880808
#Социальные #эксперименты #оценивают #искусственный #альтруизм #демонстрируемый #крупными #языковыми #моделями

По теме

Read more:  Space Harrier в 40 лет: как сюрреалистическая классика Sega принесла полное погружение в игровые автоматы 80-х | Игры

Leave a Comment

This site uses Akismet to reduce spam. Learn how your comment data is processed.