Препринт — материал ещё не прошёл рецензирование
Люди считают ИИ менее способным отвечать за поступки
Кратко
В опросе 190 участников людям приписывали больше способности самостоятельно принимать решения и отвечать за последствия, чем автономным ИИ. Языковые модели в целом повторяли эту разницу, но в конкретных дилеммах сильнее учитывали тяжесть вреда и срочность ситуации, чем свойства самого ИИ.
Зачем это знать
Работа помогает разделить два вопроса: как люди оценивают ИИ и умеет ли он действительно принимать моральные решения. На второй вопрос эти результаты ответа не дают.
Разбор
Авторы сравнили не «ум» людей и моделей, а то, кому наблюдатели приписывают моральную самостоятельность — способность принимать этические решения и нести за них ответственность. Люди оценивали человека по имени Энди и трёх искусственных агентов: роботов X100, A100 и Nao. Для этого использовали опросник с двумя отдельными сторонами оценки: насколько агент выглядит способным действовать по моральным причинам и насколько его поведение зависит от программы. Затем те же ситуации предложили нескольким языковым моделям.
У людей Энди получил среднюю оценку моральной способности 5,65 по семибалльной шкале, а искусственные агенты — примерно от 2,96 до 3,35. При этом роботов считали гораздо сильнее зависимыми от заранее заданной программы: их оценки зависимости были около 5,3–5,5, тогда как у Энди — 2,53. Иными словами, разрыв возник не только из-за общего недоверия к ИИ: люди отдельно видели в нём меньше моральной способности и больше запрограммированности. Все четыре проверенные модели воспроизвели оба направления, хотя чаще завышали самостоятельность искусственных агентов по сравнению с людьми.
Точность совпадения с ответами людей заметно различалась между моделями. Лучше всего в общей картине совпала Llama 8B, почти так же — Phi-4 и Llama 11B; InternVL3-38B ошибалась сильнее. Но в отдельных моральных сценах модели опирались прежде всего на то, насколько велик возможный вред и насколько срочно нужно действовать. Поэтому их оценка могла меняться вместе с обстоятельствами, а не оставаться устойчивой характеристикой самого агента. Раньше такие оценки изучали у людей и искусственных агентов по отдельности; эта работа напрямую сопоставляет человеческие ответы с ответами моделей в правдоподобных сценариях умного города.
Ключевые цифры
Можно ли доверять
Это препринт на arXiv, поэтому его ещё не прошла независимая проверка рецензентами. В работе участвовали 190 людей, а модели оценивали заданные текстовые сценарии, а не реальные поступки; кроме того, результаты зависят от конкретных роботов, формулировок и выбранных моделей.
Пересказано ИИ по научной статье. Как это устроено