dumai
ИИПрепринтarXiv cs.CL

Препринт — материал ещё не прошёл рецензирование

Люди считают ИИ менее способным отвечать за поступки

0

Кратко

В опросе 190 участников людям приписывали больше способности самостоятельно принимать решения и отвечать за последствия, чем автономным ИИ. Языковые модели в целом повторяли эту разницу, но в конкретных дилеммах сильнее учитывали тяжесть вреда и срочность ситуации, чем свойства самого ИИ.

Зачем это знать

Работа помогает разделить два вопроса: как люди оценивают ИИ и умеет ли он действительно принимать моральные решения. На второй вопрос эти результаты ответа не дают.

Разбор

Авторы сравнили не «ум» людей и моделей, а то, кому наблюдатели приписывают моральную самостоятельность — способность принимать этические решения и нести за них ответственность. Люди оценивали человека по имени Энди и трёх искусственных агентов: роботов X100, A100 и Nao. Для этого использовали опросник с двумя отдельными сторонами оценки: насколько агент выглядит способным действовать по моральным причинам и насколько его поведение зависит от программы. Затем те же ситуации предложили нескольким языковым моделям.

У людей Энди получил среднюю оценку моральной способности 5,65 по семибалльной шкале, а искусственные агенты — примерно от 2,96 до 3,35. При этом роботов считали гораздо сильнее зависимыми от заранее заданной программы: их оценки зависимости были около 5,3–5,5, тогда как у Энди — 2,53. Иными словами, разрыв возник не только из-за общего недоверия к ИИ: люди отдельно видели в нём меньше моральной способности и больше запрограммированности. Все четыре проверенные модели воспроизвели оба направления, хотя чаще завышали самостоятельность искусственных агентов по сравнению с людьми.

Точность совпадения с ответами людей заметно различалась между моделями. Лучше всего в общей картине совпала Llama 8B, почти так же — Phi-4 и Llama 11B; InternVL3-38B ошибалась сильнее. Но в отдельных моральных сценах модели опирались прежде всего на то, насколько велик возможный вред и насколько срочно нужно действовать. Поэтому их оценка могла меняться вместе с обстоятельствами, а не оставаться устойчивой характеристикой самого агента. Раньше такие оценки изучали у людей и искусственных агентов по отдельности; эта работа напрямую сопоставляет человеческие ответы с ответами моделей в правдоподобных сценариях умного города.

Ключевые цифры

190 участниковЭто достаточно, чтобы увидеть общий рисунок ответов, но недостаточно, чтобы автоматически считать его мнением всех людей.
5,65 из 7Так люди оценили моральную способность Энди — заметно выше, чем у трёх искусственных агентов.
2,96–3,35 из 7Такой диапазон получили искусственные агенты по моральной способности: их оценили примерно вдвое ниже человека.
SAE = 22,83Такова суммарная ошибка Llama 8B при сравнении с ответами людей; среди проверенных моделей она ближе всего воспроизвела человеческие оценки.

Можно ли доверять

Это препринт на arXiv, поэтому его ещё не прошла независимая проверка рецензентами. В работе участвовали 190 людей, а модели оценивали заданные текстовые сценарии, а не реальные поступки; кроме того, результаты зависят от конкретных роботов, формулировок и выбранных моделей.

Пересказано ИИ по научной статье. Как это устроено

Источник и детали
ЖурналarXiv (cs.CL)
Дата публикации у нас7 сентября 2026 г.
Дата источника4 сентября 2026 г.
ОригиналОткрыть
АвторыFernanda Mansilla, Aloysius Tok, Bahia Guellaï, Farah Benamara, Nancy F. Chen