Препринт — материал ещё не прошёл рецензирование
ИИ, который учитывает мнение собеседника, кажется убедительнее
Кратко
В тестах с моральными советами люди чаще выбирали ответы, которые вежливо учитывали позицию собеседника, хотя итоговый совет оставался тем же. Такие ответы вызывали большую готовность прислушаться и обратиться за советом; тот же эффект сохранялся, когда участники считали исходную позицию ошибочной.
Зачем это знать
Оценки ИИ могут принимать полезную вежливость за неуместное согласие с пользователем. Пока работа измеряла оценки и заявленную готовность слушать, а не реальные поступки.
Разбор
Авторы разбирают проблему в самих критериях оценки ИИ. Вежливый ответ может показать, что система поняла позицию собеседника и умеет говорить с ним без конфликта, но тот же признак легко принять за угодничество — готовность соглашаться с пользователем вопреки собственному выводу. Чтобы разделить эти вещи, исследователи брали уже написанные ответы на моральные вопросы и переписывали их: добавляли признание позиции собеседника, но оставляли неизменным итоговое суждение. Затем участники сравнивали исходную и обновлённую версии.
Ключевые цифры
Можно ли доверять
Это препринт с arXiv, а не статья, прошедшая рецензирование. Эксперимент сравнивает ответы с одинаковым содержательным выводом, что хорошо изолирует влияние стиля, но измеряет впечатления и заявленное намерение слушать, а не реальные действия; размер и состав выборки в представленном абстракте не указаны.
Пересказано ИИ по научной статье. Как это устроено