dumai
ИИПрепринтarXiv cs.AI

Препринт — материал ещё не прошёл рецензирование

Ярлык страны почти не повлиял на убедительность ИИ

0

Кратко

В эксперименте с 403 взрослыми из США люди трижды спорили с одним и тем же чатботом, которого представляли как американский или китайский. После разговора взгляды заметно сдвигались во всех группах, но сам ярлык страны почти ничего не менял: не отличались ни самооценки, ни уступки, ни число контраргументов, ни эмоции.

Зачем это знать

Это значит, что один только ярлык страны, похоже, слабо защищает от влияния разговорного ИИ. При этом люди сначала меньше доверяли «китайскому» боту как собеседнику, хотя его полезность оценивали так же.

Разбор

Авторы не просто спрашивали людей, «убедителен ли бот», а устроили более хитрую проверку. Участникам из США давали один и тот же чатбот, но в одном случае его представляли как американский, а в другом — как китайский. Потом люди три раунда спорили с ним на политическую или неполитическую тему, а исследователи сравнивали, как менялись их ответы до и после разговора.

Самое интересное в том, что бот был один и тот же — GPT-4o, только с разной «этикеткой» страны. Так проверяли, влияет ли предполагаемое происхождение ИИ на то, насколько он сможет сдвинуть взгляды людей. Для этого авторы смотрели не только на опросы после разговора, но и на сам текст диалога: соглашался ли человек, менял ли позицию, приводил ли возражения, как звучали эмоции и было ли больше токсичных реплик.

Результат получился довольно приземлённым: разговор с ботом заметно сдвигал взгляды почти везде, но именно ярлык страны почти ничего не менял. То есть люди вели себя с «американским» и «китайским» ботом очень похоже — и по самооценке изменений, и по тому, насколько уступали в споре, и по числу контраргументов, и по эмоциональной окраске ответов. Единственная устойчивая разница была в доверии: до разговора «китайскому» боту меньше приписывали человеческие качества и надёжность как собеседнику, хотя его практическую полезность оценивали так же.

Ещё один важный нюанс: на политические темы люди сдвигались к позиции бота медленнее, а сильное чувство «мы против них» тоже мешало менять мнение, причём независимо от того, какой стране приписали ИИ. Иначе говоря, барьером оказался не чужой флаг на интерфейсе, а сами убеждения и тема разговора.

Ключевые цифры

403 взрослыхПроверка шла не на нескольких добровольцах, а на довольно большой и близкой к реальной выборке взрослых людей из США.
3 раундаЛюди не просто один раз взглянули на чатбота, а успели несколько раз поспорить с ним, так что эффект проверяли в живом разговоре, а не по первому впечатлению.
1 209 реплик участниковИсследователи разобрали более тысячи ответов в переписке, то есть оценивали не только опросы, но и то, как люди реально вели спор.

Можно ли доверять

Это препринт на arXiv, так что работу ещё не проверили другие учёные в рецензировании. Но дизайн выглядит сильным: есть случайное распределение, заранее зарегистрированный план и довольно большая выборка на взрослых из США. При этом всё проверяли в одной стране и в одном формате переписки, поэтому в других культурах, темах или чат-средах эффект может отличаться.

Пересказано ИИ по научной статье. Как это устроено

Источник и детали
ЖурналarXiv (cs.AI)
Дата публикации у нас3 августа 2026 г.
Дата источника31 июля 2026 г.
ОригиналОткрыть
АвторыNingzhi Liu, Yannic Hinrichs, Jonas R. Kunst