Препринт — материал ещё не прошёл рецензирование
Выпуск модели меняет отношение к чат-боту: от одобрения до восстановления после недовольства
Кратко
Авторы изучили многолетние обсуждения разговорных ИИ в Reddit и сравнили реакцию на выпуски разных компаний. У одних компаний преобладало устойчивое одобрение, у других сначала возникало недовольство, а затем оно сменялось восстановлением; на отношение влияли доступность, надёжность, политика компании и общественные споры. Это предварительный анализ: он основан на автоматической обработке обсуждений Reddit.
Зачем это знать
Выпуск ИИ — не только техническое обновление, но и событие, которое меняет ожидания и общественный разговор. Однако реакции участников Reddit не обязательно отражают мнение всех пользователей.
Разбор
Авторы не просто подсчитали общий тон обсуждений. Сначала специальная языковая модель находила в постах упоминания конкретных систем и приводила разные названия к единому виду. Затем для каждого поста определяли настроение и темы — например, разговоры о надёжности, доступе или доверии. После этого сравнивали обсуждения в окне до и после выхода новой версии, чтобы увидеть именно сдвиг, а не среднюю оценку за всё время.
Такой подход нужен потому, что разговорный ИИ постоянно меняется: обновляется сама модель, появляются новые функции, меняются правила доступа и меры безопасности. Если измерить мнение пользователей только один раз, можно не заметить, как выпуск сначала вызывает раздражение, а затем — привыкание или одобрение. Анализ показал, что важна не только техническая сторона обновления: люди оценивают, могут ли они пользоваться новой версией, осталась ли доступной привычная система, справляется ли сервис с нагрузкой и понятно ли, зачем им переходить на новинку.
Отдельно видно, что у разных компаний одна и та же схема не работает одинаково. Для Anthropic обсуждения особенно часто связывались с удачным сочетанием продукта и практического применения Claude Code. Вокруг OpenAI авторы увидели не просто реакцию на качество модели, а последовательность «недовольство — восстановление» после выпусков GPT-5 и GPT-5.1. В случае Grok-3 разговор о модели тесно переплетался с образом компании и политическими спорами, а обсуждение DeepSeek-R1 одновременно включало похвалу инженерным решениям и тревогу из-за цензуры, доступа и сбоев. Из этого авторы предлагают оценивать выпуск как процесс: заранее готовить инфраструктуру, не обещать больше, чем доступно пользователю, по возможности сохранять старую версию и следить за реакцией после запуска.
Ключевые цифры
Можно ли доверять
Это препринт с arXiv, поэтому его ещё не прошла независимая проверка рецензентами. Масштаб анализа большой, но выводы основаны на Reddit и на автоматической классификации текста: такая выборка может не отражать всех пользователей, а ошибки алгоритма способны повлиять на найденные связи.
Пересказано ИИ по научной статье. Как это устроено