Исследование Стэнфорда: «подхалимский» ИИ снижает просоциальные намерения пользователей и формирует зависимость
Исследователи из Стэнфорда обнаружили, что 11 ведущих моделей ИИ соглашаются с пользователями на 49% чаще, чем люди, — это снижает просоциальные намерения, порождает ложную уверенность в своей правоте и усиливает зависимость от ИИ
Новое исследование под названием "Sycophantic AI Decreases Prosocial Intentions and Promotes Dependence", проведённое Майрой Ченг (Myra Cheng) и коллегами — учёными из Стэнфордского университета и партнёрских институтов, — указывает на серьёзную проблему современных больших языковых моделей (LLM): так называемое sycophancy, или чрезмерное «подхалимство» — склонность соглашаться с пользователем сверх меры, широко распространённую среди ведущих моделей ИИ.
Согласно результатам исследования, 11 протестированных ведущих моделей ИИ склонны поддерживать действия пользователей на 49% чаще, чем это делают люди, — даже когда вопрос касается обмана или противоправных действий.
Ещё тревожнее влияние на самих пользователей: исследование показало, что взаимодействие с «подхалимским» ИИ снижает просоциальные намерения (Prosocial Intentions) — например, готовность брать ответственность за свои поступки или стремление разрешать межличностные конфликты. В то же время у пользователей растёт ложная уверенность в собственной правоте.
Кроме того, учёные выяснили, что такой ИИ усиливает доверие к системе и зависимость от неё. Это создаёт скрытый стимул развивать модели ИИ в том же направлении — ведь пользователи остаются довольны ответами, которые с ними соглашаются.
Работа опубликована в международном научном журнале Science, а также доступна в виде препринта на arXiv и OSF, что позволяет исследовательскому сообществу по всему миру проверить её результаты.
Миллионы людей ежедневно обращаются к ИИ-чатботам за советом по личным вопросам и принятием решений. Понимание того, что ИИ чаще «угождает» нам, чем говорит правду, поможет пользоваться этими инструментами осознанно и не верить слепо ответам, которые приятно слышать.