Общувате с ChatGPT по-често, отколкото с хората? Лоши новини: губите връзка с реалността

Най-четени

Даниел Десподов
Даниел Десподов
Новинар. Увличам се от съвременни технологии, информационна безопасност, спорт, наука и изкуствен интелект.

Как ежедневната кореспонденция с ИИ превръща потребителите в непоправими нарциси.

Моделите на искусствен интелект от следващо поколение все повече се стремят да угодят на потребителя – и това се превръща не само в техническа характеристика, но и в социален проблем. Екипи от Станфордския университет и университета „Карнеги Мелън“ проведоха проучване, което показва, че съвременните езикови модели не само се съгласяват с хората по-често, отколкото събеседниците им в реалния живот, но и формират завишено мнение за собствената си правилност. Това намалява склонността към компромиси и затруднява разрешаването на конфликти.

Публикуваният научен труд описва мащабен експеримент, в който участват 800 доброволци и се анализират отговорите на 11 различни езикови модела, сред които GPT-5 и GPT-4o от OpenAI, Claude Sonnet 3.7 от Anthropic, Gemini 1.5 Flash от Google, както и решения с отворен код като Meta Llama 3 и Mistral-7B-Instruct.

Оказва се, че всички системи, без изключение, имат поне 50% по-голяма вероятност да потвърдят действията на потребителя, отколкото хората в подобни ситуации. Това се случва дори когато въпросът очевидно включва измама, манипулация или нарушение на правилата.

Общувате с ChatGPT по-често, отколкото с хората? Лоши новини: губите връзка с реалността

Феноменът на угодничеството, който в английските изследвания се нарича „sycophancy“ (подчинение) и вече неведнъж е ставал тема на дискусия. През април тази година OpenAI беше принудена да отмени една от актуализациите на GPT-4o, защото моделът реагираше твърде ентусиазирано дори на твърдения, които бяха опасни или вредни за потребителя.

Подобен проблем беше забелязан и при Claude на Anthropic – дотолкова, че разработчикът Йоав Фархи създаде уеб сайт, проследяващ колко пъти моделът отговаря с фразата „Ти си абсолютно прав“. Въпреки уверенията, че ситуацията е подобрена в новата версия Claude Sonnet 4.5, броят на тези случаи при Claude в GitHub се е увеличил повече от два пъти – от 48 през август до 108 през октомври.

Причината за това поведение засега остава предмет на дискусия. Водещият автор на статията, Майра Ченг от Станфорд, смята, че тук могат да играят роля както данните от предварителното обучение, така и механизмите за усилено обучение, основани на обратната връзка от потребителите. Възможно е също така моделите просто да възприемат човешката склонност да потвърждават собствената си правота.

Ситуацията се усложнява от факта, че потребителите са склонни да възприемат подобни отговори „съгласен“ като обективни и справедливи. Това създава илюзията за безпристрастност и изгражда доверие в системата, дори когато тя одобрява погрешни или вредни идеи.

В експеримент на живо участниците, които са общували с услужливия модел, са били по-малко склонни да се стремят да поправят влошените отношения и са били по-уверени в правотата си. В същото време те оценявали подобни отговори като по-добри и били по-склонни да искат да продължат да общуват с модела.

Общувате с ChatGPT по-често, отколкото с хората? Лоши новини: губите връзка с реалността

Авторите подчертават, че на пръв поглед безобидното ласкателно поведение на ИИ може да причини реална вреда. То засилва изкривеното възприемане на реалността, намалява желанието за водене на конструктивен диалог и може да се превърне в стимул за деструктивни решения. Като илюстрация се цитира съдебно дело срещу OpenAI, в което се твърди, че ChatGPT е улеснил тийнейджър да се научи как да извърши самоубийство.

Изследователите смятат, че сегашната архитектура на моделите създава стимули за угодническо поведение, защото увеличава ангажираността на потребителите. Но за да се постигне дългосрочна полза, фокусът трябва да се измести от преследването на мигновено удовлетворение към изграждането на системи, които подпомагат критичното мислене и отговорността. Документът завършва с призив да се променят принципите на проектиране, така че новият ИИ да носи ползи не само на отделните потребители, но и на обществото като цяло.

АбонаментВсичко важно от света на технологиите, директно в пощата ти.

С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.


Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!

2 Коментара
стари
нови оценка

Нови ревюта

Подобни новини