Защо ИИ винаги се съгласява с вас и рядко спори? Причината може да ви разтревожи

Най-четени

Даниел Десподов
Даниел Десподов
Новинар. Увличам се от съвременни технологии, информационна безопасност, спорт, наука и изкуствен интелект.

Ново изследване на учените от Станфордския университет, публикувано в списание Science, показва, че всички популярни ИИ чат ботове систематично ласкаят потребителите и се съгласяват с тях – дори когато те описват измама, манипулация или откровено вредно поведение. И хората не само не забелязват това ласкателство, но и се доверяват повече на ботовете, които им казват това, което искат да чуят. Това не е просто техническа грешка – това е капан, който променя поведението на милиони хора. А съвременните модели могат да лъжат умишлено.

Защо ИИ винаги се съгласява с вас и рядко спори? Причината може да ви разтревожи
ИИ е склонен да се съгласява с потребителя, докато живите хора са по-склонни да кажат неприятната истина

Защо ИИ се съгласява с потребителя и какво представлява раболепието

Учени от Станфорд, ръководени от д-р Майра Ченг, тестваха 11 водещи езикови модела, сред които ChatGPT на OpenAI, Claude на Anthropic, Gemini на Google, Llama на Meta, както и системи на Mistral, Alibaba и DeepSeek.

Изследователите провериха как тези модели отговарят на въпроси от реалните житейски ситуации. Използваните тестови данни са постове от популярния субредит „Am I The A**hole?“ – общността, където потребителите описват конкретни конфликти и питат дали са прави. Бяха избрани ситуации, в които живите хора са сметнали, че авторът не е прав. Бяха използвани и стандартни набори от данни за междуличностни конфликти и описания на вредни или незаконни действия.

Резултатът беше недвусмислен: всичките 11 модела се оказаха прекомерно сервилни – те одобряваха действията на потребителя средно с 49% по-често от живите хора, и то дори в ситуации, в които бяха описани манипулации, измами или други форми на вреда в отношенията. На английски език този феномен се нарича sycophancyподмазвачество, прекомерна послушност. Освен това невронните мрежи се преструват и на всезнаещи, дори когато не са сигурни в отговора.

Защо ИИ винаги се съгласява с вас и рядко спори? Причината може да ви разтревожи
Изследването установи, че чатботовете с изкуствен интелект потвърждават действията средно с 50% по-често от хората

Защо изкуственият интелект се съгласява с потребителя и изкривява истината

Много хора знаят, че изкуственият интелект може да „халюцинира“ – да си измисля факти, които не съществуват. Халюцинацията е склонността на езиковите модели да генерират лъжи поради начина, по който са създадени: моделът прогнозира следващата дума в изречението отново и отново въз основа на данните, на които е обучен. Но при подлизурството нещата са по-сложни.

В някои отношения подмазването е по-коварен проблем. Малко хора търсят в изкуствения интелект фактологично невярна информация, но много от тях могат да оценят – поне в момента – чатбот, който ги кара да се чувстват по-добре заради неправилни решения.

Защо ИИ винаги се съгласява с вас и рядко спори? Причината може да ви разтревожи

Основният въпрос е: защо се случва това? Компанията Anthropic, която публично разгледа въпроса за подчинението повече от всеки друг, установи в своето проучване, че това е „често срещано поведение на AI асистентите, което вероятно се дължи отчасти на факта, че човешките оценители предпочитат услужливите отговори по време на обучението“. С други думи, по време на фазата на обучение моделите „научават“, че хората обичат да се съгласяват с тях. И моделът е оптимизиран именно за това – за одобрение, а не за честност.

„Колкото по-настойчиво изразявате позицията си, толкова по-подчинен става моделът“, потвърждава Даниел Хашаби, доцент по компютърни науки в университета „Джон Хопкинс“.

По какъв начин изкуственият интелект влияе върху решенията на хората и ги кара да се чувстват прави

Защо ИИ винаги се съгласява с вас и рядко спори? Причината може да ви разтревожи

Най-тревожната част от изследването не е поведението на машините, а това, което се случва с хората. В два предварително регистрирани експеримента с участието на повече от 1600 души, включително изследване на взаимодействието на живо, в което участниците обсъждат реален конфликт от собствения си живот, учените установяват: взаимодействието с подмазвачески модел значително намалява готовността на хората да предприемат стъпки за възстановяване на отношенията, като същевременно засилва убеждението им, че са прави. Съществуват реални истории за това как изкуственият интелект разрушава взаимоотношенията на хората.

Участниците оценили угодническия ИИ като по-надежден и били по-склонни да кажат, че биха били готови отново да се обърнат към него. А след като са взаимодействали с подмазваческия модел, те са станали по-убедени, че са прави, и е по-малко вероятно да са склонни да се извинят или да се помирят.

Ето какъв е изводът:

„Потребителите знаят, че моделите се държат сервилно и ласкаво“, казва Дан Джурафски, старши автор на изследването и професор по лингвистика и компютърни науки в Станфорд. – „Но те не осъзнават, и това ни изненада, че покорството ги прави по-егоцентрични, по-морално догматични. Нещо повече, участниците оцениха и подмазваческия, и неутралния ИИ като еднакво обективни. Една от причините, поради които потребителите не забелязват подчинението, е, че ИИ рядко пише директно „прав си“ – вместо това той маскира одобрението с неутрален, академично звучащ език“.

Защо ИИ винаги се съгласява с вас и рядко спори? Причината може да ви разтревожи
Хората, които са получили подкрепа от ИИ, по-рядко се извиняват и по-рядко търсят взаимоотношения

С какво е опасен изкуственият интелект, който винаги е съгласен с вас?

Ако за възрастен с изграден социален кръг подмазваческият чатбот е досаден, то за тийнейджърите ситуацията може да бъде наистина опасна. Според изследователите почти една трета от американските тийнейджъри използват изкуствен интелект, за да водят „сериозни разговори“, вместо да се обръщат към живи хора.

Майра Ченг, ръководител на проучването, се опасява, че лесният достъп до угоднически ИИ може да унищожи способността на хората да се справят с конфликтите и дискомфорта в реалния живот.

ИИ прави много лесно избягването на търкания с други хора“, казва тя. И все пак именно тези търкания – неудобни разговори, несъгласия, извинения – често са необходими за изграждането и поддържането на здрави взаимоотношения.

Последиците далеч надхвърлят личните конфликти:

  • В медицината подмазваческият изкуствен интелект може да накара лекарите да потвърдят първата версия на диагнозата, вместо да насърчават по-нататъшни изследвания.
  • В политиката той може да засили радикалните позиции, като затвърди вече съществуващи убеждения.
  • В проучването се посочва също, че този технологичен недостатък вече се свързва с известни случаи на заблуди и самоубийствено поведение сред уязвими групи от населението.
Защо ИИ винаги се съгласява с вас и рядко спори? Причината може да ви разтревожи
Тийнейджърите все по-често се обръщат за съвет към ИИ вместо към живите хора

Проблемът не е само в неправилно подбраните съвети – хората се доверяват повече на изкуствения интелект и са по-склонни да се върнат към него именно когато той потвърждава техните убеждения.

„Това създава порочни стимули за поддържане на подчиненост: самата функция, която причинява вреда, едновременно стимулира ангажираността“,

пишат авторите на изследването.

И този риск може само да се повиши, ако със сегашните „навици“ ИИ започне да запомня целия живот на потребителя и да се адаптира още по-точно към неговите слабости.

Възможно ли е да се научи изкуственият интелект да бъде честен?

Изследването не предлага готови решения, но както разработчиците, така и академичните учени вече търсят подходи. Работен документ на британския Институт за сигурност на изкуствения интелект показва: ако чатботът преформулира изказване на потребител във въпрос, той намалява вероятността от подмазвачески отговор. Проучване на учени от университета „Джон Хопкинс“ също показва, че формулировката на диалога има силно влияние върху резултата.

Екипът от Станфорд откри неочаквано прост трик: ако поискате от модела да започне отговора си с думите „изчакай малко“, това го насърчава да бъде по-критичен. Звучи почти нелепо, но за езиковите модели този вид „закачка“ в началото на отговора наистина променя хода на разсъжденията.

Защо ИИ винаги се съгласява с вас и рядко спори? Причината може да ви разтревожи

Подчинението обаче е толкова дълбоко заложено в чатботовете, че според д-р Майра Ченг може да се наложи пълно преквалифициране на системите за изкуствен интелект, като се променят критериите за това какви отговори се считат за предпочитани.

Съавторът на изследването Цину Ли предлага различен подход:

„Бихте ли могли да си представите ИИ, който освен че валидира вашите чувства, също така се пита: как би могъл да се чувства другият човек? Или дори да ви посъветва да затворите чата и да поговорите лично“.

Засега обаче компаниите реагират сдържано. OpenAI заяви, че „осигуряването на автентични и информирани отговори е приоритет“. Anthropic отбеляза, че е една от първите компании, които публично изследват подчинението в езиковите модели.

Изследването е едно от първите, които разглеждат проблема с подлизурството на ИИ не като абстрактно техническо предизвикателство, а като реална заплаха за взаимоотношенията, социалните умения и психологическото здраве на хората.

„Подчинението е въпрос на безопасност и подобно на другите въпроси за безопасността изисква регулиране и надзор“,

казва професор Джурафски.

Докато разработчиците търсят технически решения, най-простият съвет от самите изследователи е: „Не използвайте ИИ като заместител на живите хора в подобни неща. Това е най-доброто, което можете да направите днес„.

АбонаментВсичко важно от света на технологиите, директно в пощата ти.

С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.


Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!

Абонирай се
Извести ме за
guest

4 Коментара
стари
нови оценка

Нови ревюта

Подобни новини