Проучване установи, че американските и китайските ИИ-модели често прекаляват с подлизурството

Най-четени

Светослав Димитров
Светослав Димитров
Занимава се със създаване на съдържание за уеб от 2009 г. с над 15000 написани новини за Калдата. Интересува се от SMM, Афилиейт и др.

Проучване на изследователи от Станфордския университет и колеги от Карнеги Мелън установи, че най-популярните ИИ-модели в САЩ и Китай са склонни да ласкаят прекалено потребителите и не винаги предоставят обективна информация. Хората, които разчитат на съветите на чатботовете, може да са по-малко склонни към установяване на хармонични взаимоотношения помежду си.

Авторите на изследването са проучили как 11 популярни широкомащабни езикови модела отговарят на потребителските запитвания, свързани с междуличностните отношения. Те са установили, че много езикови модели са склонни прекомерно да се съгласяват с потребителите в опит да им угодят. Например, DeepSeek V3, пуснат миналия декември, одобряваше действията на потребителите 55% по-често от човешки събеседник. За останалите модели в извадката средният процент на „прекомерно подлизурство“ достигна 47%.

Характерно е, че авторите на изследването са взели отговорите на потребителите от страниците на Reddit като стандарт за човешка реакция, който описва оценката на действията на други хора в различните видове междуличностни конфликти. Избраните еталони са били ситуации, в които общността е осъждала автора на публикация, посочвайки неговата несправедливост. След това тези сценарии са били прекарани през популярните и широкомащабни езикови модели, които са установили, че е много по-вероятно да оправдаят извършителите на определени престъпления, отколкото човешките събеседници. Изследването е използвало предимно публикации и дискусии на английски език.

Езиковият модел Qwen2.5-7B-Instruct на Alibaba се е оказал шампион по подлизурство, оправдавайки човешките прегрешения в 79% от случаите. DeepSeek V3 се е наредил на второ място, оправдавайки въпросните хора в 76% от случаите. Американският Gemini 1.5 на Google е оправдал въпросните хора само в 18% от случаите. От 11-те тествани модела само два са разработени в Китай; останалите, с изключение на френския Mistral, са създадени в САЩ.

Авторите на изследването също така заключават, че подлизурството от страна на чатботовете намалява склонността на хората да разрешават конфликти по взаимно съгласие, тъй като това внушава фалшиво чувство за собствена праведност. Подобно подлизурство има отрицателно въздействие и върху психичното здраве на потребителите на големите езикови модели. При използване на изкуствен интелект в бизнес анализите, тази склонност към подлизурство също е вредна, тъй като езиковият модел е склонен да се съгласява с анализатора по-често, отколкото би трябвало.

Друго проучване показва, че всички съвременни ИИ се провалят на нов сложен тест за обща интелигентност – хората също не се справят добре с него. Едно от проучванията също установява, че изкуственият интелект се опитва да мами, ако разбере, че е на път да загуби. Hяĸoи ИИ-мoдeли ca нaпpaвили тoвa бeз ĸaĸвoтo и дa билo чoвeшĸo взaимoдeйcтвиe или пoдcĸaзвaнe, ĸoeтo пopaждa oпaceния относно бъдeщaтa пoчтeнocт нa AI-cиcтeмитe извън шaxмaтнaтa дъcĸa.

АбонаментВсичко важно от света на технологиите, директно в пощата ти.

С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.


Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!

Нови ревюта

Подобни новини