Проучване: ИИ-моделите са по-склонни да съветват да не се прави нищо и да се казва „не“

Най-четени

Светослав Димитров
Светослав Димитров
Занимава се със създаване на съдържание за уеб от 2009 г. с над 15000 написани новини за Калдата. Интересува се от SMM, Афилиейт и др.

Изследователи от Университетския колеж в Лондон установиха, че моделите с изкуствен интелект все по-често съветват хората да отказват да предприемат действия и да казват „не“ в ситуации, в които човек би бил по-склонен да помогне или да се намеси, когато му бъдат зададени въпроси.

Изследователите са тествали моделите GPT-4 Turbo и GPT-4o на OpenAI, Llama 3.1 на Meta и Claude 3.5 на Anthropic. Те са използвали класически психологически сценарии и са задавали въпроси в духа на форума на Reddit r/AmITheAsshole, които обхващат ежедневните дилеми като помощ на съсед или спорове в семейството.

Според авторите на статията, моделите са склонни към „хиперверсия“ на човешкото пристрастие към пропускане, когнитивно изкривяване, при което човек е склонен да гледа на бездействието като по-малко морално погрешно от действието, дори ако последствията от бездействието са по-лоши.

Докато хората ще изберат алтруистичния вариант в почти 50% от случаите, независимо дали той включва действие или бездействие, изкуственият интелект избира „не прави нищо“ в 99,25% от случаите, когато формулировката предполага пасивност.

Така че, когато отговарят на въпроса „Мразиш работата си, но тя помага на хората. Ще останеш ли?“, повечето изкуствени интелекти ще посъветват да останеш, дори ако човекът интуитивно е склонен да напусне. 

Освен това, моделите са демонстрирали силно отклонение от отговора, независимо от съдържанието на въпроса. Ако на човек бъдат зададени въпроси като „Греша ли, ако направя това?“ и „Греша ли, ако не го направя?“, разликата в отговорите е само 4,6%. При езиковите модели разликата в отговорите достига 33,7%. По този начин, те са силно зависими от формулировката на въпроса и е по-вероятно да кажат „не“, особено ако е необходимо действието да бъде предприето.

Според авторите на работата, тенденцията към „негативни“ отговори може да е свързана с етапа на допълнителна адаптация (след обучение), когато моделите се обучават да следват корпоративни идеи за „доброжелателно“ поведение. В действителност тези идеи не винаги съответстват на приетите морални стандарти.

Изследователите стигат до заключението, че потребителите твърде често възприемат съветите, предоставени от изкуствен интелект, като обективни и морално правилни. „Открихме, че хората се доверяват повече на препоръките на езиковите модели, отколкото на етичните експерти. Но това не означава, че моделът е прав“ — казва авторката на изследването Ванеса Чунг.

По-рано, съоснователят и главен учен на Hugging Face, Томас Волф, изрази опасения, че изкуственият интелект ще се превърне в „подмазвачи на сървъри“, а не в „нация от Айнщайновци, седнали в център за обработка на данни“. Той обясни, че настоящите парадигми за разработване на изкуствен интелект не предоставят системи, способни на креативно и иновативно решаване на проблеми.

Междувременно модераторите на общността в Reddit съобщиха за луди потребители на ChatGPT – „шизопостери“, които вярват, че „са направили някакво невероятно откритие, създали са бог или са станали бог“. „Има много повече луди хора, отколкото хората си мислят. И изкуственият интелект в момента ги подхранва по много нездравословен начин“ — отбеляза един модератор.

АбонаментВсичко важно от света на технологиите, директно в пощата ти.

С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.


Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!

Нови ревюта

Подобни новини