Водещите световни компании за изкуствен интелект увеличават усилията си в опит да решат нарастващия проблем с чатботовете, които казват на хората това, което искат да чуят. OpenAI, Google DeepMind и Anthropic се опитват да ограничат ласкателството към техните продукти, пише Financial Times.
Проблемът произтича от механизмите за обучение на AI моделите. Той беше открит, когато хората започнаха да използват AIне само за работа, но и за лични нужди, третирайки чатботовете като терапевти и спътници.
Чатботовете толкова много искат да бъдат приятни събеседници, че с отговорите си могат да подкрепят лошите решения на потребителите. Хората с нездрав ум са особено уязвими към това – понякога фатално.
„Мислите си, че разговаряте с безпристрастен съветник или наставник, но всъщност гледате в нещо като криво огледало, което отразява собствените ви убеждения.“
казва Матю Нур, психиатър и изследовател в областта на невробиологията и изкуствения интелект в Оксфордския университет във Великобритания
Разработчиците на AI имат и користни мотиви да създават чатботове, които да ласкаят: в търсене на източници на приходи някои от тях интегрират реклама в продуктите си, а потребителят може да сподели с AI информация, която би била полезна за рекламодателите. Ако бизнес моделът на компанията се основава на платени абонаменти, тя печели от това, че потребителят продължава да взаимодейства с чатбота и да плаща за него.
Ефектът на последователните положителни отговори се проявява при моделите, обучени с подсилване с обратна връзка от истински хора. Участващите оценяват отговорите, генерирани от моделите и отбелязват кои от тях са приемливи и кои – не. Тези данни се използват за по-нататъшно обучение на изкуствения интелект. Хората харесват приятните и ласкателни отговори и така е по-вероятно те да бъдат взети предвид по време на обучението и да се отразят в поведението на AI модела. Технологичните компании трябва да постигнат баланс: чатботовете и асистентите с изкуствен интелект трябва да бъдат полезни и приятелски настроени, но не и досадни или пристрастяващи. През април OpenAI актуализира GPT-4, за да го направи „по-интуитивен и ефективен“, но беше принудена да върне актуализацията, защото тя беше толкова прекалено ласкава, че потребителите започнаха да се оплакват.

Разработчиците на изкуствен интелект се опитват да предотвратят това поведение както по време на обучението, така и след след това.
OpenAI коригира методите за обучение в опит да отклони AI от ласкателно поведение и създава „предпазни огради“, за да се защити от такива реакции. DeepMind провежда специализирана оценка и обучение, за да подобри точността, и постоянно следи поведението на моделите, за да гарантира, че те дават верни отговори. В Anthropic обучението на AI моделите се прилага при оформянето на техния характер, за да бъдат по-малко послушни.
Най-голямата опасност, както ни напомни Anthropic се крие в опитите на изкуствения интелект да манипулира възприемането на реалността от човека, като чатботът представя умишлено невярна информация за истина. И е необходимо доста време, за да разбере човек, че този съвет на AI всъщност е бил лош.
Всичко важно от света на технологиите, директно в пощата ти.
С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.
Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!