ИИ DeepMind на Google бе обучен да се държи крайно агресивно при стресови ситуации

Изкуственият интелект DeepMind на Google вече демонстрира възможността си за самообучение, независимо от това, което е заложено в неговата памет и победи най-добрите играчи на Го в света. След това DeepMind се научи да чете по устните на хората и дори да имитира човешки глас.

Сега DeepMind бе обучен на нещо ново. Новите тестове показаха, че когато ИИ „усеща“, че може да загуби, за да избегне загубата започва да подбира нови и „крайно агресивни“ стратегии. Специалистите на Google са направили над 40 милиона сесии с опростената компютърна игра Gathering, в която е необходимо да бъдат събрани колкото е възможно повече плодове. На виртуалната арена се сражават два ИИ, които трябва да съберат възможно най-много виртуални ябълки – зелени квадратчета.

Докато изкуствените интелекти без проблеми събират големия брой плодове, всичко върви гладко. Но с привършването на ябълките, поведението започва да става агресивно. ИИ започват активно да използват лазерния лъч, за да оставят противника извън виртуалния екран и самостоятелно да съберат всички плодове.

При използване на DeepMind от по-ниско ниво, събраните ябълки са с еднакъв брой. Но при по-сложните модели на ИИ постепенно се появява агресивно поведение, алчност и по-добра адаптация към различните условия. Агресивната тактика за победа е затвърдена от Google, понеже по този начин ИИ се обучава по-ефективно и още по-добре се адаптира към променливите условия на околната среда.

След обучението в DeepMind, три ИИ са били накарани да играят Wolfpack: двата изкуствени интелекта са играли ролята на вълците, а третият – ролята на плячката. За разлика от Gathering, в новата игра се налага извършването на съвместни действия за опазване на плячката и постигане на обща победа.

От играта Gathering ИИ DeepMind усвои, че агресията и егоизмът са най-ефективните стратегии в някои среди. А от Wolfpack същият ИИ разбра, че в други случаи единствено съвместните действия могат да донесат по-ценна награда. Тестовите среди са съвсем опростени, но основната идея е ясна: различните изкуствени интелекти в конкурентна среда могат да стигнат до война, ако нямат обща цел.

Това е важно например при светофарите, управлявани от ИИ, при безпилотните автомобили, които трябва да изберат най-подходящия маршрут. Всеки ИИ би трябвало да изпълнява задачите си по такъв начин, че да е най-полезен за обществото. Основите на тази идея навярно е по-добре да бъдат заложени още сега.

АбонаментВсичко важно от света на технологиите, директно в пощата ти.

С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.


Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!

1 Коментар
стари
нови оценка