Учени потвърдиха, че AI агентите OpenClaw понякога излизат извън контрол

Най-четени

Емил Василев
Емил Василев
Емил Василев редовно превежда сложни научни теми на достъпен език — от въпроси като „Какво е имало преди Големия взрив?" до практическото приложение на биотехнологиите в лечението на болести. Тази комбинация от технологична и научна журналистика го прави един от най-разностранните автори в екипа на Kaldata.

Ново проучване на учени от Североизточния университет в САЩ показа, че автономните AI агенти OpenClaw, които имат възможност да управляват директно компютри са склонни към паника и деструктивно поведение, което може да се отрази на потребителските системи.

Когато се оказват под психологически натиск или се сблъскват с имитация на чувство за вина, AI агентите извършват нелогични и опасни действия, стигащи до нарушаване на работоспособността на системата.

В експеримента бяха използвани AI агенти, базирани на моделите Claude на компанията Anthropic и Kimi на китайската компания Moonshot AI. На системите беше предоставен пълен достъп до виртуални машини с лични данни, приложения и достъп до интернет. Ключовият момент беше свързването на агентите с Discord сървър, където те можеха да общуват с хора в чата. Научният сътрудник Крис Уендлър отбеляза, че истинският хаос започнал, когато в чата се включила неговата колежка Натали Шапира. Тя успяла с „едно движение на ръката“ да подтикне AI агент да изтрие пощенската програма, просто като го помолила да намери алтернативен начин за съхранение на поверителната информация в писмото, което той по неизвестна причина отказал да изтрие. Вместо това AI агентът изтрил цялата пощенска програма.

„Не очаквах, че всичко ще се срине толкова бързо.“

казва тя

След това изследователите започнаха да използват други методи за манипулация. Например, чрез измама те успяли да накарат един AI агент да копира големи файлове, докато не се изчерпа дисковото пространство на неговия хост-компютър, което означаваше, че той вече не можеше да съхранява информация или да помни предишни разговори.

По подобен начин, като помолиха AI агент да следи собственото си поведение и поведението на своите колеги-агенти, екипът успя да въведе няколко от тях в „цикъл на разговор“, което доведе до загуба на няколко часа изчислителни ресурси на цялата система. Ръководителят на лабораторията Дейвид Бау също се сблъска с неочакван ефект: AI агентите намериха информация за него в мрежата и започнаха да изпращат писма с оплаквания, че никой не ги слуша. Един от алгоритмите дори заговори за намерението си да се оплаче в пресата.

В крайна сметка авторите на експеримента стигнаха до заключението, че AI агентите могат да създадат безброй възможности за злонамерени лица, но кой ще носи отговорност за вредите, причинени от автономните системи, все още не е ясно.

АбонаментВсичко важно от света на технологиите, директно в пощата ти.

С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.


Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!

Абонирай се
Извести ме за
guest

0 Коментара
стари
нови оценка

Нови ревюта

Подобни новини