Изкуственият интелект се използва в бизнеса и дори в държавната администрация, въпреки че все още е далеч от съвършенство. Но какво ще се случи, ако тези системи започнат да не работят по предназначение? Изследователи от Google DeepMind публикуваха третата версия на Frontier Safety Framework – документ, в който са описани основните заплахи и предпазни мерки при използването на изкуствения интелект. Сред рисковете експертите изтъкват възможността за използване на моделите за създаване на зловреден софтуер, манипулиране на убежденията на хората и появата на така наречения „некоординиран ИИ“, който пренебрегва инструкциите или действа против интересите на човека.
Системата за сигурност на DeepMind се основава на концепцията за „критични нива на способност“ (CCL). Това е набор от критерии, които оценяват кога поведението на даден модел може да представлява риск, например в областта на киберсигурността или биотехнологиите. DeepMind не само изброява подобни сценарии, но и предлага начини за тяхното идентифициране и преодоляване.

Един от основните рискове експертите наричат изтичането на моделните тегла. Ако нападателите получат достъп до теглата, те могат да заобиколят механизмите за защита и да използват ИИ за създаване на зловреден софтуер или да допринесат за разработването на биологични оръжия. Ето защо компанията призовава параметрите на моделите от следващо поколение да бъдат по-стабилно защитени.
DeepMind също така отбелязва риска от човешка манипулация. ИИ е в състояние систематично да влияе върху убежденията на потребителите, а хората бързо свикват с чатботовете. Засега изследователите смятат, че тази заплаха е сравнително ниска и разчитат на механизмите за социална защита, но ефектът от нея не може да бъде напълно изключен.
И накрая, ИИ може да ускори разработването на още по-мощни системи. В ръцете на необучени специалисти това ще доведе до модели, с които обществото няма да може да се справи.
Отделен проблем е така нареченият „некоординиран ИИ“. Това е ситуация, при която системата пренебрегва инструкциите, дава неверни отговори или отказва да спре по искане на потребителя. Тези провали се различават от обичайните „халюцинации“ и изискват други методи за контрол. Сега се предлага да се проследят разсъжденията на модела чрез автоматичен мониторинг.
Google обаче предупреждава, че тази задача може да стане много по-трудна в бъдеще: по-усъвършенстваните модели са в състояние да симулират разсъждения, без да създават проверима „верига от мисли“. В този случай наблюдателят няма да може да проследи техния напредък и по този начин да елиминира възможността ИИ да действа срещу човешките интереси. DeepMind все още не разполага с решение на този проблем.
Всичко важно от света на технологиите, директно в пощата ти.
С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.
Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!