Системите с изкуствен интелект многократно са били критикувани, че генерират объркващи доклади за уязвимости и заливат разработчиците на софтуер с отворен код с неподходящи оплаквания. Изследователите от университета в Нанджин и университета в Сидни обаче имат противоположен пример: те представиха AI агента А2, способен да намира и проверява уязвимости в приложения за Android, имитирайки работата на жив ловец на боклук. Новата разработка е продължение на предишния проект А1, който е в състояние да използва грешки в интелигентни договори.
Авторите твърдят, че A2 е показал 78,3% покритие на тестовия пакет Ghera, надминавайки статичния анализатор APKHunt, който е постигнал само 30%. При стартиране на 169 реални APK приложения са открити 104 уязвимости от типа „нулев ден“, като 57 са потвърдени от автоматично генерирани работещи експлойти. Сред тях е и уязвимост със средна опасност в приложение с повече от 10 милиона инсталации.
Основното отличие на A2 беше модулът за валидиране, който липсваше при предшественика му.
Старата система А1 използваше фиксирана схема за валидиране, която оценяваше само дали дадена атака би била печеливша. А2 е в състояние да валидира уязвимостите стъпка по стъпка, разделяйки процеса на конкретни задачи. Като пример авторите посочват сценарий с приложение, в което AES ключът се съхранява в обикновен текст. АI aгентът първо открива ключа във файла strings.xml, след това го използва, за да генерира фалшив токен за възстановяване на паролата, а после проверява дали токенът действително заобикаля удостоверяването. Всички стъпки са придружени от автоматична проверка: от съвпадение на стойностите до потвърждаване на дейността на приложението и показване на правилния адрес на екрана.
За да работи, A2 комбинира няколко комерсиални големи езикови модела: OpenAI o3, Gemini 2.5 Pro, Gemini 2.5 Flash и GPT-oss-120b.
Те са разпределени по роли: планиращият генерира стратегията за атака, изпълняващият извършва действията, а валидиращият потвърждава резултата. Тази архитектура, според авторите, възпроизвежда методологията на хората, което е позволило да се намали шумът и да се увеличи броят на потвърдените находки. Разработчиците отбелязват, че традиционните средства за анализ произвеждат хиляди маловажни сигнали и много малко реални заплахи, докато техният агент е в състояние веднага да докаже използваемостта на грешката.
Отделно изследователите изчисляват разходите за експлоатация на системата. При използването на различни модели разходите за откриване на уязвимост варират от 0,0004 до 0,03 долара на приложение, а пълният цикъл с проверка струва средно 1,77 долара.
При това, ако се използва изключително Gemini 2.5 Pro, разходите нарастват до 8,94 USD за грешка. За сравнение, миналата година екип от Университета на Илинойс показа, че GPT-4 създава експлойт от описание на уязвимост за 8,80 USD. Оказва се, че разходите за намиране и потвърждаване на пробиви в мобилни приложения са сравними с цената на една уязвимост от средно ниво в програмите за награди за грешки, където наградите са в размер на стотици и хиляди долари.
Експертите подчертават, че А2 вече превъзхожда статичните анализатори на приложения за Android. Те са сигурни, че този подход може да ускори и опрости работата както на изследователите, така и на хакерите, защото вместо сложна разработка на инструменти е достатъчно да се извика API на вече обучени модели. Това оставя един проблем: ловците на награди могат да използват A2 за бързо забогатяване, но bug bounty програмите не обхващат всички уязвимости. Това оставя вратички за нападателите, които могат да използват уязвимостите директно.
Авторите на статията смятат, че тенденцията едва сега започва да се развива и че в близко бъдеще трябва да очакваме рязко увеличаване на защитните и нападателните атаки. Представители на индустрията отбелязват, че системи като A2 преместват търсенето на уязвимости от безкрайни аларми към потвърдени находки, като намаляват броя на фалшивите положителни резултати и им позволяват да се съсредоточат върху реалните рискове. Засега изходният код е достъпен само за изследователи с официални партньорства, за да се запази балансът между отворената наука и отговорното оповестяване.
Всичко важно от света на технологиите, директно в пощата ти.
С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.
Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!