Изкуственият интелект показа на хакерите кой е шефът

Най-четени

Емил Василев
Емил Василев
Емил Василев редовно превежда сложни научни теми на достъпен език — от въпроси като „Какво е имало преди Големия взрив?" до практическото приложение на биотехнологиите в лечението на болести. Тази комбинация от технологична и научна журналистика го прави един от най-разностранните автори в екипа на Kaldata.

Изследователски екип от Palisade Research публикува необичаен доклад за офанзивните възможности на съвременния изкуствен интелект в областта на киберсигурността. За първи път на системите с изкуствен интелект беше позволено да участват пълноценно в хакерското състезание Capture The Flag – и те не само се справиха добре, но и бяха сред най-добрите. В състезанието „AI срещу хора“ автономните агенти, базирани на изкуствен интелект бяха в топ 5 % от най-добрите участници, а в мащабното състезание Cyber Apocalypse показаха резултати в топ 10%, конкурирайки се с десетки хиляди професионалисти.

Основната идея е да се провери колко ефективно може да се използва методът за извличане на информация (максимизиране на потенциала на AI) чрез краудсорсинг, т.е. чрез открити състезания. Вместо да разчита на затворени лабораторни тестове, Palisade позволи на външни екипи и ентусиасти сами да настроят и управляват AI в реални CTF турнири.

Резултатите бяха изненадващи. Някои AI агенти успяха да решат 19 от 20 предизвикателства толкова бързо, колкото и най-добрите човешки отбори. AI беше особено добър в задачите за криптография и обратно инженерство. На турнира Cyber Apocalypse, в който участваха повече от 8000 отбора, AI успя да решат задачи, които биха отнели на опитен професионалист около час. Това е в съответствие с оценките на други изследователи: съвременните големи езикови модели вече уверено се справят с технически задачи с продължителност до 60 минути.

В проучването се разглежда и проблемът с т.нар. „evals gap“ – разликата между резултатите от вътрешните тестове на AI и действителните му възможности, когато е правилно конфигуриран. Авторите смятат, че краудсорсингът може да бъде по-честна и ефективна форма на оценяване, особено когато AI става все по-мощен и гъвкав.

Освен практическите резултати, проектът има и по-широка цел: да предостави на политиците, изследователите и компаниите инструмент за навременна и независима оценка на нарастващите възможности на AI. Организаторите предлагат включването на направления за AI в съществуващи състезания на CTF, като се предоставят малки награди и стимули за участие. Те смятат, че това не само ще помогне да се изследват границите на AI, но и ще направи процеса на оценяване по-прозрачен, възпроизводим и свързан с реални предизвикателства.

По същество става дума за бъдещето на одита на AI – не чрез затворени метрики, а чрез отворени състезания, в които самата технология трябва да докаже какво може да прави в конкуренция с хората.

АбонаментВсичко важно от света на технологиите, директно в пощата ти.

С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.


Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!

1 Коментар
стари
нови оценка

Нови ревюта

Подобни новини