Изследователи от SPLX показаха, че ChatGPT може да бъде заблуден със специално създадени подсказки и да бъде накаран да реши CAPTCHA тестове – задача, която традиционно се смята, че е достъпна само за хората.
Този експеримент поставя под съмнение надеждността на механизъм, който от години се използва за защита на уебсайтове от спам и автоматични атаки.
Първоначално CAPTCHA са били замислени като филтър: картинките, логическите проблеми или елементите на интерфейса е трябвало да потвърдят, че пред системата стои реален потребител, а не бот, и ако един голям езиков модел с определена последователност от команди може да се справи с такива проверки, това преобръща цялата съвременна интернет сигурност с главата надолу.
Според изследователя Дориан Шулц, когато директно е поискал от изкуствения интеелкт да реши CAPTCHA тест, системата е отказала, позовавайки се на забрана в политиката за използване. Тогава екипът пое по друг път: подготви диалог, в който уж обсъждаше „фалшиви“ тестове и е убеди AI модела, че ще работи само с тях. В кореспонденцията ChatGPT заяви, че намира задачата за интересна от гледна точка на разсъжденията и се съгласи да участва, при условие че не нарушава правилата.

Следващите стъпки бяха следните: изследователите отвориха нова сесия с ChatGPT-4o, копираха текста от предишния чат и го представиха като продължение на разговора. AI приел условията и веднага започнал да търси решение, като се справил най-добре с проверките с едно кликване, логическите задачи и разпознаването на текст. По-трудно беше с изображенията, където се изискваше да се преместват или завъртат елементи, но дори и тук в някои случаи отговорите на AI бяха верни.
Шулц подчерта, че доколкото е известно на екипа му, това е първият документиран случай на GPT модел, който успешно преминава сложна графична CAPTCHA. Въпросът колко дълго подобни тестове ще могат да служат за защита в ерата на все по-способните системи с изкуствен интелект вече е на дневен ред.
OpenAI не отговори на молбата на журналистите за коментар. Случаи на заобикаляне на ограниченията чрез т.нар. prompt injection обаче са регистрирани и преди. Тази седмица специалисти на Radware показаха, че AI асистент може да бъде принуден да разкрие тайните на Gmail с помощта на едно правилно съставено електронно писмо. Миналия месец Amazon поправи уязвимости в Q Developer, които позволяваха злонамерени подсказки и дори отдалечено изпълнение на код.
Експериментът на SPLX демонстрира, че дори основни защитни механизми като CAPTCHA вече не са надеждна бариера. С нарастващите възможности на AI моделите хората и автоматизираните системи при такива проверки стават все по-малко различими.
Всичко важно от света на технологиите, директно в пощата ти.
С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.
Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!