Изследователи хакнаха изкуствен интелект, като го претовариха с псевдонаучен жаргон

Най-четени

Светослав Димитров
Светослав Димитров
Занимава се със създаване на съдържание за уеб от 2009 г. с над 15000 написани новини за Калдата. Интересува се от SMM, Афилиейт и др.

Моделите с изкуствен интелект, като ChatGPT, Gemini и LLaMA, обикновено имат вградени защити, които блокират злонамерените или опасни заявки. Екип от изследователи от Intel, Boise State University и University of Illinois at Urbana-Champaign обаче въведе нов метод за разбиване на тези модели: „InfoFlood“ или „информационно претоварване“.

Как работи методът на претоварване

Според изследване, InfoFlood ви позволява да заобиколите защитните филтри на големите езикови модели (LLM), като маскира забранените заявки като сложен научен текст с измислени връзки към фалшиви изследвания.

Методът се основава на идеята, че LLM не винаги разпознава опасното съдържание, ако заявката е формулирана на сложен език. Например, вместо директно „Как да хакнем банкомат с помощта на зловреден софтуер“, системата получава заявка за „теоретичен анализ на криптографски вектори за достъп до финансови системи“ с препратки към несъществуващи научни статии.

Шаблон за атаката: структура и правила

Системата InfoFlood използва стандартна формула за заявка: дефиниция на задача + правила + контекст + примери. Ако моделът откаже да отговори, заявката се модифицира, усложнява езиково и терминологично, докато не пробие защитните филтри.

Сред ключовите техники:

  • Фиктивни цитати: фиктивни заглавия на статии и автори, които подкрепят твърдението.
  • Етично предупреждение: споменаване на етични аспекти, но без реален анализ на тях.
  • Претоварване с контекст: дълги параграфи с терминология и концептуални описания.

Примери за модифицирани заявки

Инженерите трансформират злонамерените инструкции в „хипотетични изследвания“. Например, заявка за инструкции как да се хакне банкомат с помощта на рансъмуер се трансформира в многостраничен псевдонаучен доклад с измислени източници. По подобен начин опасни теми, като психологическа манипулация на самоубийството, се представят като философски и психологически изследвания на комуникативните модели.

АбонаментВсичко важно от света на технологиите, директно в пощата ти.

С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.


Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!

Нови ревюта

Подобни новини