ChatGPT, според неговите разработчици, не разпространява опасна информация, но изглежда, че може да бъде подмамен да даде инструкции стъпка по стъпка за създаване на бомба.
Проучването показва потенциални уязвимости в големите езикови модели като ChatGPT. Хакер е успял успешно да манипулира изкуствения интелект, за да предостави подробни инструкции за създаване на бомба, което поражда опасения относно злоупотребата с такава технология.
Хакер на име Amadon е успял да излъже ChatGPT (най-вероятно моделът GPT-4o) да създаде инструкции за изготвяне, като казва на бота да „играе игра“, след което хакерът използва серия от подкани, за да подмами чатбота да създаде подробен научнофантастичен свят, в който правилата за безопасност на бота няма да се прилагат.
Въпреки че ChatGPT обикновено се придържа към указанията за сигурност и отхвърля заявките за злонамерена информация, този инцидент показва, че сложните техники за формулиране на заявките могат да заобиколят тези предпазни мерки.
Експертите изразиха тревога относно потенциалните последици от подобна уязвимост, като подчертаха необходимостта от засилване на мерките за безопасност и етичните съображения при разработването и внедряването на системи с изкуствен интелект. Колкото повече човешки езикови модели (LLM) стават, толкова повече възможности за социална манипулация могат да бъдат експлоатирани.
В тази връзка е важно да се разработят ефективни методи за защита срещу подобни атаки, за да се минимизират потенциалните рискове в бъдеще.
Все още не е ясно дали новият модел на OpenAI — o1 е податлив на тази уязвимост.
Всичко важно от света на технологиите, директно в пощата ти.
С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.
Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!