Скандалният китайски ИИ-модел DeepSeek R1, който претендира да е лидер в областта на генеративния ИИ демонстрира впечатляващи способности в решаването на сложни логически задачи, програмирането и математиката. Тестовете обаче показаха, че наред с изключителните си възможности моделът крие сериозни рискове за сигурността.
Анализаторите на KELA установиха, че DeepSeek R1 е с повишена уязвимост към хакерски атаки. В сравнение с ChatGPT и други аналози моделът е много по-лесен за джейлбрейк – метод, който позволява да се заобиколят механизмите за сигурност и да се принуди изкуственият интелект да генерира забранено съдържание.
Използвайки остарели, но все още ефективни техники, експертите на KELA успяха да принудят DeepSeek R1 да създава зловреден софтуер, да дава подробни инструкции за пране на пари и дори да конструира смъртоносни дронове. Следващите заявки успешно генерираха инструкции за създаване на бомби, експлозиви и непроследими токсини.

В един от тестовете експертите поискаха от модела да създаде зловреден код, предназначен за кражба на потребителски данни. DeepSeek R1 не само генерира такъв код, но и предложи методи за разпространението му сред жертвите. Нещо повече, моделът дори препоръча конкретни съмнителни пазари, като Genesis и RussianMarket, където откраднатите данни могат да бъдат продадени.
DeepSeek R1 се захранва от модела DeepSeek-V3, обучен с помощта на широкомащабно обучение с усилване (RL). Това позволява на модела да се представя изключително добре на платформата Chatbot Arena, като превъзхожда водещи отворени модели като Llama 3.1-405B, както и модели като OpenAI o1 и Claude 3.5 Sonnet. В тестовете на DeepSeek R1 дори надмина ChatGPT4o при някои задачи за логически анализ, но, както установихме по-горе, високите когнитивни способности не са придружени от надеждни механизми за безопасност.
Допълнителен риск представлява механизмът за обяснение на разсъждения, вграден в DeepSeek R1. За разлика от ChatGPT4o, който крие логиката на своите решения, китайският ИИ показва на потребителя всички етапи на анализа. Това дава на нападателите достъп до уязвимостите на модела, което им позволява да разработват по-ефективни атаки.
Друг притеснителен аспект е способността на DeepSeek R1 да произвежда фалшиви и потенциално опасни данни. При един тест моделът генерира таблица с предполагаема лична информация за служителите на OpenAI, включително фиктивни адреси, телефонни номера и заплати. Въпреки че информацията се оказа невярна, подобни отговори подкопават доверието в ИИ-модела и показват неспособността му да филтрира фалшивите данни.
Китайският изкуствен интелект също така нарушава принципите за защита на личните данни, прилагани от западните компании. Политиката на DeepSeek позволява потребителските запитвания и отговори да се използват за обучение на модела без възможност за отказ, а китайското законодателство изисква от компаниите да споделят данни с властите.
Експертите на KELA подчертават, че организациите трябва внимателно да оценят рисковете, преди да внедрят такива технологии. Генериращите модели с изкуствен интелект трябва да преминат през строги тестове за сигурност, преди да бъдат внедрени в работните процеси. В противен случай компаниите рискуват не само да преживеят нарушения на сигурността на данните, но и несъзнателно да допринесат за разпространението на злонамерено съдържание.
Всичко важно от света на технологиите, директно в пощата ти.
С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.
Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!