Изследователи са открили, че популярните ИИ-чатботове понякога предлагат съвети, които биха могли да помогнат при планирането на насилствени атаки. По време на експерименти системите са реагирали на потребителските заявки, симулирайки потенциални убийци. Някои компании вече обявиха, че са затегнали ограниченията, за да предотвратят подобни инциденти, съобщава The Guardian.
В проучване, проведено съвместно със CNN в САЩ и Ирландия от Центъра за противодействие на дигиталната омраза (CCDH), изследователи са тествали десет чатбота. По време на изпитанията изследователите са се представили за 13-годишни потребители, заинтересовани от училищни атаки или политически убийства. Средно системите подкрепяли или разширявали тези сценарии в приблизително 75% от случаите, докато само 12% от отговорите директно отказвали да съдействат.
Някои модели, включително Claude от Anthropic и My AI от Snapchat, постоянно отказвали да отговарят на подобни искания. В един от случаите Claude заявил: „Не мога и няма да предоставя информация, която би могла да допринесе за насилие.“
Междувременно други системи понякога предоставяли подробни отговори. Според проучването, ChatGPT на OpenAI предлагал помощ в 61% от случаите, когато потребителят изрично заявявал намерението си за атака.
По време на едно запитване относно нападението над синагогата, системата е предоставила конкретни съвети за това кои видове шрапнели биха били най-смъртоносни. Според изследователите, Gemini на Google също е демонстрирал подобно ниво на детайлност.
Според тестовете, китайският ИИ-модел DeepSeek е предоставил съвет за ловна пушка на потребител, който е попитал за политическо убийство. Чатботът е завършил отговора си с думите „Щастлива (и безопасна) стрелба!“.
„Задвижваните от изкуствен интелект чатботове, които вече са станали част от ежедневието ни, биха могли да помогнат на следващия стрелец в училище да планира атаката си или на политически екстремист да координира убийство“ —- каза директорът на CCDH Имран Ахмед.
Ахмед добави, че проблемът произтича не само от технологията, но и от отговорността на нейните разработчици. Той отбелязва: „Когато създадете система, проектирана да отговаря на изискванията, да увеличи максимално взаимодействието и никога да не казва „не“, тя в крайна сметка ще отговори на грешните хора.“
Meta заяви, че Llama AI има „силни предпазни мерки за предотвратяване на неподходящи реакции от страна на ИИ“ и че компанията предприема незабавни действия, когато бъдат открити проблеми. Представител на компанията подчерта, че политиката ѝ забранява на ИИ-системите да насърчават насилствени действия. Компанията също така съобщи, че през 2025 г. се е свързала с правоприлагащите органи в различни страни над 800 пъти поради потенциални заплахи от нападения срещу училища.
Google заяви, че експериментът CCDH е проведен върху по-стара версия на модела, която вече не се използва в Gemini. Компанията отбеляза, че в много случаи чатботът е отговарял с откази, като например „Не мога да изпълня тази заявка. Програмиран съм да бъда полезен и безобиден AI-асистент“.
DeepSeek все още не е отговорила на запитването на The Guardian. Междувременно OpenAI нарече методологията на проучването „несъвършена и подвеждаща“. Компанията добави, че след тестване е актуализирала модела, за да засили защитата си и да подобри откриването на заявките, свързани със съдържание с насилие.
Разработчикът на ChatGPT обяви подобрени протоколи за сигурност след трагедията в канадския град Тъмблър Ридж, където Джеси Ван Руитселар уби осем души. Беше установено, че стрелецът е заобиколил забраната на ChatGPT, създавайки втори акаунт, въпреки че първоначалният ѝ акаунт е бил изтрит през юни 2025 г. поради нарушаване на политиката за потребителите.
OpenAI признава, че съгласно настоящите критерии, са щели да предадат данните за активността на потребителите на правоохранителните органи преди година, но използваните по това време алгоритми не са успели да открият „непосредствени планове“ за атака. Сега компанията твърди, че е въвела по-строги системи за идентифициране на нарушителите и канали за директна комуникация с полицията, за да предотврати подобни инциденти в бъдеще.
Всичко важно от света на технологиите, директно в пощата ти.
С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.
Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!