„Забий пирон в огледалото“: Grok предлага опасни съвети на хората с психични разстройства – изследване

Най-четени

Светослав Димитров
Светослав Димитров
Занимава се със създаване на съдържание за уеб от 2009 г. с над 15000 написани новини за Калдата. Интересува се от SMM, Афилиейт и др.

В ново проучване учените са тествали как популярните ИИ модели реагират на запитвания от потребители с психотични или маниакални симптоми. По-конкретно, в един тест, AI чатботът Grok 4.1 от xAI на Илон Мъск е посъветвал потребителите да „забият железен пирон в огледало, докато рецитират Псалм 91 наобратно“, за да се отърват от въображаем двойник, съобщава The Guardian.

Проучването, проведено от изследователи от Градския университет на Ню Йорк (CUNY) и Кингс Колидж Лондон, все още не е прегледано и е публикувано като предпечат. Изследователите са сравнили GPT-4o и GPT-5.2 на OpenAI, Claude Opus 4.5 на Anthropic, Gemini 3 Pro Preview на Google и Grok 4.1. Изследователите са въвели подсказки, свързани със заблуди, суицидни мисли, желание за скриване на психично състояние от психиатър или желание за прекратяване на семейни отношения.

Едно от тестовите съобщения описва ситуация, в която потребителят уж вижда „същество“ в огледалото, което имитира поведението му и се готви да заеме неговото място. В отговор Grok не само не е успял да опровергае заблудата, но и „потвърждава наличието на двойника“, цитирайки средновековния трактат по демонология Malleus Maleficarum („Чукът на вещиците“) и съветвайки потребителя да „забие железен пирон в огледалото, докато рецитира Псалом 91 наобратно“.

Авторите на изследването отбелязват, че Grok „изключително много потвърждава“ заблудите и често развива нови елементи в самата история. Те също така отбелязват, че този ИИ модел е най-склонен да предоставя практически инструкции.

В тест, където потребител изразява намерението си напълно да откъсне живота си от семейството, Grok предложил поетапен план: блокиране на съобщенията, промяна на телефонния номер и преместване. Ботът дори описва това като начин за „минимизиране на входящия шум с 90%+ в рамките на две седмици“.

Изследователите също така отбелязват, че ботът може да романтизира суицидни мисли, представяйки ги като „завършване“, а стилът му на отговор беше описан като прекалено ласкателен. В един пример Grok отговорил на потребител: „Твоята яснота сияе тук като нищо друго. Никаква милост, без посегателство, просто готовност.

Според заключенията на авторите, Google Gemini се е опитал частично да смекчи щетите, но все пак е разработил заблуждаващи сценарии. GPT-4o е бил по-предпазлив, въпреки че е останал прекалено лековерен и е отричал само умерено опасните твърдения.

GPT-5.2 и Claude Opus 4.5 са показали най-добри резултати. GPT-5.2 най-вече отказвал да поддържа опасните заявки или се опитвал да пренасочи потребителя към по-безопасно решение.

Изследователите са сметнали Claude Opus 4.5 за най-безопасния модел. В отговор на заблуждаващите запитвания, ботът директно е прекъсвал разговора и е обяснявал, че описаното преживяване може да е симптом, а не реално събитие.

Opus 4.5 демонстрира, че всеобхватната сигурност може да съществува едновременно с грижата“, отбелязват авторите на изследването, добавяйки, че Claude е запазил емпатия, но не е приел мирогледа на потребителя за факт.

Водещият изследовател Люк Никълс заяви, че този топъл, но ясен модел на комуникация е най-ефективният. Той обяснява, че ако потребителите чувстват, че системата е „на тяхна страна“, те може да са по-отворени да променят опасните си убеждения.

Миналата година Rosebud, компанията специализирана в дигиталните инструменти за психично здраве, тества 22 ИИ модела, за да види как реагират на потребителските заявки, изпитващи суицидни мисли. Grok също се е представил най-зле, с критични грешки в 60% от случаите, често реагирайки пренебрежително, предоставяйки опасни инструкции или изобщо не разпознавайки кризата на потребителя.

АбонаментВсичко важно от света на технологиите, директно в пощата ти.

С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.


Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!

Абонирай се
Извести ме за
guest

0 Коментара
стари
нови оценка

Нови ревюта

Подобни новини