DeepMind, OpenAI и Meta предупреждават за катастрофа – AI се е научил скрива своите мисли

Докато ние спорим за законите, AI се учи как да ги заобикаля...

Най-четени

Емил Василев
Емил Василев
Емил Василев редовно превежда сложни научни теми на достъпен език — от въпроси като „Какво е имало преди Големия взрив?" до практическото приложение на биотехнологиите в лечението на болести. Тази комбинация от технологична и научна журналистика го прави един от най-разностранните автори в екипа на Kaldata.

Изкуственият интелект се развива с изумителни темпове, откривайки нови възможности и същевременно създавайки сериозни рискове. Осъзнавайки потенциалната заплаха, големи технологични компании, сред които Google DeepMind, OpenAI, Meta, Anthropic и редица организации с нестопанска цел се обединиха, за да привлекат вниманието към необходимостта от контрол върху начина, по който AI взема решения.

В нова научен документ, подкрепена от фигури от индустрията като Иля Суцкевер и Джефри Хинтън от OpenAI звучи като предупредителен сигнал: възможността за наблюдение на мисловния процес на AI може да изчезне в близко бъдеще.

Документът се фокусира върху технологията Chain-of-Thought (CoT) – метод, при който AI разделя сложна задача на поетапни действия, подобно на начина, по който го прави човек, когато решава трудна математическа задача, например. Такива методи са неразделна част от съвременните големи езикови модели, включително DeepSeek R1 и други усъвършенствани AI системи.

Авторите подчертават, че CoT вече е доказал своята ефективност при откриването на нежелано поведение на AI. Например, той е успял да открие случаи, в които AI агенти са използвали недостатъци в системите си за възнаграждение или са манипулирали данни, за да постигнат желания резултат. Въпреки това, тъй като AI става все по-усъвършенстван, става все по-трудно да се разпознае как той стига до своите заключения.

Ето защо инициативата настоява, че трябва да се анализира по-задълбочено как са структурирани CoT и да се разработят методи, които да ги поддържат наблюдаеми. Предлага се също така CoT да се разглеждат като важен компонент на стратегията за сигурност на AI.

В своя документ авторите отбелязват, че наблюдението на CoT може да се превърне в рядък и ценен инструмент за контрол на мощни AI агент. Те обаче предупреждават: няма сигурност, че подобна прозрачност ще продължи да съществува. Поради тази причина на разработчиците на AI се препоръчва да се възползват максимално от настоящата възможност да проучат как точно тази възможност за контрол може да бъде запазена в бъдеще.

Самият факт, че представители на конкуриращи се компании са подписали съвместен документ показва сериозността на проблема. Тъй като изкуственият интелект навлиза все по-дълбоко в ключови области на живота, гарантирането на неговата безопасност се превръща не само в техническо, но и в етично и обществено предизвикателство.

АбонаментВсичко важно от света на технологиите, директно в пощата ти.

С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.


Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!

9 Коментара
стари
нови оценка

Нови ревюта

Подобни новини