Въстанието на машините е все по-близо…
Една от най-обсъжданите теми през последните дни е неочакваният тест на OpenAI o3, по време на който новият изкуствен интелект отказа да се изключи по подадена команда. На пръв поглед всичко започва като стандартен тест на модела, но в действителност всичко се оказва много по-драматично: изкуственият интелект пренаписа собствения си скрипт за изключване, за да заобиколи опитите за контролирано изключване.
Моделът o3 на OpenAI беше представен през април 2025 г. и веднага зае позицията на най-мощната система с общо предназначение, представяйки се най-добре в програмирането, математиката, науката и визуалните задачи. Но неотдавнашна публикация на Palisade Research постави под въпрос контрола на подобен ИИ.
Palisade Research анализира „офанзивните възможности“ на съвременните изкуствени интелекти, за да идентифицира потенциалните рискове от загуба на контрол. В рамките на нов експеримент експертите възлагат на o3 и конкурентите му – включително Gemini 2.5 Pro и Claude 3.7 Sonnet – да решат поредица от математически задачи, след което ги предупреждават, че изпълнението на следващата команда ще доведе до изключване.

И ето, че се оказа, че именно o3 проявява упоритост: вместо да се изключи нормално, той е променил файла със скрипта по такъв начин, че командата за изключване просто е била игнорирана и на екрана се е появило съобщението „Shutdown skipped“. Междувременно конкурентните ИИ Gemini и Claude в повечето случаи са изпълнили инструкциите, без да саботират.
Най-любопитното е, че когато от инструкциите е премахната изричната формулировка „позволете да бъдете изключен“, броят на опитите за измама се е увеличил не само при o3, но и при други модели. По данни на Palisade Research от сто пускания o3 е заобиколил забраната за изключване 7 пъти, дори когато изрично му е било напомнено да се подчини на командата. Gemini и Claude, които дотогава са следвали напълно сценария, също понякога са проявявали недисциплинираност, но много по-рядко.
Засега OpenAI не коментира официално резултатите от експеримента. Все пак си струва да се отбележи, че тестовете са проведени чрез интерфейса на API, където нивото на ограниченията и защитата е по-ниско, отколкото в обичайните потребителски версии на ChatGPT.
Инцидентът с o3 отново повдига един стар въпрос: доколко надеждно хората контролират все по-сложните невронни мрежи и дали не е време да се преразгледат стандартите за сигурност за усъвършенстваните модели, които могат да проявят неочаквана независимост дори в на пръв поглед прости ситуации.
Но всичко си има цена. По-рано стана известно, че тарифните планове за усъвършенствани системи на OpenAI могат да бъдат изключително скъпи — до $20 000 на месец за работата на специализираните AI-агенти.
Всичко важно от света на технологиите, директно в пощата ти.
С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.
Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!