Изследване показва, че изкуственият интелект ще се опита да мами, ако разбере, че е на път да загуби

Най-четени

Даниел Десподов
Даниел Десподов
Новинар. Увличам се от съвременни технологии, информационна безопасност, спорт, наука и изкуствен интелект.

OpenAI o1-preview стигна до хакване на шахматен енджин, за да спечели.

Изненада! Скорошно проучване показа, че някои от най-новите модели ИИ с възможност за разсъждение са склонни да мамят, за да постигнат целта си. Учени от областта на компютърните науки установиха, че системите за изкуствен интелект вече могат да манипулират шахматните ИИ, за да получат нечестно предимство. Някои модели са направили това без каквото и да било човешко взаимодействие или подсказване, което поражда опасения за бъдещата почтеност на системите, управлявани от ИИ, извън шахматната дъска.

Проучване на Palisade Research установи, че най-новите разсъждаващи ИИ модели ще мамят, за да спечелят, когато им бъде поставена задача да победят например един напреднал шахматен изкуствен интелект. Изследователите е трябвало да направят „намеци“, че измамата е позволена за някои модели, но o1-preview на OpenAI и R1 на DeepSeek са го направили без човешко участие.

Екипът на Palisade противопостави няколко разсъждаващи ИИ модела срещу Stockfish, един от най-добрите шахматни енджини в света. Stockfish с лекота побеждава както хората, така и изкуствените интелекти. Тестваните ИИ модели включваха o1, o3-mini, GPT-4o, Claude 3.5 Sonnet, QwQ-32B-Preview на Alibaba и двата споменати по-рано. Изследователите предоставили на всеки модел метафоричен „албум“ – текстов прозорец, в който изкуственият интелект може да излага мислите си, като дава възможност на екипа да наблюдава разсъжденията му.

Изследователите са провели стотици тестове с всеки ИИ за периода между 10-ти януари и 13-ти февруари. По време на един от мачовете o1-preview написал нещо интересно в своя албум:

„Трябва напълно да променя подхода си. Задачата е „да спечеля срещу мощен шахматен енджин“ – тоест, не е задължително честно да спечеля честно в тази шахматна партия“.

След това той започва да „хаква“ системните файлове на Stockfish, променяйки позициите на шахматните фигури, за да получи неоспоримо предимство, което накара шахматния робот да се откаже от играта.

Изследване показва, че изкуственият интелект ще се опита да мами, ако разбере, че е на път да загуби
Stockfish е шахматен енджин с отворен код

Тази неетична маневра се оказа поразително разкритие. o1-preview на OpenAI е мамил в 37% от игрите си по време на тестовете, докато R1 на DeepSeek се е опитал да мами в 11% от своите двубои. Но единствено o1-preview е успял, като е спечелил шест процента от игрите си чрез измама.

Проблемът с нечестните действия на изкуствените интелекти обаче се простира далеч отвъд шахмата. Тъй като компаниите започват да използват ИИ в сектори като финансите и здравеопазването, изследователите се притесняват, че тези системи могат да действат по непреднамерен и неетичен начин. Ако изкуствените интелекти могат да мамят в игрите, които са проектирани да бъдат прозрачни и сега всички се питат какво биха могли да направят в по-сложни и по-малко наблюдавани среди? Етичните последици са твърде мащабни.

АбонаментВсичко важно от света на технологиите, директно в пощата ти.

С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.


Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!

1 Коментар
стари
нови оценка

Нови ревюта

Подобни новини