OpenAI накараха GPT-4 да изучи логиката на GPT-2 понеже никой не знае как точно работи генеративният AI

Най-четени

Даниел Десподов
Даниел Десподов
Новинар. Увличам се от съвременни технологии, информационна безопасност, спорт, наука и изкуствен интелект.

Въпреки че езиковите модели на изкуствения интелект завладяват технологичната област, изследователите на ИИ нямат почти никаква представа какво се случва „под капака“ на невронните мрежи. OpenAI откровено признават: „Езиковите модели станаха по-функционални и много широко разпространени, но ние не разбираме как работят„.

Компанията публикува проучване, в което подробно се описва метод за използване на езиковия модел GPT-4 за обяснение на поведението на по-старата невронна мрежа GPT-2. Целта е да се постигне интерпретация и да се обясни защо невронните мрежи правят това, което правят, както и да се създаде надежден контрол на процесите. Експертите на OpenAI са на мнение, че има надежда, че GPT-4 ще може да обясни какви точно са и как протичат процесите в по-опростеният от него генеративен изкуствен интелект GPT-2.

Наличието на такъв модел на ИИ, който може да се тълкува и интерпретира, би спомогнало за постигането на една по-глобална цел, наречена „хармонизация на ИИ“ – да се гарантира, че AI системите се държат както е замислено и отразяват човешките ценности в своята работа.

Засега на никого не е ясно как точно си взаимодействат отделните елементи на невронната мрежа (невроните), за да се получи крайния резултат. Този проблем съвсем логично бе наречен „черната кутия“. С други думи, не е ясно по какъв точно начин даден въпрос се превръща в отговор.

OpenAI накараха GPT-4 да изучи логиката на GPT-2 понеже никой не знае как точно работи генеративният AI

 

В опит да надникне в „черната кутия“ OpenAI използва GPT-4, за оцени и в крайна сметка да създаде разбираеми обяснения на естествен човешки език на поведението на невроните в значително по-опростения модел GPT-2. Чрез автоматизиране на процеса на тълкуване OpenAI се стреми да преодолее ограниченията на ръчната проверка от страна на човека, която не може да обхване системи с милиарди възможни параметри. Целта на този метод на OpenAI е да обясни кои текстови модели предизвикват активиране на неврони. Методът се състои от три стъпки:

  • Да се обясни как става активирането на невроните на GPT-2, което ще се осъществява с помощта на много по=-сложния GPT-4
  • Да се моделира активацията на невроните и да се създадат логични обяснения на случващото се
  • Да се направи сравнение на дейността на различните генеративни AI

GPT-4 ще идентифицира специфичните неврони, вериги и така наречените центрове за внимание в модела и ще създава разбираемо обяснение на ролите на тези компоненти. Той също така може да генерира оценка на обяснението, която OpenAI нарича „мярка за способността на езиковия модел да компресира и реконструира невронните активации с помощта на естествен език„. Изследователите се надяват, че подобна количествена оценка ще доведе до измерим, устойчив напредък в разбирането на начина, по който работят невронните мрежи.

АбонаментВсичко важно от света на технологиите, директно в пощата ти.

С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.


Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!

Нови ревюта

Подобни новини