Въпреки че езиковите модели на изкуствения интелект завладяват технологичната област, изследователите на ИИ нямат почти никаква представа какво се случва „под капака“ на невронните мрежи. OpenAI откровено признават: „Езиковите модели станаха по-функционални и много широко разпространени, но ние не разбираме как работят„.
Компанията публикува проучване, в което подробно се описва метод за използване на езиковия модел GPT-4 за обяснение на поведението на по-старата невронна мрежа GPT-2. Целта е да се постигне интерпретация и да се обясни защо невронните мрежи правят това, което правят, както и да се създаде надежден контрол на процесите. Експертите на OpenAI са на мнение, че има надежда, че GPT-4 ще може да обясни какви точно са и как протичат процесите в по-опростеният от него генеративен изкуствен интелект GPT-2.
Наличието на такъв модел на ИИ, който може да се тълкува и интерпретира, би спомогнало за постигането на една по-глобална цел, наречена „хармонизация на ИИ“ – да се гарантира, че AI системите се държат както е замислено и отразяват човешките ценности в своята работа.
Засега на никого не е ясно как точно си взаимодействат отделните елементи на невронната мрежа (невроните), за да се получи крайния резултат. Този проблем съвсем логично бе наречен „черната кутия“. С други думи, не е ясно по какъв точно начин даден въпрос се превръща в отговор.
В опит да надникне в „черната кутия“ OpenAI използва GPT-4, за оцени и в крайна сметка да създаде разбираеми обяснения на естествен човешки език на поведението на невроните в значително по-опростения модел GPT-2. Чрез автоматизиране на процеса на тълкуване OpenAI се стреми да преодолее ограниченията на ръчната проверка от страна на човека, която не може да обхване системи с милиарди възможни параметри. Целта на този метод на OpenAI е да обясни кои текстови модели предизвикват активиране на неврони. Методът се състои от три стъпки:
- Да се обясни как става активирането на невроните на GPT-2, което ще се осъществява с помощта на много по=-сложния GPT-4
- Да се моделира активацията на невроните и да се създадат логични обяснения на случващото се
- Да се направи сравнение на дейността на различните генеративни AI
GPT-4 ще идентифицира специфичните неврони, вериги и така наречените центрове за внимание в модела и ще създава разбираемо обяснение на ролите на тези компоненти. Той също така може да генерира оценка на обяснението, която OpenAI нарича „мярка за способността на езиковия модел да компресира и реконструира невронните активации с помощта на естествен език„. Изследователите се надяват, че подобна количествена оценка ще доведе до измерим, устойчив напредък в разбирането на начина, по който работят невронните мрежи.
Всичко важно от света на технологиите, директно в пощата ти.
С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.
Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!
