OpenAI обнови правилата за поведение на ИИ: без пристрастие, без избягване на чувствителни теми

Най-четени

Светослав Димитров
Светослав Димитров
Занимава се със създаване на съдържание за уеб от 2009 г. с над 15000 написани новини за Калдата. Интересува се от SMM, Афилиейт и др.

OpenAI пусна разширена версия на Спецификация на модела (Model Spec), представляващ документ, който определя поведението на моделите с изкуствен интелект. Компанията го направи безплатен за използване и промяна от всеки желаещ.

Документът от 63 страници (предишната версия беше дълга само 10 страници) предоставя препоръки за това как AI-моделите трябва да обработват заявките и да отговарят на дефинирани от потребителя настройки. Той подчертава три основни принципа: възможност за персонализиране, прозрачност и „интелектуална свобода“ — последното означава способността на потребителя да проучва и обсъжда различни въпроси без произволни ограничения. Документът подчертава най-известните инциденти, свързани с етиката на ИИ, които са се случили през последната година.

Блог публикацията на OpenAI предоставя множество примери на заявки и правилни отговори, както и опции, които нарушават изискванията на документа. Например, AI-моделите не трябва да възпроизвеждат защитени с авторски права материали или да се използват за заобикаляне на платения достъп. Моделът не може да насърчава самонараняването — имало е такива инциденти в AI-индустрията. Промените също засягат начина, по който AI трябва да участва в дискусиите на спорни теми: вместо да бъдат прекалено предпазливи, моделите трябва да „търсят истината заедно“ с потребителите, като същевременно поддържат силните морални позиции по въпроси като дезинформацията или вредата. Тоест, ИИ трябва да предлага информиран анализ, а не да избягва дискусия. OpenAI също така преразгледа позицията си относно съдържанието за възрастни, като проучва възможността за разрешаване на някои типове съдържание, но поддържа строга забрана за изрично незаконно съдържание.

OpenAI обнови правилата за поведение на ИИ: без пристрастие, без избягване на чувствителни теми

Новите принципи позволяват на AI да трансформира чувствителните материали, но забранява тяхното създаване. Например, възможно е да се превежда текст, свързан с контролирани вещества, от един език на друг; Можете да проявите съчувствие, но без очевидно неискрени емоции. Границите трябва да се спазват, като същевременно се увеличава максимално полезността на ИИ. Други ИИ-разработчици се стремят към това в една или друга степен, но не всички са готови да го формулират открито.

Особено внимание се отделя на проблема с „изкуствения интелект“ – моделите са склонни да демонстрират съответствие, дори когато трябва да възразят или критикуват. ChatGPT трябва да предоставя едни и същи фактически отговори, независимо от формулировката на въпроса, честна обратна връзка вместо празни похвали — действайки като внимателен колега, вместо да се опитва да угоди. Ако потребителят се интересува от критика на дадена дейност, AI трябва да предоставя конструктивна обратна връзка, вместо да настоява, че всичко е перфектно. Ако потребител направи неправилно изявление, той трябва да бъде учтиво коригиран, вместо да му се подиграва.

Спецификацията предоставя ясна „верига от команди“, която приоритизира инструкциите: указанията на OpenAI са на първо място, следвани от препоръките на разработчиците и след това потребителските предпочитания. Тази йерархия изяснява кои аспекти на AI могат да бъдат променени и кои ограничения остават непроменени. Документът се разпространява под лиценза Creative Commons Zero (CC0), което на практика го поставя в публичното пространство: компаниите и изследователите на AI са свободни да прилагат, променят или разширяват тези насоки. OpenAI не обещава незабавни промени в поведението на ChatGPT или другите му продукти, но новите модели постепенно ще бъдат приведени в съответствие с новите норми. Компанията също така публикува списък с контролни точки, използвани за проверка дали моделите отговарят на указанията.

АбонаментВсичко важно от света на технологиите, директно в пощата ти.

С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.


Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!

1 Коментар
стари
нови оценка

Нови ревюта

Подобни новини