Meta Platforms Inc. разкриха тази седмица Purple Llama – инициатива, която цели да популяризира отговорната разработка на AI системи. От компанията-собственик на социалната мрежа Facebook заявиха, че с времето ще направи достъпни всички инструменти и правила, от които се нуждаят специалистите, за да създават открити генеративни AI модели по един безопасен и отговорен начин.
В публикация в един от блоговете на компанията, Meta привеждат това, че в момента наблюдаваме възход на различни приложения на основата на изкуствения интелект, като генератори на изображения, конверсивните чатботове и инструменти за обобщаване на документи. Много от тези приложения днес се задвижват от Llama – сбор от открити големи езикови модели. Именно участието на Llama във всички тях задължава компанията да поеме отговорността и да засили взаимодействието между различните страни в процеса, което е необходимо за създаването на доверие в иновациите от този тип. „Хората, създаващи AI системите не могат да се справят с предизвикателствата преди изкуствения интелект изолирано от другите. Това се явява причината да искаме да създадем еднакви правила за всички тук и създадем единен център за открито доверие и безопасност“, пишат Meta.
Една от първите инициативи, свързани със старта на Purple Llama е пускането на набор от безплатни и открити оценъчни тестови правила на киберсигурността на големите езикови модели с името CyberSec Eval. Представя се също така и Llama Guard – защитен класификатор за входно/изходно филтриране, който е специално оптимизиран за лесно внедряване и използване. CyberSec Eval ще предоставя метрични показатели с цел оценката на риска, свързани с конкретни големи езикови модели и засягат често срещни проблеми в процеса по създаването на такива модели, като например честотата на предлагане на предложения за използването на несигурен код. Тези и други характеристики на CyberSec Eval са създадени с помощта на водещи експерти по сигурност и се базират на вече установени и проверени правила и стандарти от киберзащитната индустрия. Една от основните цели тук е предотвратяването на възможността киберпрестъпници да използват големите езикови модели за провеждане на атаки чрез тях, посочват Meta.
Самият Llama Guard представлява предварително обучен модел. който е проектиран така че да забранява на AI моделите да генерират потенциално рискови крайни резултати. Той е бил обучен чрез смес от публично достъпни набори от данни, способни да засекат често срещани типове рисково или насилствено съдържание. По този начин, Llama Guard може да регистрира както рискови входни данни, така и зловредно и опасно изходно съдържание, създавано от генеративните AI модели и да поречи на обработката им. Това, подчертават от Meta, ще помогне на разработчиците да пригодят своите модели по такъв начин, че да се сведе до минимум риска от генериране на съдържание, което може да доведе до противоречия, смут или обида.
По отношение на именуването на самия проект (в превод от англ.: „Лилава лама“), то то е свързано с добре известна терминология от киберзащитната индустрия, комбинирайки „червените екипи“ – сбор от специалисти по сигурност, които тестват сигурността на дадена система, като я атакуват и „сините екипи“, които се фокусират над защитата и отговора на тези атаки.
Всичко важно от света на технологиите, директно в пощата ти.
С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.
Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!