Meta получи обвинение в използване на пиратски копия на книги за обучението на своя ИИ

Най-четени

Светослав Димитров
Светослав Димитров
Занимава се със създаване на съдържание за уеб от 2009 г. с над 15000 написани новини за Калдата. Интересува се от SMM, Афилиейт и др.

Адвокатите на Meta предупредиха компанията да не използва пиратски копия на книги за обучение на изкуствения интелект, но тя все пак го направи, според съдебно дело за авторски права, заведено срещу компанията миналото лято, съобщава Reuters.

Ден преди това съдебните дела срещу Meta бяха обединени от комика Сара Силвърман, носителя на наградата Пулицър Майкъл Чабон и няколко други автори, които твърдят, че компанията е използвала произведенията им без разрешение, за да обучи големия си езиков модел Llama. В документите се привеждат журнали от преписки на един от сървърите на Discord, в които един от участниците, изследователят на Meta Тим Детмърс, описва дискусията си с правния отдел на компанията относно това дали би било законно да се обучава AI на електронни копия на книги.

Адвокатите на Meta са му казали, че „данните не могат да бъдат използвани [за обучение на модела] или моделите не могат да бъдат публикувани, ако са обучени на тези данни“. Но компанията призна, че все пак е използвала тези данни, за да обучи първата версия на Llama. Събеседниците на Детмърс обаче настояват, че използването на защитена с авторски права литература трябва да бъде „предмет на честна употреба“ — правна доктрина в Съединените щати, която в определени случаи позволява използването на защитени с авторски права произведения без съгласието на техните автори.

Тази година технологичните компании бяха засегнати от множество съдебни дела от различни създатели, обвиняващи разработчиците на AI в незаконно използване на защитените с авторски права произведения. Тяхната победа може да представлява заплаха за зараждащата се генеративна AI-индустрия, тъй като разходите за разработване на модели ще се повишат поради необходимостта от плащане на авторски права. Предварително одобреният закон за изкуствения интелект в Европа изисква от разработчиците да разкриват данните, които използват за обучение на своите модели.

През февруари Meta представи първата версия на големия езиков модел Llama и разкри масива от данни, използвани за обучението му, включително и блок, за който се твърди, че съдържа 196 640 книги. Миналото лято беше представена втората версия на Llama и Meta вече не разкрива какви данни са използвани за обучението ѝ. Компаниите, управляващи услуги с по-малко от 700 милиона месечни потребители, могат да използват Llama 2 безплатно.

АбонаментВсичко важно от света на технологиите, директно в пощата ти.

С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.


Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!

Нови ревюта

Подобни новини