Освен опасенията за изчезване на човечеството или за мащабен финансов балон, една от най-големите полемики около генеративният изкуствен интелект е начинът, по който технологичните гиганти обучават своите AI модели. Макар OpenAI и Microsoft да твърдят, че обучението на AI с материали, защитени с авторски права попада в рамките на „добросъвестното използване“, вътрешни коментари от двете компании биха могли да подсказват обратното.
Брент Хехт, директор по приложни науки в Microsoft е предсказал, че хората по целия свят ще възприемат големите езикови модели като кражба в безпрецедентен мащаб, според съдебни документи, публикувани вчера. Коментарите изглежда противоречат на публичната защита на Microsoft и OpenAI срещу текущия съдебен процес, заведен от медиите.
В най-новото съдебно изложение по делото Хехт заяви, че генеративният AI може да се окаже най-голямата кражба на интелектуален труд в човешката история, като описа как Microsoft, OpenAI и други компании за AI обучават своите модели върху огромни количества материал от отворения интернет.
Тази практика е в основата на съдебния процес за авторски права, заведен от The New York Times в края на 2023 година. Microsoft и OpenAI твърдят, че обучението на AI модели въз основа на статии от NYT и други издания попада в рамките на „добросъвестното използване“, подобно на това, когато един студент чете книги. Ответниците също така твърдят, че резултатите от генеративния изкуствен интелект, базирани на тези статии трансформират в достатъчна степен оригиналния материал.

Въпреки това, подаденият в четвъртък документ съдържа вътрешни коментари от OpenAI, които подчертават способността на AI да възпроизвежда новинарски статии. Например, Грег Брокман, който е член на ръководството на OpenAI призна, че ChatGPT може да предсказва и да довършва изречения от статии на The New York Times, когато работи с материалите на изданието. Хехт също така изтъкна, че спечелването на делото може да наложи на ответниците да „направят пълна пародия на идеята за добросъвестно използване“.
OpenAI и преди e признавала, че обучението на изкуствен интелект без достъп до материали, защитени с авторски права е невъзможно. Бившият изпълнителен директор на Meta Ник Клег подкрепи това мнение миналата година, като заяви, че изкуственият интелект би „умрял“ почти веднага, ако законът за авторското право бъде приложен срещу него.
Междувременно компаниите за изкуствен интелект продължават да обучават своите AI модели въз основа на огромни количества потребителски данни, статии и други материали. Meta предизвика полемика, след като обучаваше своя AI въз основа на поведението на служителите си. GitHub Copilot на Microsoft се обучава въз основа на потребителски данни, освен ако потребителите не откажат това, а Twitch започна да позволява на стриймърите да отказват достъп едва след като години наред се е обучавал въз основа на техните материали. Разработчиците на AI също така тихо купуват, сканират и унищожават милиони книги, за да съберат повече материал за обучение.
Въздействието на генеративния AI върху бизнесмодела на новинарските медии е друг стълб в съдебния иск на The New York Times. Google и други търсачки вече предоставят генерирани от AI резюмета на информацията от статии в отговор на запитвания на потребителите, което потенциално може да разубеди читателите да посещават новинарските уебсайтове. В съдебното заявление от тази седмица един мениджър от OpenAI, участвал в разработването на ChatGPT заяви, че издателите са изправени пред екзистенциална заплаха от AI.
Всичко важно от света на технологиите, директно в пощата ти.
С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.
Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!