ИИ-компаниите ще плащат на Уикипедия, за да я предпазят от фалит, поради скрапинг

Най-четени

Светослав Димитров
Светослав Димитров
Занимава се със създаване на съдържание за уеб от 2009 г. с над 15000 написани новини за Калдата. Интересува се от SMM, Афилиейт и др.

Съоснователят на Уикипедия Джими Уелс заяви, че онлайн енциклопедията работи с големи технологични компании за разработване на споразумения за лицензиране на съдържание за обучение по изкуствен интелект, подобни на споразумението си с Google, за да компенсира нарастващите разходи, свързани със „скрапинга“.

Уелс заяви на мероприятието Reuters Next в Ню Йорк, че използването на съдържание от Уикипедия от технологичните компании за обучение на големи езикови модели води до рязко повишаване на разходите, които се поемат от некомерсиалния оператор на сайта. „ИИ-ботовете, които обхождат Уикипедия, обработват целия сайт. Така че се нуждаем от повече сървъри, повече RAM памет и повече кеш-памет, а това е непропорционално скъпо“ — каза той.

Уелс подчертава, че съдържанието на Уикипедия остава безплатно за физически лица съгласно нейния лиценз, но автоматизираният достъп за търговските организации е съвсем различен въпрос. Той отбеляза, че вече е постигнато споразумение по този въпрос с Alphabet, компанията майка на Google, и че в момента се водят преговори с други компании.

През 2022 г. Фондация Уикимедия (нестопанската организация, която управлява Уикипедия) сключи споразумение с Google, което задължава компанията да плаща за достъп до съдържанието на Уикипедия, използвано за обучение на AI-моделите.

Уелс припомни, че основният източник на приходи на фондацията са малки публични дарения, които не са предназначени за финансиране на разработването на комерсиални ИИ-продукти на стойност милиарди долари. „Хората даряват пари в подкрепа на Уикипедия, а не за субсидиране на OpenAI, което ни струва огромни суми. Това е несправедливо“ — казва той.

Джими Уелс заяви, че поради финансови проблеми Уикипедия може да обмисли и използването на технически мерки, като например контрол на достъпа до съдържанието на базата на изкуствен интелект на Cloudflare, който позволява на клиентите да ограничават ИИ-ботовете, които обхождат интернет. Съоснователят на енциклопедията призна, че предвид идеологическия ангажимент на Уикипедия за отворен достъп до знания, това може да създаде дилема.

По-рано Уикипедия публикува набор от данни за обучение на ИИ, така че ботовете да не претоварват сървърите със скрапинг.

АбонаментВсичко важно от света на технологиите, директно в пощата ти.

С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.


Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!

Нови ревюта

Подобни новини