Reddit ще съди Perplexity за незаконен скрапинг на данни за ИИ

Най-четени

Светослав Димитров
Светослав Димитров
Занимава се със създаване на съдържание за уеб от 2009 г. с над 15000 написани новини за Калдата. Интересува се от SMM, Афилиейт и др.

Платформата Reddit заведе дело срещу Perplexity и трима доставчици на услуги за уеб-скрайпинг – SerpApi, Oxylabs и AWMProxy – обвинявайки ги в масово, неоторизирано събиране на чувствителни данни от сайта на социалната медия за обучение на изкуствен интелект (ИИ). В делото се твърди, че Perplexity, разработчикът на ИИ-търсачката, използва данни, получени чрез тези посредници, вместо да сключи директно споразумение с Reddit, както са направили някои други AI-компании.

Според иска, както научи The Verge, през май 2024 г. Reddit е изпратил на Perplexity официално искане за прекратяване и преустановяване на извличането на съдържание, на което компанията е отговорила, че не използва данни от Reddit за обучение на своите AI-модели и спазва правилата, посочени във файла robots.txt. Въпреки това, малко по-късно броят на цитиранията на Reddit в отговорите на Perplexity се е увеличил, според ищеца.

Reddit подчертава, че генерираните от потребителите милиони публикации осигуряват значителна стойност за обучението на изкуствения интелект и дори компанията е сключила споразумения с OpenAI и Google, а също е въвела платен API през 2023 г., в опит да получи компенсация за използването на своите данни.

Бен Лий, главен юрисконсулт на Reddit, заяви, че „ИИ-компаниите са влезли в надпревара във въоръжаването за висококачествено генерирано от човека съдържание и този натиск е подхранил икономиката за пране на данни в индустриален мащаб“. Той е назовал и литовския скрепер Oxylabs UAB, ботнета AWM Proxy и SerpAI, които открито рекламират методи за заобикаляне на мерките за сигурност, като типични примери за такава незаконна дейност. Той твърди, че тези компании (ответници по делото), без директен достъп до Reddit, прикриват своите скриптове и местоположение, за да крадат съдържание чрез резултатите от търсенето в Google, и че Perplexity съзнателно придобива тези откраднати данни, избягвайки правно сътрудничество.

Джеси Дуайър, ръководител на комуникациите в Perplexity, заяви пред The ​​Verge, че компанията все още не е получила иск, но възнамерява енергично да защитава правото на потребителите на свободен и справедлив достъп до обществена информация. Той подчертава, че Perplexity остава принципна и отговорна и няма да толерира заплахи за откритостта и обществения интерес.

Reddit преди това съди Anthropic по подобни причини, твърдейки, че ботовете на Anthropic са получили достъп до платформата Reddit, дори след като Anthropic заяви, че не прави това.

Спомнете си, че Reddit реши да замрази плановете си за монетизация на събредитите и че възнамерява да се превърне в търсачка. Така, освен монетизацията на ценното съдържание на платформата чрез различни договори с отделни ИИ-компании, като търсачка компанията ще изгради още едно перо за приходи.

АбонаментВсичко важно от света на технологиите, директно в пощата ти.

С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.


Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!

Нови ревюта

Подобни новини