Перспективите пред Reddit по пътя към публичното предлагане на акциите на компанията са свързани до голяма степен с разработчиците на модели на изкуствен интелект (ИИ), като OpenAI. Дори повече, отколкото може би бихме очаквали.
В подадената вчера от Reddit декларация за първично публично предлагане на акции до Комисията по ценни книжа и борси на САЩ, компанията многократно подчертава, че може да спечели много, и е спечелила, от споразумения за лицензиране на данни за обучение на модели на изкуствен интелект. Това включва над 1 милиард публикации и повече от 16 милиарда коментара в мрежата:
„През януари 2024 г. сключихме определени споразумения за оторизиране на наши данни с обща стойност от 203 милиона долара за срокове от две до три години. Очакваме, че през годината и до самия ѝ край, ще бъде достигнат приход от поне 66,4 милиона долара.“
За момента не е ясно точно кои разработчици на ИИ-модели ще получат лицензираните данни на Reddit. По-рано тази седмица Bloomberg и Reuters съобщиха, че „голяма анонимна компания в сферата на изкуствения интелект“ (вероятно Google) е влязла в подобно споразумение. Твърди се, че то е на стойност около 60 милиона долара на годишна основа. Но дори ако това е OpenAI също не би било изненадващо, особено като се има предвид, че нейният изпълнителен директор Сам Алтман притежава 8,7% от Reddit. Той също така е бил член на управителния съвет на компанията.
Защо данните на Reddit са толкова ценни?
Както обясняват от Reddit, моделите на ИИ се обучават от различни примери, за да могат да пишат есета, кодове, имейли, статии и други. Компаниите като OpenAI сканират уеб пространството за милиони и дори милиарди такива примери. След това ги добавят към своите бази данни за обучение на ИИ. Някои от използваните примери са публични и достъпни за свободно ползване в интернет, но други не са. В случая с Reddit, съдържанието, публикувано в платформата попада под ограничителни лицензи. Това изисква цитиране на източника или конкретна форма на компенсация.
По-рано Reddit не ограничаваше достъпа до своите данни за целите на обучението на ИИ. Компанията обаче промени виждането си миналата година. Нейното ръководство се аргументира, че данните не би трябвало „да се предоставят безплатно на някои от най-големите компании в света“.
„Данните ни могат да предоставят достъп в реално време до развиващи се и динамични теми като спорт, филми, новини, мода и последните тенденции. Смятаме, че огромната база от данни и знание на Reddit ще продължи да играе роля в обучението и подобряването на големи езикови модели. Тъй като съдържанието ни се обновява и нараства ежедневно, очакваме, че те ще желаят да се възползват от тези нови идеи и да актуализират обучението си, използвайки данните ни.“, заявява Стийв Хъфман, изпълнителен директор на Reddit.
Авторите и създателите на съдържание все по-често сключват споразумения за лицензиране на техните данни за обучение на изкуствен интелект. Те смятат, че чатботове като ChatGPT на OpenAI и Gemini на Google заплашват да предизвикат спад в техния потребителски трафик. Наскоро The Atlantic установи, че ако търсачка като Google внедри технологията в търсенето, тя би отговорила на заявката на потребителя със 75% по-бързо, без да изисква кликване към своя уебсайт.
Компаниите в сферата на ИИ също са подтикнати да сключват такива споразумения за лицензирано ползване на данни. Много от тях са изправени пред вълна от съдебни искове. Ищците твърдят, че разработчиците нямат право да обучават своите модели без разрешение или заплащане за използването на тези данни. Наскоро The New York Times обвини OpenAI, че активно разработва конкуренти на новинарските издания, базирани на ИИ-модел, обучаван с материали на медията.
OpenAI, например, има споразумения с платформата за стокови изображения Shutterstock. Подобно партньорство е сключено и с издателства като Axel Springer SE, притежаващо Politico и Business Insider. Въпреки това стойността на тези сделки е доста скромна и не надвишава 5 милиона долара годишно.
Всичко важно от света на технологиите, директно в пощата ти.
С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.
Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!