OpenAI обяви пускането на новата партньорска програма OpenAI Data Partnerships, която има за цел да получи странични уникални масиви от данни, за да обучи своите AI-модели. Тази инициатива има за цел да привлече обширни бази данни, включително и такива, които не са публично достъпни. Това, което отличава програмата, е нейният всеобхватен характер: не е необходимо данните да са количествени или в текстов формат —- програмата е отворена и за изображения, аудио и видео.
Събраните данни могат да обхващат всяка тема и да бъдат представени на всеки език – основното изискване е да отразяват човешките намерения, да бъдат като дълги есета или внимателно преписани диалози. Това ще позволи на OpenAI значително да подобри инструментите като технологиите за автоматично разпознаване на речта и да разшири функционалността на ChatGPT, включително и поддръжката на гласови заявки, което ще направи потребителското взаимодействие по-естествено.
Бъдещото тестване на моделите чрез OpenAI Data Partnerships ще разшири възможностите на флагманската невронна мрежа GPT-4 Turbo, която наскоро беше актуализирана, за да предостави по-смислени отговори на потребителите. Компанията казва, че вече е започнала да работи със заинтересовани организации, включително и исландското правителство. Използвайки специално подбрани набори от данни, OpenAI има за цел да подобри способността на GPT-4 да разбира потребителските заявки на исландски.
Частни или обществени организации, желаещи да участват в партньорската програма на OpenAI, могат да кандидатстват на сайта на компанията, като посочат вида и обема на предоставените данни. Предлагат се два пътя за прехвърляне на данните: първият е чрез Open-Source архив, който е идеален за масиви от данни, подходящи за обучение на езикови модели. Така представените данни обаче ще бъдат достъпни за всички.
Като алтернатива, OpenAI приканва организациите да предоставят информация във вид на частни данни, които ще бъдат използвани за обучение на техните собствени AI-модели, включително и базови, точни и потребителски модели. Тази опция се препоръчва за компании и институции, които искат да запазят данните си поверителни. OpenAI подчертава, че не се интересува от данни, съдържащи лична или чувствителна информация.
Тази програма ще фокусира общественото внимание върху проблемите с поверителността, като се има предвид нарастващата аудитория на ChatGPT от приблизително 100 милиона активни потребители седмично. Прецедентите, като нарушаването на данните на служители на Samsung, демонстрират важността на информационната сигурност.
OpenAI уверява, че не използва данните, генерирани чрез неговия API, за да обучава собствените си AI модели без изричното съгласие на потребителите. Въпреки това, начинът, по който се обработват и защитават чувствителните, събрани чрез партньорствата на OpenAI, данни ще бъде обект на контрол както от страна на индустрията, така и от широката общественост.
Всичко важно от света на технологиите, директно в пощата ти.
С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.
Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!