Хората с лекота разпознават гласа на отделния човек в шумната тълпа, но компютрите твърде зле се справят с подобна задача. Google представи решение на този проблем.
Специалистите на интернет гиганта създадоха система с дълбоко машинно обучение, която може да разпознае отделните гласове, може да наблюдава лицето на отделните хора и да разпознава кога говорят. Невронната мрежа може да разпознава отделните разговарящи и да създава виртуални групи. Целта е новият изкуствен интелект да започна да изолира тези групи в отделни звукови пътечки.
Новата система с изкуствен интелект се е научила с висока точност да разпознава гласа на отделния човек, дори и когато няколко души говорят едновременно. Невронната мрежа създава отделна звукова пътечка само с чистата реч на всеки от говорещите. Изкуственият интелект добре разпознава речта, дори и ако лицето е частично закрито с ръка или от микрофона.
Google проучва възможността за използването на тази функционалност в своите продукти. Тя може да се използва например при видеочат в препълнено помещение, за подобряване на речта при запис на видео и т.н. Съществуват и потенциални проблеми с конфиденциалността, понеже някой може да реши да използва новата система за публично подслушване.
Всичко важно от света на технологиите, директно в пощата ти.
С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.
Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!

















