Съвременното програмно осигуряване вече с лекота разпознава различните обекти в изображенията, но не може да опише видяното. Това съвсем скоро ще се промени, понеже специалистите на Google и учените от Станфордския университет създадоха софтуер, който може на съвсем разбираем човешки език да описва видяното.
Новата софтуерна система е съставена от две невронни мрежи, всяка от които решава собствени специфични задачи. Първата невронна мрежа служи за конкретното разпознаване на изображенията и обектите в тях, а втората невронна мрежа се използва за описване на видяното с прости и разбрани думи.
Така например, в първото от показаните тук изображения, системата не казва просто „мотоциклет и човек“, а подробно обяснява, какво точно е изобразено: „човек кара мотоциклет по кален черен път“.
Разработването на тази система едва сега започва и засега допуска грешки. Главният проблем засега е сложната, но твърде малката база данни, която се използва от двете невронни мрежи. Специалистите работят в момента върху обучаването и самообучаването на невронните мрежи.
Новата система ще се използва при създаване на нов ИИ и в роботехниката. Навярно това ще се окаже един от най-големите технологични пробиви.
Всичко важно от света на технологиите, директно в пощата ти.
С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.
Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!