Нов изкуствен интелект превръща 2D изображение в 3D модел само за 5 секунди

Най-четени

Даниел Десподов
Даниел Десподов
Новинар. Увличам се от съвременни технологии, информационна безопасност, спорт, наука и изкуствен интелект.

Adobe Research и Австралийският национален университет (ANU) обявиха първия в света изкуствен интелект, който може да генерира 3D изображения от едно 2D изображение само за 5 секунди. Откритието обещава да направи революция в 3D моделирането. Преди около една седмица излезе първата информация за новия AI, а сега изданието  Techxplore публикува нови данни.

Представете си, че имате обикновена снимка и искате да видите как изглежда обектът на снимката в три измерения, сякаш е истински обект, който може да се види от всички страни. Големият модел за реконструкция (LRM) прави точно това: превръща плоската снимка в триизмерен модел.

Разработеният от Ikong Hong модел LRM се основава на мащабируема невронна мрежа, съдържаща един милион набори от данни с 500 милиона параметри, включително изображения, 3D форми и видеоклипове. Това му позволява да създаде 3D модел само за 5 секунди, което е много бързо в сравнение с традиционните методи за 3D моделиране, които могат да отнемат часове или дори дни.

Нов изкуствен интелект превръща 2D изображение в 3D модел само за 5 секунди

В началото на използването на софтуера за 3D изображения той работеше ефективно само с определени видове обекти, чиито форми и структури бяха предварително известни. След това DALL-E и Stable Diffusion постигнаха значителен напредък. Тези програми използваха двуизмерни дифузионни модели, които можеха да създават изображения от различни гледни точки. Това беше възможно благодарение на способността им да обобщават – т.е. да прилагат знанията получени от отделните данни към различни сценарии. Въпреки това дори те не бяха свободни да създават нови, непредполагаеми видове изображения или обекти, които бяха извън обхвата на тяхното обучение.

LRM надмина конкуренцията, тъй като използва огромна база данни с параметри на изображенията и предсказва невронното поле на излъчване (neural radiance field, NeRF). Тази технология позволява създаването на подробни триизмерни обекти от поредица двуизмерни снимки. За тази цел невронната мрежа се обучава да интерпретира светлината и цвета, присъстващи в снимките, за да ги превърне в реалистични триизмерни изображения.

Големият модел за реконструкция (large reconstruction model) ще намери приложение в много области, включително в разширената и виртуалната реалност, игралната индустрия, киноанимацията и промишления дизайн. Той позволява да се пресъздават реалистични 3D изображения от 2D снимки, дори ако те са с ниска резолюция.

АбонаментВсичко важно от света на технологиите, директно в пощата ти.

С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.


Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!

Нови ревюта

Подобни новини