Екипът за машинно обучение на Apple, заедно с изследователи от университета в Нанкин и Хонконгския университет за наука и технологии, разработи 3D ИИ-модел, наречен Matrix3D, който може да пресъздаде 3D-обекти и сцени само от няколко 2D снимки.
Matrix3D принадлежи към категорията на големите фотограметрични модели. Фотограметрията използва снимки, за да получи информация за обекти и да направи измервания, за да създаде 3D модели или карти. В момента този процес включва използването на различни модели за оценка на позата и прогнозиране на дълбочината, което може да доведе до неточности.
Matrix3D ви позволява да извършвате тези операции наведнъж. Той взема предвид изображения, параметри на камерата (като ъгъл и фокусно разстояние), данни за дълбочината и ги обработва, използвайки унифицирана архитектура. Това не само опростява процеса, но и увеличава точността.
За да обучат Matrix3D, изследователите са използвали стратегия за маскирано обучение, при която изследователите скриват част от данните, принуждавайки модела да се научи да запълва празнините. Този метод е ключов, защото позволява ефективно обучение на моделите, дори и с по-малки или непълни набори от данни.
В резултат на това, само с три входни изображения, Matrix3D може да генерира подробни 3D-реконструкции на обекти и дори цели среди, които биха могли да намерят приложение в имeрсивни очила като Vision Pro на Apple.
Изследователите са публикували изходния код на Matrix3D в GitHub. Те също така са създали и сайт, където можете да научите повече за възможностите на новия ИИ-модел.
Всичко важно от света на технологиите, директно в пощата ти.
С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.
Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!