Компанията Google DeepMind разработва технология, базирана на изкуствен интелект, за създаване на саундтраци към видео.
Изследователският отдел на Google за изкуствен интелект и други организации вече са създали модели за видеоклипове, но не могат да генерират звукови ефекти за тях. За тези цели DeepMind използва технологията V2A (video-to-audio).
„Моделите за генериране на видео се развиват с невероятна скорост, но много съвременни системи не създават звуков съпровод. Една от следващите важни стъпки към генерирането на филми е появата на саундтраци за тези неми видеоклипове“ — се казва в изявлението на DeepMind.
V2A технологията на DeepMind използва подкани в комбинация с видео за създаване на музика, звукови ефекти и диалог. Например: „Пулсираща под водата медуза, морски живот, океан.“ Базовият дифузионен AI модел на V2A се обучава на аудио, преписи на диалози и видео клипове.
За създаването на звук към видеото са използвани следните подсказки: кинематография, трилър, филм на ужасите, музика, напрежение, атмосфера, стъпки върху бетон.
DeepMind отбелязва, че технологията все още не е съвършена и звукът не може да се нарече висококачествен или убедителен. Преди пълноценното пускане на V2A са необходими подобрения и тестове.
Всичко важно от света на технологиите, директно в пощата ти.
С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.
Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!