OpenAI представи Sora – новия си ИИ-модел за генериране на видео чрез текстови заявки.
Компанията твърди, че Sora „може да създава реалистични и фантастични сцени чрез текстови инструкции“.
Моделът за преобразуване на текст във видео позволява на потребителите да създават фотореалистични видеоклипове с дължина до една минута във Full HD (1920 × 1080 пиксела) резолюция въз основа на текстови описания.

Според компанията, Sora може да създава „сложни сцени с множество герои, специфични видове движения и прецизни детайли на обектите и фона“. Компанията също така отбелязва, че невронната мрежа може да разбере как обектите „съществуват във физическия свят“, както и „точно да интерпретира реквизита и да генерира убедителни герои, изразяващи ярки емоции“.

Моделът може да генерира видеоклип от неподвижно изображение, да попълни липсващи кадри в съществуващ видеоклип или да го разшири. Демонстрациите, създадени със Sora и показани в блога на OpenAI, включват сцена от ерата на златната треска в Калифорния, видео, заснето сякаш от вътрешността на влак в Токио и други. В много от тях има артефакти, показващи работата на изкуствения интелект.


Например подозрително движещият се под във видеото от музея. От OpenAI казват, че моделът „може да срещне трудности при точното моделиране на физиката на сложна сцена“. Но като цяло резултатите са доста впечатляващи.
Има някои въпроси, свързани с авторските права и етиката.
Става въпрос за това какви данни са били използвани за обучението на Sora, както винаги се случва с тези технологии. От OpenAI не са много разговорливи по отношение на тази информация. Компанията само отбеляза, че са използвани около 10 000 часа висококачествено видео.
Понастоящем Sora е достъпна само за отделни тестери, които оценяват модела за потенциални вреди и рискове. OpenAI също така предлага достъп при поискване на отделни художници, дизайнери и режисьори, за да получат обратна връзка. Компанията отбелязва, че съществуващият модел може да не симулира точно физиката на сложна сцена и да интерпретира погрешно някои случаи на причинно-следствена връзка.
По-рано този месец OpenAI обяви, че добавя етикети към своя инструмент за преобразуване на текст в изображения DALL-E 3. Компанията обаче отбелязва, че те могат лесно да бъдат премахнати. Както и при други продукти с изкуствен интелект, OpenAI ще трябва да се бори с последствията от представянето на фалшиви фотореалистични видеоклипове, генерирани от изкуствен интелект за истински.

Още видеоклипове, генерирани от Sora, можете да намерите тук.
Всичко важно от света на технологиите, директно в пощата ти.
С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.
Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!