Изследователи от Масачузетския технологичен институт (MIT) успяха да ускорят значително създаването на изображения чрез текстови подкани с помощта на генеративен изкуствен интелект.
Новият метод може да генерира изображения с висока разделителна способност 30 пъти по-бързо от съществуващите.
Генеративният изкуствен интелект обикновено използва техника, наречена „дифузия“, при която се създава размазано изображение и след това то се детайлизира до крайния резултат, максимално съответстващ на това, което изкуственият интелект може да създаде в отговор на заявката на потребителя. Дифузията отнема доста дълго време, затова изследователите от MIT си поставили за цел да я ускорят.

Изследователи от Лабораторията по компютърни науки и изкуствен интелект към MIT са свели генерирането на изображения до еднократно преминаване. Новият метод се нарича „distribution matching distillation“. Очевидно е, че генерирането на изображение в рамките на едно преминаване е забележимо по-бързо от типичните 30-50 стъпки за дифузионните модели. Така модерен инструмент като Stable Diffusion 1.5 създава изображение за 1,5 секунди. Докато новият модел, базиран на DMD, се справя за 0,05 секунди.

Това не е първият опит за ускоряване на генерирането на изображения. Instaflow и LCM опитаха подобен подход, но резултатите не бяха впечатляващи. Stability AI също се опита да ускори дифузионните модели и постигна известен успех със Stable Diffusion Turbo, който генерира до 1-мегапикселови изображения с едно преминаване. Изображенията, генерирани с няколко преминавания все пак бяха забележимо по-добри.
Всичко важно от света на технологиите, директно в пощата ти.
С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.
Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!