Мислите, че инструментите за изкуствен интелект са в своя пик? Помислете си пак. Музиката, генерирана от изкуствен интелект, вече е факт! Да, прочетохте правилно. Инструментите за изкуствен интелект вече могат да създават музика само с помощта на текстова подсказка. И резултатите са по-добри от това, което може би сте очаквали, след като сте прочели заглавието.
Въпреки това не е като инструментите за изкуствен интелект да могат директно да създават музика. Вместо това музиката се осъществява чрез генератори на изображения на ИИ, които произвеждат спектрограми на музика. След това можете да преобразувате тези спектрограми в аудиоклипове. И така, означава ли това, че в бъдеще музиката, създавана от ИИ, ще замени тази, създавана от човека?
Запознайте се с революцията: ИИ, който може да създава музика
ИИ, базиран на изображения, обучава компютърни алгоритми да откриват снимки на места и обекти. След това алгоритмите се използват за възпроизвеждане на подобни, но уникални изображения. Добри примери за това са DALL-E и Stable Diffusion.
На този етап можете да накарате тези програми да визуализират всичко, което искате. Всичко това чрез текст!

И така, инструментът за изкуствен интелект, който може да създава спектрограми, се нарича Riffusion. Това е най-новият проект за изкуствен интелект и в основата си представлява генератор на текст в изображение, базиран на стабилната дифузия. Но как е станал способен да генерира музика?
Как се появи музиката, генерирана от ИИ?
Зад Riffusion стоят роботистът Хайк Мартирос и софтуерният разработчик Сет Форсгрен. Те искали да проверят дали настоящите програми за изкуствен интелект могат да работят в аудио сферата. И така започва пътуването на Riffusion в създаването на музика. Форсгрен разказва пред PCMag:
Двамата с Хайк свирим в малка група и започнахме проекта просто защото обичаме музиката. Виждайки страхотните резултати от стабилната дифузия за генериране на изображения, се запитахме как би изглеждало използването на дифузионен подход за създаване на музика.
За да разберат това, екипът от двама души обучава стабилната дифузия с отворен код върху изображения на спектрограми. Те били съчетани с текст. След това програмата е била в състояние да създава спектрограми на музика въз основа на определени подсказки.

Първоначално не знаехме дали изобщо ще е възможно архитектурата на модела Stable Diffusion да създаде изображение на спектрограма с достатъчна точност, за да се преобразува в аудио, но се оказа, че може да направи това и дори повече. На всяка стъпка по пътя бяхме все по-впечатлени от това, което е възможно, и една идея води до следващата. – казва Форсгрен.
Може ли генерираната от изкуствен интелект музика да замени създадената от човека?
Тази технология не е в състояние да замени музиката, създавана от човека, но проектът ни показва, че алгоритмите за изображения с изкуствен интелект все още имат много неподозирани възможности. Скоро той може да се превърне в помощник на създателите на музика. Може би, за да получите вдъхновение за песен.
Всичко важно от света на технологиите, директно в пощата ти.
С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.
Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!