Stability AI опубликовала открытую модель Stable Audio для генерации музыки, звуковых эффектов и окружения.
Stable Audio Open генерирует 47-секундные музыкальные семплы и звуковые эффекты.
К примеру, можно попросить нейросеть создать партию на фортепиано, барабанный бит, гитарный риф, пение соловья или шум дождя. Для генерации надо отправить текстовый запрос.
Пользователи могут генерировать музыку и на своих данных.
К примеру, барабанщик может загрузить записи своих битов и на их основе создавать новые.
В блоге компании рассказали, что открытая модель отличается от одноимённой коммерческой.
Закрытая версия Stable Audio может генерировать трёхминутные треки с проработанной структурой. А также в ней поддерживается режим Audio-to-Audio, в котором в качестве запроса можно передать уже готовый трек.
Модель и вес опубликованы на Hugging Face.
Stable Audio Open генерирует 47-секундные музыкальные семплы и звуковые эффекты.
К примеру, можно попросить нейросеть создать партию на фортепиано, барабанный бит, гитарный риф, пение соловья или шум дождя. Для генерации надо отправить текстовый запрос.
Пользователи могут генерировать музыку и на своих данных.
К примеру, барабанщик может загрузить записи своих битов и на их основе создавать новые.
Закрытая версия Stable Audio может генерировать трёхминутные треки с проработанной структурой. А также в ней поддерживается режим Audio-to-Audio, в котором в качестве запроса можно передать уже готовый трек.
Модель и вес опубликованы на Hugging Face.