StepAudio 3 Music
StepAudio 3 Music (https://huggingface.co/spaces/stepfun-ai/StepAudio-3-Music et documentation : https://platform.stepfun.ai/docs/en/guides/models/stepaudio-3-music) génère des chansons ou des morceaux instrumentaux à partir d’une description, avec ou sans paroles.
Trois modes proposés :
- En mode « Song », la description obligatoire, paroles et titre optionnels (si paroles vides le modèle les écrit. Option « Instrumental ».
- « Vocal to Song » construit un arrangement autour d’une voix a cappella importée (wav, flac, mp3 ou opus).
- « Song Cover » change le style d’un morceau importé (mêmes formats).
Morceaux jusqu’à 5 min 30 en MP3 (format et débit réglables dans « Advanced »).
Note : interface en chinois et anglais, français accepté pour les paroles.
Gratuit et open source, limites d’utilisations liées à HuggingFace (varient en fonction de la demande sur le site).




Sources :