Un jour, un outil d'IA générative

StepAudio 3 Music (https://huggingface.co/spaces/stepfun-ai/StepAudio-3-Music et documentation : https://platform.stepfun.ai/docs/en/guides/models/stepaudio-3-music) génère des chansons ou des morceaux instrumentaux à partir d’une description, avec ou sans paroles.

Trois modes proposés :

  • En mode « Song », la description obligatoire, paroles et titre optionnels (si paroles vides le modèle les écrit. Option « Instrumental ».
  • « Vocal to Song » construit un arrangement autour d’une voix a cappella importée (wav, flac, mp3 ou opus).
  • « Song Cover » change le style d’un morceau importé (mêmes formats).

Morceaux jusqu’à 5 min 30 en MP3 (format et débit réglables dans « Advanced »).

Note : interface en chinois et anglais, français accepté pour les paroles.

Gratuit et open source, limites d’utilisations liées à HuggingFace (varient en fonction de la demande sur le site).

Sources :