Text to Voice & Voice Cloning
Model Examples:
XTTS-v2, Chatterbox, VibeVoice, ChatTTS, MeloTTS, Mimic 3
Text to Music
Model Examples:
AudioGen, MusicGen, Suno's Bark, Stable Audio Open 1.0, AudioCipher, ACE-Step
Video to Audio
Model Examples:
MMAudio, VATT
Usecase:
Video narration, sound effects, music creation, voice cloning