86 expressive tags and sixteen languages for Alibaba's voice model

Alibaba's Qwen-Audio-3.0-TTS model integrates performance tags to dictate laughter and sighs. An advancement for dubbing in sixteen languages.