Supports dual-person dialogue, emotional vector control, emotional text description, timbre transfer
IndexTTS2/More professional emotional vector control: https://www.runninghub.cn/post/2012710824451772417 (More professional emotional vector control)
LongCat AudioDiT single/dual-person voice cloning TT: https://www.runninghub.cn/ai detail/2039309597042806785 (Ultra-fast generation of the strongest timbre similarity voice cloning)
FishAudio S2 multi-person dialogue/automatic emotion (default dual-person) https://www.runninghub.cn/ai detail/2034547463670992897 (Automatic emotion addition by large language model)