两款语音模型分别优化清晰度与低延迟,并支持最短5秒音频快速克隆。
推荐理由:用5至15秒样本即可生成逼真克隆,专业版则以10分钟素材换取更高质量;新增逐字标签能准确念出编码,直接补强实时客服与游戏语音的可用性。
阅读原文