Fish Audio最近推出的Fish Speech1.5语音合成模型在多个方面取得了显著进步。
它不仅支持五种新增语言,还具备实时无缝对话功能,用户可以更方便地进行互动。
该模型经过超过100万小时的多语言训练,能够生成高质量的语音合成输出,并在匿名TTS-Arena中获得第二名的好成绩。
零样本和少样本语音合成:只需10到30秒的声音样本即可生成高质量语音。
多语言支持:支持英语、日语、韩语、中文等多种语言,打破语言障碍。
高度准确与快速:在高性能硬件上实现实时语音合成,错误率低至2%。返回搜狐,查看更多