正在加载视频...
视频加载失败
Soprano: An instant, ultra-lightweight TTS model for realistic speech; generates 10 hours of 32kHz audio in <20s; streams with <15ms latency using just 80M params & <1GB VRAM. Has some limitations and drawbacks.
0 条评论
暂无评论
原始帖子的评论将显示在这里
