Video wird geladen...

Video konnte nicht geladen werden

Zur Startseite

兄弟们 炸裂了 这个语音专文本TTS模型 应该是目前对中文支持最好的了 ChatTTS:专门为对话场景设计的文本到语音TTS模型 该模型经过超过10万小时的训练,公开版本在 HuggingFace 上提供了一个4万小时预训练的模型。 专为对话任务优化,能够支持多种说话人语音,中英文混合等。 模型还能够预测和控制细粒度的韵律特征,如笑声、停顿和插话等,还能进行更细粒度的调整,如语速、音调和情感等。 GitHub: 详细介绍:

296,677 Aufrufe • vor 2 Jahren •via X (Twitter)

10 Kommentare

Profilbild von 小互
小互vor 2 Jahren

测试演示:

Profilbild von Adam Carter
Adam Cartervor 2 Jahren

分享下使用教程 1. 到 克隆项目 2. 按照以下方式输入代码 3. 运行(运行时看到缺什么组件就装什么组件) 注意: 1. 尽量不使用特殊的标点符号,甚至引号都会影响生成结果。 2. 多音字还是有点问题 3. 一次生成感觉不好可以多生成几次

Profilbild von JoeDean
JoeDeanvor 2 Jahren

太炸裂了,刚在这里体验了一下,

Profilbild von 知识分享官
知识分享官vor 2 Jahren

3070ti能否一战

Profilbild von Justin
Justinvor 2 Jahren

有 API 就好了,这个东西个人本地使用还有点门槛,显卡并非人人有啊😂

Profilbild von Eric Z
Eric Zvor 2 Jahren

能保持同一个人的语调吗

Profilbild von Jiu Peak
Jiu Peakvor 2 Jahren

网站有错位

Profilbild von 阿外
阿外vor 2 Jahren

语气、节奏、情绪等副语言效果都太赞了,这已经堪比4o voice语音模型的拟人化效果了,还开源👍

Profilbild von Tales
Talesvor 2 Jahren

不需要再找听力材料,直接根据需要,强度生成恰好的即可,N+1学习。

Profilbild von HelloLeo
HelloLeovor 2 Jahren

牛逼的开源项目,未来电话另一头是什么人应该更难区分了

Ähnliche Videos

Google的教学视频《Introduction to Large Language Models | 大语言模型介绍》(中英双语字幕) 这个视频介绍了大型语言模型(Large Language Models,LLMs)的概念、使用场景、提示调整以及Google的Gen AI开发工具。 大型语言模型是深度学习的一个子集,可以预训练并进行特定目的的微调。这些模型经过训练,可以解决诸如文本分类、问题回答、文档摘要、跨行业的文本生成等常见语言问题。然后,可以利用相对较小的领域数据集对这些模型进行定制,以解决零售、金融、娱乐等不同领域的特定问题。 大型语言模型的三个主要特征是:大型、通用性和预训练微调。"大型"既指训练数据集的巨大规模,也指参数的数量。"通用性"意味着这些模型足够解决常见问题。"预训练和微调"是指用大型数据集对大型语言模型进行一般性的预训练,然后用较小的数据集对其进行特定目的的微调。 使用大型语言模型的好处包括:一种模型可用于不同的任务;微调大型语言模型需要的领域训练数据较少;随着数据和参数的增加,大型语言模型的性能也在持续增长。 此外,视频还解释了传统编程、神经网络和生成模型的不同,以及预训练模型的LLM开发与传统的ML开发的区别。 在自然语言处理中,提示设计和提示工程是两个密切相关的概念,这两者都涉及创建清晰、简洁、富有信息的提示。视频中还提到了三种类型的大型语言模型:通用语言模型、指令调整模型和对话调整模型。每种模型都需要以不同的方式进行提示。 原始视频链接:

宝玉

114,690 Aufrufe • vor 3 Jahren