Загрузка видео...

Не удалось загрузить видео

На главную

Opus做的中国上下5000年视频,TTS是调用的我本地的模型生成的,TTS拉垮了。后续还是配上Gemini 3.8 TTS,送的API额度不用白不用。

15,376 просмотров • 4 дней назад •via X (Twitter)

Комментарии: 10

Фото профиля Crio Songo
Crio Songo4 дней назад

每个月白给10美元额度真挺良心,Gemini 3.8 TTS效果本来就不错,正好能用。

Фото профиля JingMing
JingMing4 дней назад

背景音乐是opus加的?

Фото профиля Gorden Sun
Gorden Sun4 дней назад

是

Фото профиля bruceamoi
bruceamoi4 дней назад

我感觉怎么我的OPPus5.5点我是假的呀?你们咋做的这么好啊?

Фото профиля Faker2026
Faker20264 дней назад

需要什么提示词呢?

Фото профиля 胖叔万东尼
胖叔万东尼4 дней назад

非常棒!专门做一档节目也完全没问题。

Фото профиля 苏倩
苏倩4 дней назад

gemini 送的吗?

Фото профиля Gorden Sun
Gorden Sun4 дней назад

对,每月10美元 API额度

Фото профиля Peter Zhang
Peter Zhang3 дней назад

Opus做这样的视频需要花多少钱呀?

Фото профиля Gorden Sun
Gorden Sun2 дней назад

只需要订阅Claude即可,其他费用约等于0

Похожие видео

细节的 TTS 技术 Seed-TTS,制作出来的有声书可能要让喜马拉雅的很多主播失业了!支持多种语言。 目前还没看到项目代码或者测试地址,只有论文: 摘要 我们介绍了Seed-TTS,这是一系列大规模自回归文本转语音(TTS)模型,能够生成几乎与人类语音无法区分的语音。Seed-TTS作为语音生成的基础模型,在语音上下文学习中表现出色,在说话者相似性和自然性方面的表现与真实人类语音在客观和主观评估中相匹配。通过微调,我们在这些指标上获得了更高的主观评分。Seed-TTS在各种语音属性(如情感)上提供了卓越的可控性,并且能够为自然环境中的说话者生成高度富有表现力和多样化的语音。此外,我们提出了一种用于语音因子化的自蒸馏方法,即通过让模型自行学习和改进的方式来提高性能,以及一种增强模型鲁棒性、说话者相似性和可控性的强化学习方法。我们还展示了Seed-TTS模型的非自回归(NAR)变体,名为Seed-TTSDiT,它采用完全基于扩散的架构。与以前的基于NAR的TTS系统不同,Seed-TTSDiT不依赖于预估的音素持续时间,而是通过端到端处理进行语音生成。我们证明了这种变体在客观和主观评估中达到了与基于语言模型的变体相当的性能,并展示了其在语音编辑中的有效性。

宝玉

67,886 просмотров • 2 лет назад