Video wird geladen...
Video konnte nicht geladen werden
交作业,Heygen+minimax 做数字人太夸张了,我刚才让 codex 参考skill做了一条视频,不过我的minimax复刻的声音好机械呀!
88,729 Aufrufe • vor 1 Monat •via X (Twitter)
36 Kommentare

哇!感谢分享!minimax复刻之后,可以再调!比如语速加快,语气和情绪这些

好哒感谢 我调一调试试

加油👏

可以试试boson的, 这里面同时有avatar + 声音克隆, 可以参考一下 最近还有三十刀免费credit用

声音机械往往不是模型单点问题,而是流程问题:先把长句切成有停顿的短句,再标出重音和情绪,最后用字幕/镜头节奏掩盖少量合成感。这个 skill 如果能把“脚本分句→音色→口型→成片验收”做成可替换节点,会比固定工具链更耐用。

我很早前用minimax,现在被朋友种草豆包语音模型了,你可以试试

你用的2.8模型吧 2.6hd模型最稳定

是的 2.8的 回头试试2.6

这个视频是怎么做的 好想学习一下

我有共学营 要加入吗

@AiMarkdai 可以私我

画面好多了。 节奏还是生硬啊,难搞,配音要是有gpt live的感觉就好了。

节奏是不是脚本的问题

不是脚本,读的很机械,这是AI塑料感。 比如换气,目前就只能这样。

声音机械?试试调高情感参数,或者换种更自然的文本风格看看?

成本如何?

heygen贵一点,不过视频时长短一点也还好

Remotion效果是自己加的吗

里面涉及到的电脑操作你是提前录屏吗?

部分是我录屏 部分是它自己找的

Use HeyGen cloned voice instead 🫡

确实 要试试heygen的音色克隆

声音机械可能是采样率或情感参数没调好,试试调整语速和停顿。数字人现在的唇形同步确实强,但听觉上的自然感还得再磨磨细节。

语音不行

大概的成本呢,想把这个做成解决方案卖给宁静致远这些微信好友

@Zesee 请问这个视频制作用的什么skill啊

@Zesee 我转帖那篇文章里有个整体流程的skill,然后整体风格是我自己设计的

@Zesee 谢谢!我也去试一下

不错耶!这个布景和灯光一看就是下了功夫的!非常逼真

这样一个视频 耗费多少token

MiniMax 你用的哪个音色,感觉 MiniMax 效果还不如 CosyVoice 的女声。

我用自己克隆的

效果可以的!

厉害 好学生

Voice cloning still needs work, honest take

一分钟用了多少钱?
