正在加载视频...
视频加载失败
国产视频生成框架!能让老黄唱野狼 Disco! 大模型竞技场速报!17小时前发布的 国产 人类视频生成框架—— OmniHuman-1! (一定要开声音看这个视频才震撼!) 这个模型的突破有: 1. 首次实现单模型支持音频/视频/文本/姿态任意组合生成视频,突破现有方法只能单一模式的限制。
11 条评论

karminski-牙医1 年前
2. 超长时间稳定生成,30秒以上没问题 3. 全条件训练"(Omni-Conditions Training)策略,通过混合文本、音频、姿态等多模态条件信号,解决了传统单条件模型数据利用率低的问题。 4. 通过大规模姿态条件数据训练,解决了端到端音频驱动模型中手部抖动/不自然的长期难题。

karminski-牙医1 年前
5. 超强泛化能力,支持非人类图像拟人化动画(如卡通角色)兼容低质量参考图像 项目地址: 论文: 不过模型目前并没有开源。可以等我后续报道进展,如果放出模型我会第一时间放出测评,大家对我的测评速度应该有目共睹 (视频均来自官方项目页面)

Akool Inc2 年前
Choosing between AKOOL and D-ID for AI avatars or voiceovers? Let’s compare the two and help you make the best choice for your AI-powered video production! 🎥✨

颜选1 年前
牛。商业模特这个行业,棺材板上被敲上最后一颗钉

仗贱走天涯1 年前
越来越无趣了。

weipengni7771 年前
第一部AI电影将会很吸金,噱头大,谁会吃第一个螃蟹呢

NiceCamera1 年前
搬运的基本没饭吃了

币安交易所高返佣注册(Parody)1 年前
真是震撼

老猫查档查仁1 年前
👍

notice_u1 年前
@readwise save thread

Qist1 年前
好像是阿里的,开源
相关视频
0:25
Sensitive content
现在图生视频都在5秒或10秒,10秒的看上去像5秒的慢放,这个无论是在开源模型还是闭源模型上都有类似效果。尤其对于商业闭源视频来说,如果花费一倍以上的成本生成的10秒视频却只是5秒的慢放版,那就显得太不划算了。这里尝试一个方案:从商业闭源模型生成5秒视频,然后用插帧模型生成10秒视频,以下是使用Topaz插帧和原生的对比,供 这里尝试一个方案:从商业闭源模型生成5秒视频,然后用插帧模型生成10秒视频,以下是使用Topaz插帧和原生的对比,供大家参考。 #女s #les #女仆 #AI视频
獨自懵逼
20,065 次观看 • 1 年前
