Video yükleniyor...
Video Yüklenemedi
有朋友问:MiniMax H3 一次最多生成 15 秒,做短剧的话,段和段之间怎么接才不突兀? 我推荐用 ComfyUI-H3-Motion-Context 的方案,项目中有直接可用的工作流示例。 常见做法是拿上一段的最后一帧去做图生视频。问题是一张静态图里没有运动信息,模型只能猜:人刚才往哪走、多快,全靠猜,所以接缝处经常卡一下或者动作突变。 Motion Context 的做法是:把上一段最后 22 帧(0.92 秒)原样钉在下一段开头,每一步采样都不动它们。模型看到的是真实的运动,不用从一张图去猜。 画面和声音都是直接从上一段的 latent 里切出来的,不用先解码成视频再编码回去,所以不会每接一次就损失一点画质。 生成完,用 Trim 节点把开头这 22 帧剪掉,两段直接首尾拼接,不需要做转场。我逐帧看了接缝前后,角色的姿势、位置、表情都对得上。 最关键的是提示词:下一段开头要先描述上一段是怎么结束的。同一个角色、同样的景别、同样的动作,保持一两秒,再写新的剧情。 项目地址: 我不说的话,谁能看出这30s的功夫熊猫是两段生成的?
40,334 görüntüleme • 1 gün önce •via X (Twitter)
15 Yorum

mc延长我都用了一个来月,这个MV一整段就是用mc延长流对口形一次生成,没有剪辑. 做了一个可以延长10段最大300秒时长的工作流,每段最长30秒,延长十次.

才出来的时候我也分享过,没什么人关注。很早就在我的群文档记录了这个lora。今天又有朋友问起,就又整理了个推文。

可按照真正的影视创作方式,15秒为啥不闭环掉一个完整的分镜,要和下一段连起来呢。 每一段视频的起和落都是完整的,中间有衔接需求的场景一定要放在第15秒吗

这种做法有个问题 如果上一段视频的尾帧出现了另外的人或者场景 那么下一段就会出错。实际上应该在这里加路由 通过抽帧与下一段视频的提示词做结合分析 如果出现多人 新或者新面孔 要分情况处理 默认使用上一段尾帧衔接下一段🤪这是俺用文生视频 首帧参考生视频总结处理的 这样连续生成长视频

这个好 我之前都是让 codex 帮我首尾帧衔接

刚要困觉让人给来了一拳··· 开干。

最难搞的是两个镜头是不连续的,但是需要两次生成

学习了

ありがとう!参考になった!

我其实只要转镜头就会单独生成一次,这样方便改错,切换也不突兀,add guide是一个非常好用的功能

So basically it's FLF2V but with a couple of frames. That's nice to know, thanks!

Existe ainda uma técnica que injeta o contexto global em todos os segmentos pra o modelo entender que tá gerando parte de um longo vídeo e não um vídeo isolado.

感谢你提供的方案

正需要,不知现在本地的h3啥水平了

学习了
