Loading video...

Video Failed to Load

Go Home

发个帖,让那些不相信通过codex能实现长视频自动生成的网友看一下我的工作流是怎么工作的,我的本地H3生成视频的质量和时 是怎么把控的。 1、我早上在codex里下的指令,已运行了一个多小时,全部完成还十几分钟。 2、我通过UU打开远端工作机的comfyui 界面,看正在后台跑的生视频流程。 3、分享一条我的参考生视频提示词,这次是20秒的,确保在8步下不崩不破音。 4、分享一条生成的最新视频,上面有未锁定服装导致的穿帮。 5、分享一条我的人物角色资产。 prompt 视频提示词如下:

16,665 views • 3 days ago •via X (Twitter)

30 Comments

PixelAIGC's profile picture
PixelAIGC3 days ago

prompt 视频提示词: subject_definitions: <Subject 1> is Zhangsun Wuji from the first reference image: male Tang statesman and imperial relative, composed but tense, formal official robe, intelligent cautious eyes. He is not Empress Zhangsun. <Subject 2> is Emperor Li Shimin from the second reference image: mature Zhenguan emperor, muted ocher-red robe, black futou, beard, grave authority. summary: [reference generation] Zhangsun Wuji brings a half cord found in his sleeve; Li Shimin sees black wax like coffin sealing, making the missing seal case more sinister. retention_analysis: <Subject 1> (appears in [Shot 1], [Shot 3]): fully_preserved - Zhangsun Wuji remains a male minister, not the empress. <Subject 2> (appears in [Shot 2], [Shot 4], [Shot 5]): fully_preserved - Li Shimin remains the only emperor. detailed_description: Inner palace side room, cold dawn, a short black-waxed cord on a tray, all symbols unreadable. [Shot 1] Close-up of <Subject 1> alone, presenting the cord with both hands. <Subject 1> (S1) says, <d>[Chinese] 臣袖中,多了这个。</d> [Shot 2] At 00:03.500, close-up of <Subject 2> alone, staring at the cord. <Subject 2> (S2) says, <d>[Chinese] 谁放的?</d> [Shot 3] At 00:06.500, cut to <Subject 1>, fearful but honest. <Subject 1> (S1) says, <d>[Chinese] 臣若知道,就不敢来见陛下了。</d> [Shot 4] At 00:10.500, insert of <Subject 2>'s fingers lifting the cord; black wax flakes fall. <Subject 2> (S2) says, <d>[Chinese] 这不是御印封绳。</d> [Shot 5] At 00:13.500, close-up of <Subject 1>. <Subject 1> (S1) says, <d>[Chinese] 像是封棺的蜡。</d> At 00:17.000, close-up of <Subject 2>, chilled by the implication. <Subject 2> (S2) says, <d>[Chinese] 他不是要开门,是要埋人。</d> overall_soundscape: Tray placed on wood, wax flake falling, low room tone, tense breathing. non_diegetic_music: A very low cello note with a slow drum heartbeat. Negative: no subtitles, no readable text, no wrong speaker, no identity swap, no duplicate emperor, Zhangsun Wuji is male.

PixelAIGC's profile picture
PixelAIGC3 days ago

codex提示词

PixelAIGC's profile picture
PixelAIGC3 days ago

远端工作机的界面

PixelAIGC's profile picture
PixelAIGC3 days ago

我的中控台的界面

PixelAIGC's profile picture
PixelAIGC3 days ago

我的工作流

PixelAIGC's profile picture
PixelAIGC3 days ago

我的技术说明帖

爱玩ai的猫's profile picture
爱玩ai的猫3 days ago

里面一半是自动化晚上我睡觉的时候跑的,

PixelAIGC's profile picture
PixelAIGC3 days ago

厉害,期待大作早日上线,建议边做边播

爱玩ai的猫's profile picture
爱玩ai的猫3 days ago

有点长,估计做完有四五十分钟,很大的工程,显卡不好,跑得很慢,一天最多做五分钟,

PixelAIGC's profile picture
PixelAIGC3 days ago

你生成的原片分辨率比较高,应该在768以上

爱玩ai的猫's profile picture
爱玩ai的猫3 days ago

双采,一采0.3M,二采1.3M,可以跑2M的1920X1088,但是那个慢到家了,实在受不了,我放一个以前跑的2M的你看看,画质确实好,五秒一段,用mc延长流跑了5段,这26秒的视频跑了2个小时才跑出来,

PixelAIGC's profile picture
PixelAIGC3 days ago

我用3060跑过一次1080,5秒差不多用了2小时

爱玩ai的猫's profile picture
爱玩ai的猫3 days ago

🤣跑1M的分辨率其实也可以,在剪映里再调下色,加点滤镜还能看,就是H3有个很严重的问题,远景小脸太糊,2M都没办法解决,

PixelAIGC's profile picture
PixelAIGC3 days ago

用参考图会好一些,官方design 终端效果好很多

生腌 | Evan's profile picture
生腌 | Evan3 days ago

先关注,晚上打飞机的时候再看

PixelAIGC's profile picture
PixelAIGC3 days ago

谢谢

cc chris's profile picture
cc chris2 days ago

只想问现在 ai 短剧收益如何

PixelAIGC's profile picture
PixelAIGC2 days ago

不知道哦,我不是做短视频收益的

澜森's profile picture
澜森3 days ago

很厉害,每天看你做的越来越好了!

PixelAIGC's profile picture
PixelAIGC3 days ago

谢谢大佬鼓励!

景哥|AI落地与智能体实践's profile picture
景哥|AI落地与智能体实践3 days ago

值得看的不是“Codex能不能生成视频”,而是它已经开始从写代码变成持续跑完整工作流。人负责定目标、验结果,剩下的执行交给 Agent,这才是效率真正发生变化的地方。

PixelAIGC's profile picture
PixelAIGC3 days ago

是的,提示词都是codex 直接根据skill 生成,不需要人工编辑

爱玩ai的猫's profile picture
爱玩ai的猫3 days ago

早就用codex来自动生视频了,做好skill,给剧本,codex 自己生场景角色卡,自己写分镜,判断时长,自已调用comfy的api,早上起床收货就行了

PixelAIGC's profile picture
PixelAIGC3 days ago

我这里没有设定场景图和道具图,提示词没锁死服装,所以生成质量差了点。

Aave 🫛's profile picture
Aave 🫛3 days ago

用 codex 调用了那个做视频的工具?还是就是使用的 skill

PixelAIGC's profile picture
PixelAIGC3 days ago

comfyui

Rudresh Upadhyaya's profile picture
Rudresh Upadhyaya3 days ago

The unlocked clothing thing gets us too. Are you locking wardrobe per character asset file now, or per shot?

PixelAIGC's profile picture
PixelAIGC3 days ago

最终的成片是这样的,这是直出的第一版,未作任何二次修改。

superfang119's profile picture
superfang1192 days ago

配音时minimax h3 自动的吗?

th's profile picture
th2 days ago

你不要运行20秒的,20秒一次性就能运行完成。你运行1分钟的试试看,最好是要有参考图的

Related Videos

我来揭示秘密! 1⃣硬件: 我的电脑是4070显卡16G显存,CUP I7-13700内存是32G 2⃣配置技术: 这种配置电脑和显卡本地部署MINIMAX H3生成视频的技术要点: 首先声明一下,我所有的安装和部署是在workbuddy指导下完成的。 1、我选用的是精简版comfyui 2、选用Minimax H3的turbo lora模型 minimax_h3_turbo_4step_ema_ckpt850.safetensors ,可以到HF的用户amirjan122222空间下载,是8月7日左右的版本。 3、选用6步,理论上4步到8步都可以,我选6步是兼顾成品质量和时间 4、分辨率选0.4也就是480P,时长要求是15秒以内,在这个分辨率下我都是20-30秒,为兼顾时间和质量,我选25秒。如果是1分辨率,也就是768P,时长必须在15秒以内,否则要崩,最好是10秒。 5、超分我用的是电脑上已经安装的Topaz Video AI 5.0.2 便携版,超分至1080P,由电脑自动完成,不是人工去做。 6、我用的工作流,和comfyui官方的工作流是一致的,只是在LORA选择上我更喜欢用ckpt850。 7、我让workbuddy为我做了一个系统,在工作电脑上后台运行,这样我在手机上就可以通过浏览器调用,直接输入我的提示词来生成视频,系统会自动超分,超分保存的目录是直接网络共享到百度网盘的,也可以通过浏览器直接预览和下载,不必打开网盘。 8、我的系统已可以实现文生、图生、首尾帧、参考生视频、文生图片等集成功能,下一步是制作导演台,实现多个镜头的编辑,保持一致性,生成几分钟的长视频。 3⃣关于低分辨率视频制作的美学要点 1、由于要从480P超分到1080P,这种情况下,好做的是无人的风景视频、人物的特写、镜头运动较慢的人物腰以上中景构图的画面 2、如果要做人物全身,建议是按照720P或1080P直接出片,这样就要缩短时长,我曾经从3060 12G的显卡制作出1080P的4秒视频,所以,首选是720P超分,时长10秒左右。 3、提示词选用结构性提示词,我让codex根据网上较好的一些优秀提示词进行仿制各种电景风格中的人物对话特写,多用正反打,脸部特写,用微表情和内容生成有一定思想内涵的25秒左右的视频。 4、H3对室内灯光环境中的人物脸部光景刻划非常有立体感,可以尝试。 4⃣工作效率 1、turbo模型,生成480P6步超分至1080P的时间25秒用时大概13至15分钟。30秒用时大概19至21分钟。20秒480P16:9横屏8步已超分1080P耗时13分46秒。10秒720P16:9 横屏8步已超分1080P耗时15分51秒。 2、原版模型,生成8秒720P参考生视频超分1080P耗时23分32秒。5秒480P参考生视频超分1080P,耗时3分33秒 3、失败的尝试:TURBO模型想生成20秒720P8步超分1080P,直接失败。 4、系统交互表单提交的提示词,可以一直排队下去,不需要等前一个完成了再提交,这样极大提高了效率,晚上睡觉前一次性提交30个提示词,等第二天起来一看,已全部生成完毕。 以上是关于近期网友较多留言的回复,有问题可以在这里提问,我将尽量予以回答,我也会在合适的时间在经过认真论证后开源我的系统和工作流。 案例视频是早期我尝试的一个30秒电影复刻视频 prompt 视频提示词如下:🔽⬇️

PixelAIGC

69,426 views • 1 month ago

我从8月初开始在本地部署了MiniMax H3 + Turbo LoRA ,一共部署了三台电脑,最高的配置是4070 16G 显存,其它的是3060 12G显存,4060 8G显存,均能非常流畅地生成视频,6步加速模式下我极限尝试生成过35秒480P视频。通常为确保音画质量均衡,提高一次成功率,我大多用25秒以内480P然后用Topaz 5超分到1080P。如要768P分辨率直出通常是在10秒以内能保证不崩。 我建立了一个自动生成平台,把高算力的电脑设为工作机,通过网页界面由手机或其它电脑通过交互界面输入提示词生成电脑。近来,我通过workbuddy, codex 等Agent来调度算力,只给agent下指令。 比如“生成10段明朝人物的代表性对话,每段25秒,完成后下载并添加分幕图,加封面,配字幕,配片尾图,并验收合格后提交”通常一段25秒的视频生成时间是13分钟多,一部10个片断的片子大概4分多钟时长,要2个多小时,晚上睡觉前提交需求,早上起来就可以看到成片了。这套工作流已基本打通,可复制。我有一天尝试了用14个小时生成了近60首25秒的古诗视频。 生成短剧也可以,就是先生成角色图,再参考生视频,我也尝试生成过10集的短剧,每集一分钟,因为lora状态下视频总是出现字幕,后来这个项目暂停了。 下面我提交一个我正在做的横屏格式的《历史对话合集》系列剧的第一集的一个修正版4分钟样片无背景音乐版,从选题开始到提示词到制作到合成到封装都是电脑自动化生成的。封面封底是image2,其它分幕图是本地zimage生成。

PixelAIGC

19,108 views • 11 days ago