Загрузка видео...

Не удалось загрузить видео

На главную

说个我做了大半年AI 漫剧踩过的坑: AI短剧拍多人戏,最容易崩的根本不是画质,是一换机位人物就全乱了。 你想啊,上一秒三个人好好坐在茶桌前,左边右边都对得上,镜头一切过肩,好家伙,位置、视线、桌子、背景,模型跟失忆了一样,全部重新脑补一遍。 试了好多次才想明白,问题不是提示词写得不够华丽,是根本没给AI一个“稳定的空间”去理解。 这次用的是LibTV的3D导演台,流程大概是这样:先画一张多人站位图,角色、桌子、背景的相对位置先定死;把这张图丢进3D导演台,变成一个能转能换机位的空间蓝图;在这个空间里随便切全景、近景、过肩、俯拍、低角度,怎么切都不乱;最后把这些机位截图转成真实古风剧照,再从剧照生成视频。 说白了核心就一句话:别让模型每次都从一句话里“凭空想象”场景,先把空间关系锁死,剩下的画面质感、表演、运镜交给模型就行。 这样人物不会飘,桌子不会跑偏,镜头切换是真的像有导演在调度,而不是一张张抽卡拼出来的。 我感觉这才是AI短剧从“好看的一张图”往“能讲故事”迈出的关键一步。 7月8号周三晚上8点,我会开一场直播,把整套流程从头到尾拆给你们看。想进群的加微信ponyoassist。

22,295 просмотров • 1 месяц назад •via X (Twitter)

Комментарии: 0

Нет доступных комментариев

Здесь появятся комментарии из оригинального поста

Похожие видео

做 AI 短剧、小说号、AI 视频号的,可以重点看一下这个开源项目,叫 Toonflow-app。 它不是那种「输入一句话,直接给你生成一个视频」的玩具。 那种东西看演示很爽,真要拿来做内容,很快就会发现一地鸡毛:角色不一致,剧情接不上,分镜乱飞,素材越堆越多,最后文件夹里全是废片。 Toonflow 解决的是更前面的事。 它把小说、故事、剧本、角色、分镜、图片素材、视频节点,全部放进一个工作台里。 展示形态更像一个 AI 短剧生产后台,不是单纯聊天框。你可以导入小说,让它拆章节事件,生成故事骨架,再改成剧本,然后进入画布,把角色、场景、镜头、视频生成节点串起来。 这就有点意思了。 AI 视频真正难的,从来不是生成一个 5 秒镜头。 难的是你能不能把一堆镜头、一堆角色、一条剧情线,稳定组织成一个能看的作品。 Toonflow 的核心玩法就是:把「小说到短剧」这条流程拆开,再让不同 AI 模型去处理不同环节。 写剧本用文本模型,出角色图用图片模型,生成镜头用视频模型,最后在工作台里统一管理。 这类项目最适合三种人: 小说号想升级成 AI 漫剧。 短剧团队想降低前期试错成本。 AI 视频创作者想从单条演示,升级成连续内容生产。 说实话,这才是 AI 视频工具接下来该卷的方向。 不是炫一个镜头有多炸,而是能不能把内容稳定做出来。

老杨啊

16,040 просмотров • 3 месяцев назад

真正言出法随的AI视频工具,终于被我找到了!! 而且还是个100%开源的视频世界模型项目! 这个用来做视频真的很高级! 先说一个长期的“痒点”,做AI视频为了保证空间场景的一致性, 不得不生成一大堆各种角度的场景的图片作参考约束, 要确保正反打都不会穿帮,要确保镜头转过去再转回来场景不走形, 但其实,这个方法很原始! 但如果,直接可以生成一个高度一致性的空间, 让人物站在该有的位置,并且还能够自由控制镜头在空间里的运动, 所有一致性的困扰,就全部解决了!! AlayaWorld Alaya Lab 就完全是这个思路, 根据任何图片和视频,实时渲染一个自由空间, 先固化一个场景,然后人物和道具进场,先搭景再拍摄, 这样做视频的体验,就无限接近于真实片场! 你就像一个导演,站在片场里,并且拥有“言出法随”的能力! 改天气、换演员、换服装、甚至直接换场景,可玩性和可控性全部拉满, 突发奇想的指令或者是已经设置好“技能”,就可以实时渲染出来! 而且这个时长不受限制,一个空间里,“拍摄”多久都可以。 想想就很爽,这种创作体验,是前所未有的!! 不光是视频,这也完全是彻底改变游戏行业的存在。 尤其是那种沉浸感很强的第一人称游戏! 越说越激动,这个项目现在是完全开源的, 有兴趣的朋友,真的可以关注一下这方面的趋势, 我觉得在这个探索世界模型的阶段, 这个,就是最好的落地应用!!

沐阳

30,907 просмотров • 1 месяц назад

卧槽,抖音上"给爷爷奶奶修结婚照"这个赛道,怎么闷声做起来了啊??? 一张糊到快看不清的黑白照,修完上色,老两口二十几岁的样子就出来了。评论区清一色一句话:"我也想给我奶奶做一个"。 我盯着看了两天,越看越觉得这事被严重低估了。 因为修图只是入场券。真正没人做的那块是——那一代人根本没有影像。 想想看,我爷爷奶奶结婚那年,全国有几台摄像机?他们上工、结婚、生孩子,一辈子下来就剩两三张黑白照片,一秒钟动态画面都没有。 不是拍得不好,是压根不存在。 所以这不是"修复"生意,是"补拍"生意。 而 Seedance 2.5 现在能干的,就是把那两三张照片里的人,变成会动、会转头、会看着你的人。 我自己上手跑了一遍,踩的坑和方法都留在这: 1、先出"锚点脸",别一上来就生场景。单独生一张正脸参考图,纯灰背景、正面柔光、中性表情,抽到满意为止。这张脸定了,整条片才不会飘。我这两张运气好,各一次就过了,138 秒和 99 秒。 2、去 AI 味靠固定词库,别指望模型自觉。毛孔、绒毛、碎发、左右脸不对称,再补一句"皮肤哑光,不许油光"。我同一条提示词在 gpt-image-2 和另一个通路上各跑了一遍:gpt-image-2 更听话,脸型、发缝、构图全按你写的来,但它会自己把毛孔磨平、把左右脸修对称。这几个词必须往重了写,写轻了压不住它的美化。 3、跨年龄千万别用链式。想让爷爷从 25 岁演到 75 岁,别拿 37 岁那版去生 48 岁那版——一版推一版,脸就慢慢变成另一个人了。每一版都回头引最开始那张锚点图,提示词里只加"眼角细纹、两鬓白发、手背老年斑"这类生理变化,五官一个字都别重新描述。 4、提示词里必须写死"不许看镜头"。这条我是翻车翻出来的:第一版两位老人全程直勾勾盯着镜头,像在拍证件照,一点亲密感都没有。回去翻提示词才发现我压根没禁止。补上一句"两人都不看镜头,是被偷看到的一刻",重跑就对了。 5、不只人要参考图,东西也要。那个年代的搪瓷缸、白毛巾、蓝工装,全都单独出一张,不然道具每个镜头长得都不一样。 说实话这条片我翻车了两轮才成:第一版老两口中间横了一盆绿萝、坐得老远,怎么看都不像夫妻;重写提示词才把椅子并拢。全程一共跑了 11 次生成,最后能用的就 3 条,废了 8 次。抽卡这事真是躲不掉。 但光是这个方向我就觉得夯爆了: 谁没有爷爷奶奶?影楼这个活根本接不了——他们能修照片,修不出一段会动的 1976 年。而给长辈的东西,中国人是最舍得掏钱的。 况且这种场景多的是:父母恋爱那年、已故亲人的动态遗像、家族三代同框、老兵战友重聚......全是人这辈子最舍得花钱、又最没有素材的时刻。 质量越来越高,门槛越来越低,想象空间越来越大。 兄弟们,这个真的大有可为啊!!! 下面是成片👇

超级个体|柿子

92,916 просмотров • 7 дней назад

我愿称seedance2.5为掌管视频的神!!这东西完全已经到了可以商用的地步了... 拍古装短剧,最烧钱的从来不是演员,是打戏。 武行、威亚、场地、保险,一条能用的轻功镜头下来多少钱,做过的兄弟心里都有数。 我昨晚一个人做了一段30 秒的屋顶轻功视频! 从这片瓦跃到那片瓦,中间跨过一整条街,没有武行,没有场地,没有一个人。 这玩意能干嘛?我想了想,能干的事还真不少: 1、短剧打戏。现在古装短剧一集成本压得死死的,打戏经常是第一个被砍的。你要能出这个,就是刚需。 2、国风品牌片。白酒、茶叶、汉服、香道,这帮客户天天张嘴就是"要有意境",但根本请不起团队。 3、游戏和文旅宣传片。那种"高手掠过屋顶"的镜头,以前只能做三维,报价你们懂的🤣 4、做古风账号的素材。讲武侠讲历史的号,最缺的就是画面,天天在网上扒素材。 方法我也放这,就三条最要命的: 1、千万别让它一镜到底。我第一版就是一镜到底,30 秒里就一次跳,出来是飘的,人跟吊威亚一样。改成 20 个镜头快切,节奏立马就对了。 2、每个镜头都得让他朝同一个方向跑。这一镜朝左下一镜莫名其妙朝右,是剪过的 AI 动作片散架的头号原因,专业叫越轴。所有机位都留在他跑动路线的同一侧,一次都别越。 3、多给特写。脚踩瓦、袖子翻卷、落地扬尘——这些细节在全景里根本看不见。0.8 秒一个特写砸进去,"真实感"就出来了。 说实话第一版翻得挺惨的。我让他穿宽袍、走一镜到底,结果落地那两秒人形直接没了,画面上就剩一堆白布铺在屋顶上,我看了半天没找着人在哪😅 这个事是真能干啊,成片👇 虽然没打磨太多,但是我觉得已经到了那个水平了,稍微打磨打磨这件事绝对能干啊!

超级个体|柿子

106,130 просмотров • 9 дней назад

好玩,真的好玩。 我很久没因为一个 AI 工具这么“爽”过了。 刚刚我花了几分钟,给我不到 3 岁的女儿,把她最喜欢的绘本《长个不停的腿》做成了一个动画视频。 不是 PPT,不是剪辑拼贴,而是完整的绘本动画。 她坐在那儿看得特别认真,一直笑。 那一刻我突然意识到: 原来视频创作,真的可以变得这么轻。 说实话,这多少有点“大材小用”。 很多人用这个工具是在做商业级的视频:企业宣传片、广告、科普、故事短片那种。但架不住孩子喜欢,我已经打算把她喜欢的绘本都做成动画存手机里了。 画风是真的漂亮,能明显感觉到底层用的是很顶级的生图 / 视频模型。 关键是—— 整个过程几乎不需要“操作”。 我是先用 GPT 帮我生成了一段故事提示词,然后直接丢进 -- 比例 -- 时长 -- 声音 剩下的事,它自己全干完了: -- 拆分镜头 -- 生成分镜 -- 出视频 -- 剪辑拼接 -- 配音 + 背景音乐 ✅一气呵成。 更爽的是,你可以一边用 AI,一边随时“插手”。 比如某个画面不喜欢,直接跟它说; 想整体换文案、改节奏、换感觉,全程就是聊天。 这种「言出法随」的体验,真的会让人上头。 做科普、做故事、做广告片,甚至接单子,我觉得都完全没问题。 你只有真正用过一次,才会明白这种感觉。 我就一句话: 你自己试试就知道了。 👉

鱼总聊AI

20,643 просмотров • 7 месяцев назад

这个Skill真的让我看到了一个人干翻一个动画工作室的可能性,我用它做了个DeepSeek V4-Flash的视频, 一个人,一条指令,40块钱,2分钟电影感动画科普视频。 不是那种一眼AI的垃圾。是角色不崩、声音一致、镜头有语言、旁白有节奏的正经片子。 这东西叫animated-voiceover,刚开源,MIT协议。作者是前字节产品经理sida,他自己已经用这套东西在小红书起号了。 它不是软件,不是App,是一套喂给Codex/Claude Code的完整制片流程。你就跟它说一句:"用animated-voiceover做一条两分钟关于确认偏误的动画科普",剩下的Agent按流程给你跑: 先研究,写完整旁白, 锁视觉风格参考图,锁角色参考图。 每15秒拆成5个镜头,每个镜头写清主体、变化、镜头运动。 先生成第1段,把人声提出来,48kHz立体声WAV锁死。 后面所有片段全部挂这同一个人声参考——声音飘的问题,工程化解决了。 逐段QC,旁白完整性、角色一致性、构图、运动,不合格重来。 最后拼成片,做封面。 最狠的是它解决问题的方式,全是工程思维,不是玄学。 AI视频最大的痛点是什么?声音每段都不一样,角色脸走着走着就变了,镜头之间没有逻辑。 他怎么干的?先做第一段,把人声锚定,后面全挂这个参考。 一张风格图贯穿全片,每个角色独立参考图+角色表管理。 旁白写完再切,中文卡到每15秒60个字,多一个少一个都不行,信息密度均匀,不机械。 这不是"帮我生成个视频",这是把一个专业动画导演脑子里的制片流程,变成了Agent可以执行的Skill。 一条2分钟的片子,LibTV跑下来大概40块钱。一个人,一个下午,从选题到成片。以前这活儿得一个团队干一周。 作者反复强调一句话:90%自动化,但那10%人的判断决定上限。你定选题、定风格、卡审批,剩下重复的、容易出错的、熬人的,全交给Agent。 这才是Agent Skill该有的样子, 不是跟你聊天,不是帮你写个Prompt,是把一整条专业生产管线——从研究到脚本到分镜到渲染到QC到成片——封装成一个你随时可以调用的能力。 知识博主、超级个体、想做深度内容但不会动画的人,这个东西的价值怎么强调都不过分。B站、小红书那些电影感科普号,以前得团队作战,现在一个人就能干。 GitHub搜s1dashu/animated-voiceover,SKILL.md和references目录里全是干货,旁白怎么写、分镜怎么拆、声音怎么锁、Seedance的提示词怎么用,全给你摊开了。 别再问AI能不能替代内容创作者了,会用这种工具的创作者,正在替代不会用的。

AYi

20,833 просмотров • 28 дней назад

玉伯之前发了一条推文,说问了很多牛人下一个大模型会有什么惊艳发布,其中一个预测是:可实时生成的视频。 其实我当时没太理解什么是实时生成视频,直到我看了 PixVerse R1 的演示视频,实际体验了一把,才算是理解了什么是实时生成视频,以及它带来的想象空间有多大。 PixVerse R1 可以说是全球首个实时生成模型了,是 PixVerse 自研的大模型。 如果你看了这个视频演示,你会发现它和传统的 AI 视频生成完全不是一回事。演示里是一个"魔法水族箱",金鱼在水草间游动,你打一句话,画面立刻响应。输入"一只小龙虾",红色的鳌虾就趴在石子上了;打"几只蓝色小水母",半透明的水母就漂出来了;说"一条鲨鱼",鲨鱼就从左边游进画面。不是生成完再播放,是你说一句、它变一帧,像在跟视频对话。 更厉害的是复杂交互。你打"一只手伸进去抓鱼",真的有只手从上方探入水中捞鱼;说"用渔网捞",绿色的捞网就出现把金鱼网住了。场景也能随便加——"出现一艘沉船",海盗船模型就沉在鱼缸里了;"掉进去一个棒棒糖",红白旋涡的巨型棒棒糖就躺在石子上,超现实。最离谱的是你还能控制镜头:打"镜头拉远,一个孩子正在看水族箱",视角瞬间从鱼缸内部切到外面,一个小男孩背对着你站在水族箱前。 在实际体验的时候,我也发现一个问题:人的反应速度跟不上视频生成的速度。AI 生成太快了,我写提示词的手速跟不上。但这应该不是大问题,完全可以语音指挥,让 AI 来实时写提示词。 实时生成这个方向打开的想象空间太大了。 直播?想象一下,主播说“今天心情好,给我换个海边背景”,下一秒人就站在马尔代夫的沙滩上了。弹幕刷“下雨”,雨就下了;刷“放烟花”,天上就炸开了。观众不再是观众,是共创者。 游戏?你对着屏幕说“我要进一个赛博朋克风格的酒吧”,酒吧就生成出来了,霓虹灯、全息广告、调酒机器人,全是根据你那句话现编的。不需要提前建模,每个玩家看到的世界都不一样。 教育?老师讲二战诺曼底登陆,不用再放 PPT 了,直接说“给我生成一段盟军抢滩的画面”,学生眼前就是士兵跳下登陆艇、冲向海滩的场景。讲到哪,演到哪。 互动影视?男女主角站在分岔路口,观众投票往左走还是往右走,视频实时往那个方向演下去。每个人看到的结局都可能不一样。 这模糊了视频和游戏、直播、互动内容的边界。视频不再是“做好了给你看”的东西,而是“你说了算”的东西。 PixVerse R1 作为第一个吃螃蟹的出现了,接下来看谁跟上。 如果你能实时控制视频里的一切,你第一个想玩什么?

宝玉

78,956 просмотров • 7 месяцев назад

这是美国大学毕业季 最诚实的一场演讲 也是AI时代最引人思考的 关于教育的一场讨论💐 Angela Duckworth 一位哈佛毕业的网红教授 专门研究毅力的顶级学者 在宾大的毕业典礼上 一句话炸翻了全场 今天的演讲(稿) 是我和AI一起写的!😂 而且我一点儿也不惭愧 这太魔幻了 一个教孩子要坚毅要刻苦的 居然在带头“偷懒” 但是她接下来说的话 才是我反复该说的部分 就是这篇人机协作的演讲稿 给出了AI时代家长心里最担心的 两个问题的答案 第一个问题 孩子天天用AI,脑子会不会废掉? 扫了一眼台下的毕业生 问了一个戳心的问题 如果我们一直这么用AI 会变得越来越不会思考 她自己呢带头就举了手 台下呢也几乎是全员举手 Angela接着说 她自己呢也担心过 因为大脑是用尽废退 不用的话神经连接都会萎缩 她讲了一个故事 她被一个很难的 统计学方法卡住了 当时呢身边没有人能够帮她 在客厅里做着 房地产相关的工作 于是她打开了GPT 就把问题呢告诉它 结果AI只用了几句话 就把这个复杂的问题讲清楚了 不但讲清楚了 还提醒她常见的误区 给了清晰的步骤 她对不懂的地方进行追问 让AI示范 短短十分钟之后 她不仅仅是拿到了答案 而且真正的理解了 注意她的关键词啊 不是替我想 而是带我想👊 她又问台下的毕业生们 你们有没有哪怕一次 真切的感受到 因为AI比你之前聪明了一点点? 这一次又是几乎全员举手🙋‍♀️ 同样的一群人 同样的一双手 可以是害怕AI让我变笨 也可以是因为AI 让我变强🐮 她又用博士生的实验补了一刀 两组年轻人写求职信 一组呢完全自己写 另一组呢 用AI辅助 结果非常反常识 用AI那组不但写的更快 就连写作能力也提升的更多 为什么? 给出了一个关键解释 因为AI在做一件 人类老师一直想做 但没有精力去做的事 它会不停的给你看更好的版本 这个句子可以更短 那个词可以换 这个结构呢还可以调整 你就一遍一遍的看这些示范 就是在训练自己的眼睛和感觉 所以结论很简单 也很有力量👍🏼 AI会不会废掉孩子 并不取决于AI有多强 而是取决于我们把它当什么 当你把AI当拐杖 你交出的就是大脑 当你把AI当教练 你练出来的就是判断力、表达力、结构感 AI的正确打开方式 不是把脑子托管给它 而是用它不断的看到更好的思考 然后呢逼自己追上去 第二个问题 既然知识和课程网上全有 AI又能给出答案 那我们为什么还需要老师? 教育为什么还需要人? 在学期末 说这样一个秘密 这整个学期 我教给你们的所有知识网上全都有 每一篇文章都有电子版 每一道作业都有人做过类似的 换句话说就是 只要你愿意不来上我的课 你照样能学 学生们呢?都愣住了 然后她说 但是你们还是需要我 因为你们需要有人在周二之前 逼你读完一篇并不轻松的文章😂 需要有人在周四之前 提醒你们交出一篇 你们以为自己写不出来的论文🥹 需要有人把你关进一个没有手机的教室 需要有人给你定一个 你以为达不到的标准 然后认真的看着你的眼睛说 我知道你能做到 我会等到你做到!👍🏼 这一段看起来安安静静的话 简直是一下子戳中了 教育的本质 教育从来都不是信息的填充 而是灵魂的唤醒!👍🏼💐 她讲到自己高中那位英语老师 图书馆的知识是免费的 但是你得自带容器 而一个真正的好老师 就会帮你塑造这个容器 我突然想到了我的孩子们 AI可以把全世界的知识 都摆在他们的面前 但是它做不到的是 在他们快要放弃的时候 坚定的看着他们的眼睛说 这很难 ☹️ 但我相信你 对于孩子们来说 爸爸妈妈 才是他们最早遇到的老师 那位Angela老师 在这个算力爆炸的时代 我们到底要教给孩子什么? 用AI的方法 当然 但比这个更重要的是 带他们去户外徒步 去仰望星空 去面对挫折 去感受心跳 我们要做的是站在孩子的身边 成为赋予他们品格的那个人 如果你有时间 强烈建议你和孩子一起看一下这个演讲 ———————————— 演讲就在下面,快看看啊 有这么想讨论的一起聊聊吧😊

华尔街财经 | WS × AI Era

43,968 просмотров • 6 месяцев назад