Загрузка видео...

Не удалось загрузить видео

На главную

想做 AI 漫剧?先搞懂最大难点:场景调度 你有没有发现,AI 做多人打斗视频的时候,最容易乱的不是招式。而是人物一多,镜头就不知道该跟谁,空间也开始对不上。 这条视频我想讲的就是一个很实用的方法: 先不要急着写“飞身、挥刀、闪避”这些动作词。 先把场景画成一张 3D 俯视动线图。 谁从哪边进来,镜头从哪里推进,危险点在哪里,人物最后要往哪边走,都先在图上定清楚。 这样 AI 生成的时候,它拿到的就不是一句模糊的“打一场很燃的戏”,而是一张能拍的导演地图。 多人打斗想不乱,第一步不是加动作,是先控场。 这条可以当成一个小方法,以后做动作戏、舞蹈戏、多人调度都能用。 #AIGC #AI导演 #即梦AI #AI短片 #场景设计 #分镜设计

13,378 просмотров • 2 месяцев назад •via X (Twitter)

Комментарии: 0

Нет доступных комментариев

Здесь появятся комментарии из оригинального поста

Похожие видео

真正言出法随的AI视频工具,终于被我找到了!! 而且还是个100%开源的视频世界模型项目! 这个用来做视频真的很高级! 先说一个长期的“痒点”,做AI视频为了保证空间场景的一致性, 不得不生成一大堆各种角度的场景的图片作参考约束, 要确保正反打都不会穿帮,要确保镜头转过去再转回来场景不走形, 但其实,这个方法很原始! 但如果,直接可以生成一个高度一致性的空间, 让人物站在该有的位置,并且还能够自由控制镜头在空间里的运动, 所有一致性的困扰,就全部解决了!! AlayaWorld Alaya Lab 就完全是这个思路, 根据任何图片和视频,实时渲染一个自由空间, 先固化一个场景,然后人物和道具进场,先搭景再拍摄, 这样做视频的体验,就无限接近于真实片场! 你就像一个导演,站在片场里,并且拥有“言出法随”的能力! 改天气、换演员、换服装、甚至直接换场景,可玩性和可控性全部拉满, 突发奇想的指令或者是已经设置好“技能”,就可以实时渲染出来! 而且这个时长不受限制,一个空间里,“拍摄”多久都可以。 想想就很爽,这种创作体验,是前所未有的!! 不光是视频,这也完全是彻底改变游戏行业的存在。 尤其是那种沉浸感很强的第一人称游戏! 越说越激动,这个项目现在是完全开源的, 有兴趣的朋友,真的可以关注一下这方面的趋势, 我觉得在这个探索世界模型的阶段, 这个,就是最好的落地应用!!

沐阳

31,087 просмотров • 1 месяц назад

做 AI 短剧、小说号、AI 视频号的,可以重点看一下这个开源项目,叫 Toonflow-app。 它不是那种「输入一句话,直接给你生成一个视频」的玩具。 那种东西看演示很爽,真要拿来做内容,很快就会发现一地鸡毛:角色不一致,剧情接不上,分镜乱飞,素材越堆越多,最后文件夹里全是废片。 Toonflow 解决的是更前面的事。 它把小说、故事、剧本、角色、分镜、图片素材、视频节点,全部放进一个工作台里。 展示形态更像一个 AI 短剧生产后台,不是单纯聊天框。你可以导入小说,让它拆章节事件,生成故事骨架,再改成剧本,然后进入画布,把角色、场景、镜头、视频生成节点串起来。 这就有点意思了。 AI 视频真正难的,从来不是生成一个 5 秒镜头。 难的是你能不能把一堆镜头、一堆角色、一条剧情线,稳定组织成一个能看的作品。 Toonflow 的核心玩法就是:把「小说到短剧」这条流程拆开,再让不同 AI 模型去处理不同环节。 写剧本用文本模型,出角色图用图片模型,生成镜头用视频模型,最后在工作台里统一管理。 这类项目最适合三种人: 小说号想升级成 AI 漫剧。 短剧团队想降低前期试错成本。 AI 视频创作者想从单条演示,升级成连续内容生产。 说实话,这才是 AI 视频工具接下来该卷的方向。 不是炫一个镜头有多炸,而是能不能把内容稳定做出来。

老杨啊

16,040 просмотров • 3 месяцев назад

我把 AI 解说视频,彻底做成了一条“无人流水线” 丢进去文案和声音,后面的配音、分镜、画面、字幕、合成基本全自动 开源 4 天,350+ Stars,1000+ 人收藏。今天一次性把 cs-board 的全部功能讲透 并且新增加了自媒体封面修改功能,内置十种风格(还可以diy)还有市面上所有封面的尺寸(图二)👇 cs-board已经从一个 AI 白板视频工具,越改越像一个真正的 AI 内容生产工作台 以前用 AI 做一条内容,流程基本是这样的: 写文案 → 找模型改稿 → 克隆声音 → 拆分镜 → 生图 → 调风格 → 做动画 → 加字幕 → 做封面 → 导出 问题不是 AI 不够强 而是: 每一步都很强,但每一步都是孤岛 你要不断复制粘贴、切工具、重新上传素材、重新解释人物是谁、重新告诉模型你要什么风格 最后不是 AI 在替你工作,而是你成了 AI 工具之间的“人肉 API” 所以 cs-board 现在做的事情,本质上不是继续堆 AI 功能 而是把这些步骤做成一个有状态的内容生产工作台 1️⃣ 为什么我没有直接做“一键生成视频” 因为真正影响内容质量的,从来不是“一键” 而是中间状态能不能被控制和复用 比如现在 cs-board 生成一条视频,中间会留下: 配音 → 分镜 → 图片 → 分段视频 → 最终成片 这些都不是一次性的临时结果,而是检查点 假设你已经生成完所有图片,只是觉得字幕位置不对 正常 AI 工作流可能又得重新跑一遍 cs-board 不需要 直接从后面的渲染阶段继续 前面花过的钱和时间不重新花 我越来越觉得,AI 工具真正应该优化的,不是“第一次能不能生成”,而是: 第 17 次修改的时候,你还需不需要从头来一遍 2️⃣ 动态信息图为什么不是“让 AI 生成一张 PPT” 这个功能我改得比较久 因为我发现很多所谓 AI 视频,本质都有一个问题: 画面和人声是脱节的 旁白还没讲到第三点,画面已经把五点全部展示出来了 观众其实根本不会跟着你的表达走 所以 cs-board 的动态信息图不是: 文案 → HTML → 视频 而是先把真实旁白做成一个语义时间轴 一句话什么时候开始说、哪个关键词什么时候出现、哪个知识卡片什么时候展开,都跟实际音频绑定 所以画面不是按照“程序跑到第几秒”出现 而是: 你讲到哪,它才出现到哪 这其实是我现在做 cs-board 比较核心的一个思路: AI 负责理解内容,程序负责保证确定性 能交给代码控制的东西,我越来越不想交给模型猜 3️⃣ 为什么人物和画风要单独抽出来 以前最大的问题之一就是一致性。 第一张图是这个人。 第二张开始脸就变了。 第三张甚至连画风都换了。 所以现在自定义模式里,我把两件东西单独抽出来: 人物参考 + 风格参考。 可以放固定 IP,也可以放自己的品牌视觉。 人物最多可以提供多张参考图,风格也作为独立条件贯穿整个任务。 这意味着 cs-board 不只是帮你“生成一条视频”。 更重要的是: 它开始能够持续生产属于同一个 IP 的内容 对于真正做账号的人,这个区别非常大 4️⃣ 最近我又把封面也塞进去了 因为做完视频以后,我发现自己还得打开另一个工具做封面。 那干脆继续 Coding 现在封面制作直接放进工作台 粘贴文章 / 帖子内容以后: 自动理解内容 → 提炼标题 → 选择构图 → 生成人物与视觉 → 输出封面。 我没有只给一个“生成封面”按钮 而是先做了 10 种专业封面构图 因为封面的核心根本不只是图片好不好看 而是: 标题放哪、人物放哪、视觉重心在哪、第一眼先看到什么 构图是确定性的,审美才交给模型 这和前面动态信息图其实是同一套逻辑 5️⃣ 现在这个工作台正在慢慢变成什么 目前已经逐渐放进来了: 白板视频 / 自定义人物与画风 / 动态信息图 / 文案改写 / 对口型视频 / AI 封面制作 视觉模板现在也已经扩到了 12 套 音色克隆可以接本地 IndexTTS 任务、素材、配置、历史和成片默认都放本地 甚至同一个局域网里的电脑,可以共享制作队列 这也是我现在给 cs-board 定的方向: 不做一个 AI 视频生成器。 做一个可以不断往里面塞能力的 AI 内容生产工作台。 目前项目继续开源: 现在功能还远远没做完,下一步正在接入数字人工具 如图P3 但我觉得这条路,比继续做一堆“一键生成 XX”的小工具有意思多

陈硕KAI(耍门)

30,270 просмотров • 16 дней назад

Claude Opus 4.8 出了之后,我的第一反应是:想试。 第二反应是:算了,token 这东西真的不经烧。 结果看到 ZenMux 现在可以体验 Opus 4.8,就拿它试了一个我最近一直想做的小东西。 我自己有个很真实的问题: 脑子里经常冒出各种产品想法。 但每次真要开始做,就会卡住。 用户是谁? 第一版到底做什么? 哪些功能应该先砍掉? 怎么定价? 第一周从哪一步开始? 上线后怎么找第一批用户? 想法很多,执行很散。 所以我让 Claude Opus 4.8 做了一个「一人公司作战室」。 需求我写得也挺直接: 输入一句产品 idea。 自动拆出产品定位、MVP、开发任务、定价方案。 再生成落地页文案、冷启动实验、风险清单和本周计划。 最好不是一个静态页面,而是真的能点、能改、能导出。 然后我就把这段话丢给 Claude Opus 4.8。 出来的效果比我预期好不少。 它真的把“一人公司怎么从想法走到执行”这件事拆开了。 左边输入产品想法。 中间生成产品蓝图、MVP 范围、定价和官网文案。 右边是任务看板和本周计划。 底部还有冷启动实验、风险雷达和 Markdown 导出。 最让我觉得有意思的是,它不是一味堆功能。 比如我输入“给小红书博主做 AI 选题助手”,它会主动判断: 第一版必须做什么。 哪些功能看起来高级,但现在应该先别碰。 怎么找第一批真实用户。 哪些风险可能让这个项目做不下去。 这点就很能体现 Opus 4.8 的能力。 普通模型经常是:你要什么,我全给你加上。 最后页面很热闹,但产品判断是空的。 Opus 4.8 更像是在帮你收敛:先想清楚用户、场景和第一步,再把它变成可以执行的工作台。 我是在 ZenMux 上试的。 它比较方便的一点是,一个 Key 就能切不同模型,新模型上线也很快。 Opus 4.8 拿来做这种带产品判断、交互状态和复杂信息结构的网页,确实挺顺。 想试 Claude Opus 4.8 的,可以从这里进:

Joruno

16,224 просмотров • 3 месяцев назад

如何用 AI 做视频——运镜教学 运镜别再乱推拉了!今天波妞用二十四节气把镜头讲明白 很多人一做多景别,镜头就开始忙了。 近景推一下,远景拉一下,人物一走再跟一下。 看起来每个镜头都在动,但剪到一起反而更乱。长镜头尤其明显:镜头转了一大圈,观众却不知道该看哪里。 其实运镜不是“让镜头一直动”。 它真正要做的,是带着观众的眼睛走。 所以我最近换了一个特别有意思的练习方法: 用二十四节气学运镜。 为什么偏偏是二十四节气? 因为节气本身就带着时间、空间和情绪变化。 夏至的荷塘,是水面、荷叶和小船之间的层层递进;小满的青麦田,重点是田埂向远处延伸的纵深;到了芒种,麦浪变成金黄色,画面也从“生长”进入了“收获”。 同样是乡野场景,只换一个节气,镜头的速度、方向和落点就会跟着变化。 这样练,比单独背“推、拉、摇、移”好记太多。 夏至这一段,我会先用横移或者轻摇建立环境,再慢慢把视线送到小船、荷花这些主体上。 镜头不急着交代答案,而是让观众自己走进画面。 小满更适合练推进和跟随。 顺着田埂向前走,前景的麦穗、中景的人物、远处的房子会自然形成三个景别。 一个镜头,就能把空间关系讲清楚。 到了芒种,画面更加开阔,颜色也更有重量。 这时候可以用拉远、升高或者小幅环绕,把人物从主体慢慢放回整片麦田里。 情绪也会从“看见一个人”,变成“看见一个季节”。 后面我会把常用运镜大概整理成这几类: 1⃣直线轨迹:推、拉、横移,重点是改变距离和景别。 2⃣弧线轨迹:环绕、弧形跟拍,重点是交代人物与空间的立体关系。 3⃣纵向轨迹:升、降,适合从局部打开环境,或者给画面一个更有余韵的收束。 4⃣复合轨迹:比如“推进加环绕”“拉远加升高”。但一定要先确定一个主方向,别让几个动作一起抢戏。 你可以把运镜理解成三个问题: 从哪里出发? 带观众看什么? 最后停在哪里? 只要这三个问题是清楚的,镜头就不会乱。 它真正好用的地方,是把抽象的镜头轨迹,变成我们能够看见、能够感受到的时间变化。这就是我想做这套运镜分享的原因。 后面还会继续把不同节气拆成具体镜头案例。这篇建议先收藏,拍多景别和长镜头的时候,可以直接拿出来对照。 #AI视频 #运镜教学 #镜头语言 #二十四节气 #视频剪辑 #AIGC创作 #长镜头 #分镜设计

波妞PONYO

13,948 просмотров • 2 месяцев назад

AI视频,99%的人都忽略的…… 首先给你看今天的案例视频,这是我们去年日本的合作伙伴给一个日系服装进行的demo设计,目前已经成交,所以demo可以放出。我今天想要说的是,你先看完这个视频,然后你问自己一个问题,这个视频给你的感觉是什么?为什么会有这种感觉,那么AI在这里又扮演了什么角色? 99%在做AI视频的时候,会考虑情节、人物、钩子、分镜、音乐、音效、滤镜,但是很少人会注意到一个原生的影响视频质量的地方——配色! 我昨天在直播时也曾经说到这个问题,我关注的都是一个元素,包括汤姆和杰瑞的背景配色,是互补色还是同类型颜色。其实很多视频在一开始就已经决定了你是不是能过关。 这支demo很巧妙的是,我在设计的时候,故意利用nano banana pro的修图功能,把色调都调成了粉蓝分红的对撞色,但又不像AI做的,好像现实中就真的有这样的场景,这才是最考验人的。包括人物的服装配饰都是遵循这样的配色,整体非常干净协调,给人一种很舒服的感觉。这和甲方需要体现的舒适衣服的概念是很匹配的。 再次要说的是,我用AI做视频所追求的是,不像AI,无限接近于实拍,所以我会故意加上噪点,加上电影的压边,加上手持抖动。只有用AI生产不像AI的东西,才能产生高溢价。

肖师傅

38,573 просмотров • 8 месяцев назад

很多人一聊到选哪条链?第一反应都是: 热度高不高?补贴多不多?生态有没有流量? 但今天听了 Talus 🐸 CEO Mike Hanono 和 The Rollup 的视频会议,我反而有种感觉:这不是在给 Sui 站台,更像是一场技术自白。 首先Talus 选 Sui,真的不是因为它现在火。而是因为 Talus 想做的这件事,在别的链上,很难跑得像样。先说清楚一点:Talus 要做的不是一个 AI 应用,也不是几个 bot、几个策略脚本。它想做的是——一个大规模、自主运行的代理网络:成千上万个代理同时运行、同时决策、同时交互。光是这个前提,就把底层链的门槛直接拉满。 为什么是 Sui?我听下来,核心其实就三点。 第一,并行执行。代理世界不是排队点菜,不是你先我后那种单线程逻辑。代理一多,如果底层还是串行执行,结果只有一个:越跑越卡,最后只能做 demo。Sui 的并行执行,本质上就是为“多主体同时操作” 这种系统准备的,这点和 Talus 的形态非常贴合。 第二,高吞吐量。代理不是偶尔动一下,而是持续、高频地产生状态变化。TPS 要是撑不住,所有“自主”“实时”都会变成慢动作回放。对 Talus 来说,吞吐量不是加分项,是能不能活下来的前提条件。 第三,移动端和安全模型。这一点很多人会忽略。未来代理不只在服务器、交易后台跑,它一定会越来越靠近用户。Sui 在账户模型和安全设计上,本身就更像现代应用,而不是早期 DeFi 那套「钱包就是一切」的逻辑。 所以当 gmike 说“我们一直都是 SUI Maxis”,我反而觉得这句话挺克制的。这不是情绪站队,而是工程师视角下的现实选择。至于多链?我自己的理解是:Talus 不是不懂多链,而是很清楚——在基础设施阶段,过早多链只会把复杂度放大。尤其是代理这种高度耦合、强调协同的系统,先把一个底层跑通、跑稳,比到处铺点重要得多。很多项目喜欢先讲“未来多链叙事”, 但真正做底层的人,往往会先问一句:现在这个系统在哪条链上能真正跑到规模?从这个角度看,Talus 的选择是理性的,也是偏长期的。不追热点,不抢流量,先把代理世界里最难的那一块解决掉。这种项目短期不一定最热,但一旦真跑起来,后面的持续热度,反而会非常高。 Kaito AI 🌊 #Yapping #MadewithMoss MOSS #Starboard Galxe River River4FUN 🐝

百里 🌊RIVER | MemeMax⚡️|🧠SENT

13,710 просмотров • 9 месяцев назад

我愿称seedance2.5为掌管视频的神!!这东西完全已经到了可以商用的地步了... 拍古装短剧,最烧钱的从来不是演员,是打戏。 武行、威亚、场地、保险,一条能用的轻功镜头下来多少钱,做过的兄弟心里都有数。 我昨晚一个人做了一段30 秒的屋顶轻功视频! 从这片瓦跃到那片瓦,中间跨过一整条街,没有武行,没有场地,没有一个人。 这玩意能干嘛?我想了想,能干的事还真不少: 1、短剧打戏。现在古装短剧一集成本压得死死的,打戏经常是第一个被砍的。你要能出这个,就是刚需。 2、国风品牌片。白酒、茶叶、汉服、香道,这帮客户天天张嘴就是"要有意境",但根本请不起团队。 3、游戏和文旅宣传片。那种"高手掠过屋顶"的镜头,以前只能做三维,报价你们懂的🤣 4、做古风账号的素材。讲武侠讲历史的号,最缺的就是画面,天天在网上扒素材。 方法我也放这,就三条最要命的: 1、千万别让它一镜到底。我第一版就是一镜到底,30 秒里就一次跳,出来是飘的,人跟吊威亚一样。改成 20 个镜头快切,节奏立马就对了。 2、每个镜头都得让他朝同一个方向跑。这一镜朝左下一镜莫名其妙朝右,是剪过的 AI 动作片散架的头号原因,专业叫越轴。所有机位都留在他跑动路线的同一侧,一次都别越。 3、多给特写。脚踩瓦、袖子翻卷、落地扬尘——这些细节在全景里根本看不见。0.8 秒一个特写砸进去,"真实感"就出来了。 说实话第一版翻得挺惨的。我让他穿宽袍、走一镜到底,结果落地那两秒人形直接没了,画面上就剩一堆白布铺在屋顶上,我看了半天没找着人在哪😅 这个事是真能干啊,成片👇 虽然没打磨太多,但是我觉得已经到了那个水平了,稍微打磨打磨这件事绝对能干啊!

超级个体|柿子

110,858 просмотров • 24 дней назад