Загрузка видео...

Не удалось загрузить видео

На главную

这个产品有点🐂❗ 一条已经生成完成的 AI 视频,竟然还能如此细致地修改,做AI视频再也不用担心“不可编辑”、反复抽卡耗费高昂成本了。 为了证明我没有吹牛,可以先看下面的展示视频 我们以前用AI模型做视频,通常只能生成几十秒的单个片段,一旦有个细节错了,就得全部推翻重新生成。 凑齐画面后,还得把这些“零件”导入到 PR 或剪映里繁琐地手动拼接、加音频和字幕,频繁切换多个软件,一条视频做下来费时费力。 但我这次用 Fotor Video Agent 做了一条 NovaQuiet 降噪耳机产品视频,体验完全不同。 第一轮,我只需提供产品 Brief、晚高峰地铁场景、核心文案,以及需要的画面要求。 Fotor Video Agent 依托长时序规划,直接生成了视频初稿,并自动将素材、文字、字幕和声音全部编排到了多轨道时间轴上。在一个系统内就能完成所有制作,根本无需切换其他软件。 初稿出来后,我觉得人物和耳机主体不够突出。以前遇到这种情况只能重头再来,但 Fotor Video Agent 生成的是支持二次修改的工程文件,所有元素都能继续调整。 于是我直接在聊天里进行第二轮编辑:“给人物加一层透明度约 20% 的冷白轮廓光,让耳罩旁的声场数值从 72 dB 降到 18 dB,再让声波、颗粒和字幕主动避开人物。” 这些要求原本需要拆成好几个复杂的剪辑动作:跟踪人物轮廓、处理描边透明度、制作数字变化、逐个检查字幕挡脸等。 但在 Agent 里面,我只需要把想要的效果讲清楚。 Agent 接着就在多轨时间轴里修改了原来的项目。人物从拥挤的地铁画面里被凸显出来,声场数值精准变化,周围的视觉元素也开始智能避让人物。 这正是 Fotor Video Agent 这次最值得介绍的能力。它通过自动规划和编排,能够让你在单一系统内高效出片。 原本需要 3-5 天的繁琐拼接修改工作,现在差不多...

200,446 просмотров • 1 день назад •via X (Twitter)

Комментарии: 0

Нет доступных комментариев

Здесь появятся комментарии из оригинального поста

Похожие видео

卧槽!我一个视频小白,只用一句话,就生成这种效果的视频! 我只说了句: “我想做一个很有张力的古风视频。画里的女生想逃出来,最后又被重新困回画里,你帮我看看怎么做。” 它脑洞大开,直接给我整了一个被巨型画笔追杀的画中人。 我没写分镜,也没拆镜头,故意装成纯小白: 当用户只有一个模糊想法,甚至不知道该怎么专业表达时,它到底能不能听懂? 做过 AIGC 视频的应该都知道,痛点其实不只在生成视频。 只要你前面需求拆偏一点,后面的人物、画风和剧情就可能一起跑偏。 好不容易生成出来,想改一个镜头,很多工具给你的又只是一条写死的内容,只能回去重新抽,时间和积分继续往里烧。 而且我平时得在 不同工具之间来回切换:搬参考图、搬提示词、下载素材,再把所有东西拖进剪辑软件里重新组装。费时费力,大部分时间都浪费在了搬运上。 这次我用 Fotor Video Agent Fotor , 先用长时序规划把整条故事该怎么走拆开,再把参考图、真实录屏、生成镜头、字幕、BGM、脚步声、画布撕裂声和心跳声,自动编排进同一个多轨项目里。 我不用每做一步就换一个软件。字幕、配乐、转场和画面布局也能在这套流程里继续完成;哪里不对,就留在项目里接着改,不必为了一个局部问题把整段视频全部推倒重抽。 它最后补出了一个灰白色的线稿世界,还放进去一支巨型画笔。 这个画笔确实挺有意思,它一出现,女生为什么要跑、为什么始终逃不出去、最后又为什么会被困回画里,一下就都有了解释。整个故事有了对抗,也有了闭环。 当然,这条片绝对不是一句话扔进去,一次就直接生成完了。 前前后后至少留下了 5 个完整版本。我一直看的还是最基本的东西:逻辑自然吗?人物和画风统一吗?衔接顺不顺?我要的张力有没有出来?不行就继续改。 所以这次真正让我感觉省事的,不是它把 AI 生成的不确定性彻底消灭了,而是需求规划、素材生成和后期组装终于能留在一个项目里继续推进。 最后这个东西到底能不能用,还是得由我自己拍板。现在这版也不是每个转场都绝对丝滑,但整体我能接受,不影响故事表达。 反正后面每次都能做到这个程度的话,我肯定会继续用。 Link in my bio. Try Fotor Video Agent. 成片放下面,可以看看效果。

木马人

14,025 просмотров • 2 дней назад

HeyGen这次开源,把AI做视频的最后一道门槛拆没了🤯 他们用Claude Code写代码,做了自己的50秒产品发布视频,然后把整个工具链完整开源给了所有人,致敬开源🫡 以后做视频真的能简单到离谱, 给一句话,做一个30秒的产品介绍,给一个PDF,自动生成总结视频, 迭代就是改一句话的事,比如把标题放大两倍,第三秒加一个淡入转场等, 这个工具叫HyperFrames,本质上就是一个纯HTML转MP4的视频渲染框架。 所以其实我们不用学任何剪辑软件,也不用写复杂的React代码, 只要写普通HTML,加几个简单的data属性,就能定义视频的每一帧、时间线、动画和音轨。 HyperFrames从第一天起就是为AI代理原生设计的。 AI天生就会写HTML,现在Claude、Cursor、Gemini所有编码Agent,只要装一个skill,立刻就会做视频。 这妥妥的降维打击啊,以前Remotion把视频变成了代码,但它需要你会React,需要构建流程,属于开发者专属的玩具。 HyperFrames是把视频变成了纯HTML,零构建,无DSL,不需要任何前置知识。 说白了,Remotion是给人写的,HyperFrames是给AI写的。 以前AI能写文字,能生成图片,但视频一直是最后一块硬骨头,现在这块骨头也被啃下来了。 代理现在能端到端完成一整条内容流水线,调研,写脚本,做设计,加动画,最后直接渲染出成品视频,全程不需要人类碰一下。 它还自带50+官方现成组件,社交遮罩、图表、转场,一行命令一键安装。 支持GSAP、Lottie、Three.js所有主流动画库,随便混用。 也就是说,同一份HTML永远出一样的结果,完美适合自动化流水线。 官方甚至把视频语言都标准化了,缓动用snappy,bouncy,转场用能量等级,字幕分Hype/Corporate/Tutorial三种风格。 AI只要学会这套词汇,就能稳定输出专业级视频,这不就是在教AI做导演嘛🤣 这对HeyGen来说也是一步妙棋,他们不再只是一个卖AI头像的SaaS公司,现在能做整个AI视频时代的基础设施了, 未来所有AI代理生成的视频都能跑在HyperFrames上。 然后再无缝接入HeyGen的头像、语音、翻译能力,形成一个完美的闭环。 当然目前也不是完美的,初期输出还有AI味,超过一分钟的复杂长视频,渲染还需要较强算力。 但我觉得这都不重要,关键是它第一次把完整的视频生产力交给了AI Agent,相当于AI内容创作时代的又一个里程碑。 想试的直接去GitHub搜heygen-com/hyperframes。 跑一行npx hyperframes init,然后让Claude帮你做第一个视频。 #HyperFrames #HeyGen #AI视频 #AI代理 #开发者 #内容创作

AYi

36,922 просмотров • 4 месяцев назад

我把 AI 手绘视频,做成了一条可以本地持续生产的自动化流水线,有人之前已经在抖音跑出千赞 现在市面上 AI 视频工具很多,但大多数只解决“生成一条视频” 我更想解决的是: 怎么把一条视频,变成一套能稳定复用、持续产出的生产系统 所以我把声音克隆、文案拆解、分镜、插画、白板动画、字幕和最终合成,全部接到了一起 你只需要做 3 件事: · 上传一段 10–30 秒的参考声音 · 粘贴一段你想表达的文案 · 选择画面风格和视频形式 剩下的交给系统: · 自动克隆声音 · 自动理解文案并拆分内容结构 · 自动生成统一风格插画 · 自动绘制白板笔迹动画 · 自动生成字幕并合成 MP4 · 失败后可以从断点继续,不需要全部重来 这次新版还加了一条我很喜欢的能力: 动态信息图模式 它不再只是“白板画画”,而是会根据真实旁白的时间,自动把内容组织成动态 PPT / 知识卡片 比如对比、流程、因果、时间线、层级、总结这些内容,都会用不同版式呈现 而且画面元素会严格跟着旁白出现,不会提前抢话,也不会靠字数瞎估时间 我自己的方案是: 本地 TTS + AI 文案理解 + AI 插画生成 + 本地渲染 目标不是做一个“好玩的一键生成器”,而是让一台电脑可以持续稳定地生产内容 如果你手里有矩阵账号、知识类账号,或者长期需要把口播文案转成视频,这套流程应该会比较有用 项目已经全部开源,能跑的代码都放出来了: 功能演示我会继续更新 创作不易,如果你觉得这个方向有用,欢迎帮忙转发、关注,也欢迎直接拿去改

陈硕KAI

11,520 просмотров • 12 дней назад

AI 视频制作也接近了 GPT 时刻,视频智能体背后的工作原理🧵 AI 产品都有个可用性易用性的临界点,临界点之下,属于专业玩家的玩具,需要各种提示词技巧、专业知识才能用起来;临界点之上,就真正变成了普通人也可以用起来并且有用的工具。就像 AI 聊天,在 ChatGPT 之前,我们常笑话它们是人工智障,在 ChatGPT 之后,它是真的变成了一个有帮助的助手,能帮助我们完成很多任务,所以我们通常把 AI 产品跨过可用性通用型临界点叫 GPT 时刻。 类似的比如前不久 GPT-4o 发布的图片模型,提示词很简单,不需要像 MidJourney 那样需要专业的提示词才能生成好的图片作品,普通人都可以把自己天马行空的想法变成真实有趣的作品,我这样非专业的都玩了好一段时间。 像 AI 视频类产品我一直没怎么玩,因为对于我这样的非专业人士来说,做好视频太难了,创意和提示词反倒相对容易一点,主要是得写脚本、画图、声音、多条视频,剪辑,做好一条视频要费很多时间精力。 不过上面这条视频倒是没花我多少时间,我就输入了一条提示词: > 生成视频,主题是“西游记人物自拍视频,用自拍的方式来讲述《西游记》经典场景”,视频长度为2分钟。 发送到纳米AI然后等着就成了,整体看着还挺有趣,有画面有声音有剧情。让我觉得 AI 视频终于也接近了 GPT 时刻,普通人也可以通过简单的提示词就能做出还不错的视频作品,动动嘴就能出视频。对于创作者,也可以快速制作视频 Demo,将创意想法快速落地。

宝玉

26,346 просмотров • 1 год назад