Загрузка видео...

Не удалось загрузить видео

На главную

Codex做视频的工作流基本跑的差不多了。 目前还差一个中文断句+语句组织skill、 好一点的钩子skill(不同类型的视频需要不同类型的钩子) 总体上细节能够完善的地方还有不少,但是能够确定的是以后也不用自己费劲录自己的口播视频了,自己的数字人也能够P好看一点,减少出镜容貌焦虑。感谢AI大时代。 下面这个视频就是寥寥两轮提示词三四句话做出来的(其中一个风格模板)。 等我整理一下,明天开源😋

25,223 просмотров • 1 месяц назад •via X (Twitter)

Комментарии: 31

Фото профиля xilo
xilo1 месяц назад

内容很棒啊,但是感觉 文案 AI 味还是有点强😅

Фото профиля 雪踏乌云
雪踏乌云1 месяц назад

是的 还得调整

Фото профиля xilo
xilo1 месяц назад

我觉得demo 做出来了,其他的就简单了

Фото профиля 烟花老师
烟花老师1 месяц назад

牛批

Фото профиля freshlaker
freshlaker1 месяц назад

总体上没有很大区别,还是PPT风。这得模型更新视觉能力了。

Фото профиля Stokis Tian
Stokis Tian1 месяц назад

牛逼plus了兄弟

Фото профиля royal Z
royal Z1 месяц назад

看起来很好啊,期待期待

Фото профиля 王朵拉(Dolla
王朵拉(Dolla1 месяц назад

全 AI 跑下来~~i 人必备神器啊

Фото профиля Sac
Sac1 месяц назад

又帅又能打

Фото профиля Milo发现
Milo发现1 месяц назад

中文断句这一步确实最容易把成片搞得像机器念稿 😂 我更想看你最后怎么处理:先按语义切句,再限制单条字幕字数,还是直接让模型按配音停顿重排?

Фото профиля Mens@cc.codesome.ai
[email protected]1 месяц назад

这个音频还需要调试

Фото профиля 晚晚
晚晚1 месяц назад

数字人先替本人上班了

Фото профиля Nikola
Nikola1 месяц назад

帅哥,这是照着稿子读的吗?哈哈

Фото профиля 旭旭旭旭
旭旭旭旭1 месяц назад

期待这个skill

Фото профиля Marvin的数字工坊
Marvin的数字工坊1 месяц назад

想知道token的消耗量级怎么样

Фото профиля 程序员Left
程序员Left1 месяц назад

握草太帅了直接开源

Фото профиля Leo
Leo1 месяц назад

AI 文案真的听得我难受

Фото профиля 百科星球AI
百科星球AI1 месяц назад

我等你

Фото профиля David Yin
David Yin1 месяц назад

这数字人头像用的是哪一家的?

Фото профиля henry
henry1 месяц назад

期待

Фото профиля 梭哈.AI
梭哈.AI1 месяц назад

卧槽这声音?

Фото профиля 耀天 YT(悟道版)
耀天 YT(悟道版)1 месяц назад

等待开源

Фото профиля 牛油果先生
牛油果先生1 месяц назад

坐等投喂了

Фото профиля 宝宝
宝宝1 месяц назад

我做了一个自媒体skill集合,你看看有没有你需要的,

Фото профиля Feinode
Feinode1 месяц назад

长这么帅可以直接来的,真人有超绝的价值

Фото профиля Ding
Ding1 месяц назад

需要!

Фото профиля AI Mastery Guide
AI Mastery Guide1 месяц назад

No more camera anxiety, that's huge 👏

Фото профиля 星见
星见1 месяц назад

牛的, 期待

Фото профиля Yanhua
Yanhua1 месяц назад

牛逼 刚需啊

Фото профиля 三三
三三1 месяц назад

期待这个

Фото профиля dy w
dy w1 месяц назад

数字人吗?

Похожие видео

做AI短视频,我踩过 5 个坑 今天全说出来,希望你能少走一些弯路。 ──────────────── 第一坑:一上来就猛学 刚开始做的时候,我每天研究工具、研究技术、研究别人怎么做。研究得很起劲,但回头一看,一个视频都没做完。 正确的顺序是先做出来,再边做边学。做完第一个你懂了流程,做完几个你有了感觉,就这样进步 总结一句:先完成,再完美 ──────────────── 第二坑:总想省钱省积分 生图要钱,生视频要钱,心疼是真的 刚开始做的时候,我也试过那些便宜的方案,效果看起来差不多。实际用下来,各种问题,花了大量时间去调,最后还是放弃了。 成本要跟结果比,不是跟价格比。做一个视频的成本本来就不高,省那点钱,丢的是时间和机会。 总结一句:用最好的工具,做最好的作品 ──────────────── 第三坑:死抠画面 刚开始做的时候,总想把画面做得很精美。结果发现根本做不到,提示词再好也有上限。 后来才发现,很多播放量很高的视频,画面并不精致,但内容抓人、节奏好,照样爆。 总结一句:别死抠视觉,够用就行。 ──────────────── 第四坑:忘了内容本身 这是最大的坑 刚开始做的时候,我花了大量时间研究工具、研究技术,结果忘了自己是做内容的 我们做的是视频,第一件事是内容好不好,不是特效漂不漂亮。 把注意力放回内容上之后,效果立刻就不一样了。 总结一句:我们是做内容的,不是研究AI的 ──────────────── 第五坑:做得太少 做一个感觉效果不好,就开始大改、大优化。其实很可能是这个方向用户不感兴趣,换一个方向就好了。 只要数量足够多,总会有跑通的 总结一句:干就完了,量大出奇迹 ════════════════ 我现在用什么工具 工具不用多,我现在核心就靠Creao 🔹 视频生成— 支持 Google Veo 和 Seedance,提示词直接出视频 🔹 图片生成— 最高 4K,随时在对话里生成 🔹 配音 — 20 多种声音,直接出音频文件 🔹 Agent 自动化 — 流程搭好之后可以定时跑,不用每次手动 可以试试: 最后一句:别光收藏,动手才能进步

Powerpei🦅🏆买美股上币安

22,183 просмотров • 2 месяцев назад

绝了!这应该是最适合接入视频剪辑工作流的AI!! 因为它真正能看懂视频,并且够快够便宜! 对于做视频,不管是专业还是非专业选手,最耗费时间的其实就是找素材,和选素材! 好几个小时的素材,可能真正能用上的就几分钟! 而为了找到合适的,往往需要把每一条都从头看完, 根据脚本反复拖动时间轴、记录和剪切可用的素材。 这非常费时间,一点也不AI。 我也试过用很多AI来解决这个需求,包括一些所谓的视频素材AI管理工具, 能读视频的多模态模型其实很多,靠截图的方式能够理解视频的内容, 但也仅限于知道视频的内容,因为这些模型不太能理解视频里各个镜头和画面的时间关系。 这次看到 Ant Ling 新出的多模态模型 Ling-3.0-flash-VL, MoE架构,总参数124B、有效激活5.5B参数,支持256K长上下文和VideoRoPE时空编码。 激活参数更小,说明成本更低! 这个VideoRoPE时空编码,据说是靶向解决我上面说的那个问题! 第一时间测试了一下!! 我丢给它一个演讲的视频,让它告诉我讲了什么,有什么重点, 另外我告诉它,我想基于这个演讲视频剪辑一个高光短视频,需要它帮我找到一些高光时刻,然后告诉我准确的时间码,并且为这个高光短视频写一个文案。 这已经不是单纯的“视频总结”之类的简单任务, 它需要按照时间线给出: 高光时间段+核心观点+入选理由+建议标题+开头钩子+发布文案。 这应该才是多模态模型能够发挥价值的地方!! 普通模型可以告诉你“一小时的视频讲了什么”,但内容创作真正需要的是:这一小时里,到底哪些能够用,要怎么用? 让我比较惊喜的是,它不光给了我高光视频剪辑要用的分镜、脚本、文案,甚至还给了我转场、和BGM的建议! 完全就是一份可以照做的剪辑执行单!! 这说明和它对原视频的理解已经远超我的预估!! 我在想,也许可以把这套能力接入剪辑工具,整个工作流就还可以继续延伸: 读取视频 → 理解内容 → 定位高光 → 输出时间码 → 调用工具裁剪 → 生成标题和发布文案。 完全实现视频剪辑自动化!! 当然,理想是丰满的,AI挑出的素材不一定全都符合审美和叙事偏好, 时间码和上下文完整性也需要人工复核。 要想创作出好的视频作品,必然还是需要人的参与! 不过,用AI搞定素材的初筛,也是目前的超级刚需啊!!

沐阳

10,474 просмотров • 9 дней назад

HeyGen这次开源,把AI做视频的最后一道门槛拆没了🤯 他们用Claude Code写代码,做了自己的50秒产品发布视频,然后把整个工具链完整开源给了所有人,致敬开源🫡 以后做视频真的能简单到离谱, 给一句话,做一个30秒的产品介绍,给一个PDF,自动生成总结视频, 迭代就是改一句话的事,比如把标题放大两倍,第三秒加一个淡入转场等, 这个工具叫HyperFrames,本质上就是一个纯HTML转MP4的视频渲染框架。 所以其实我们不用学任何剪辑软件,也不用写复杂的React代码, 只要写普通HTML,加几个简单的data属性,就能定义视频的每一帧、时间线、动画和音轨。 HyperFrames从第一天起就是为AI代理原生设计的。 AI天生就会写HTML,现在Claude、Cursor、Gemini所有编码Agent,只要装一个skill,立刻就会做视频。 这妥妥的降维打击啊,以前Remotion把视频变成了代码,但它需要你会React,需要构建流程,属于开发者专属的玩具。 HyperFrames是把视频变成了纯HTML,零构建,无DSL,不需要任何前置知识。 说白了,Remotion是给人写的,HyperFrames是给AI写的。 以前AI能写文字,能生成图片,但视频一直是最后一块硬骨头,现在这块骨头也被啃下来了。 代理现在能端到端完成一整条内容流水线,调研,写脚本,做设计,加动画,最后直接渲染出成品视频,全程不需要人类碰一下。 它还自带50+官方现成组件,社交遮罩、图表、转场,一行命令一键安装。 支持GSAP、Lottie、Three.js所有主流动画库,随便混用。 也就是说,同一份HTML永远出一样的结果,完美适合自动化流水线。 官方甚至把视频语言都标准化了,缓动用snappy,bouncy,转场用能量等级,字幕分Hype/Corporate/Tutorial三种风格。 AI只要学会这套词汇,就能稳定输出专业级视频,这不就是在教AI做导演嘛🤣 这对HeyGen来说也是一步妙棋,他们不再只是一个卖AI头像的SaaS公司,现在能做整个AI视频时代的基础设施了, 未来所有AI代理生成的视频都能跑在HyperFrames上。 然后再无缝接入HeyGen的头像、语音、翻译能力,形成一个完美的闭环。 当然目前也不是完美的,初期输出还有AI味,超过一分钟的复杂长视频,渲染还需要较强算力。 但我觉得这都不重要,关键是它第一次把完整的视频生产力交给了AI Agent,相当于AI内容创作时代的又一个里程碑。 想试的直接去GitHub搜heygen-com/hyperframes。 跑一行npx hyperframes init,然后让Claude帮你做第一个视频。 #HyperFrames #HeyGen #AI视频 #AI代理 #开发者 #内容创作

AYi

37,069 просмотров • 5 месяцев назад