Loading video...

Video Failed to Load

Go Home

Kimi K3可能是最懂视频剪辑的模型,能够精准满足自媒体人的各种需求 下面是我在描述清楚需求后,用一条goal命令跑出来的世界杯决赛前瞻视频 素材、旁白、配乐全部自己搞定,一次出的版本就已经有那么点味道了 (提示词传送至评论区)

42,212 views • 2 months ago •via X (Twitter)

0 Comments

No comments available

Comments from the original post will appear here

Related Videos

绝了!这应该是最适合接入视频剪辑工作流的AI!! 因为它真正能看懂视频,并且够快够便宜! 对于做视频,不管是专业还是非专业选手,最耗费时间的其实就是找素材,和选素材! 好几个小时的素材,可能真正能用上的就几分钟! 而为了找到合适的,往往需要把每一条都从头看完, 根据脚本反复拖动时间轴、记录和剪切可用的素材。 这非常费时间,一点也不AI。 我也试过用很多AI来解决这个需求,包括一些所谓的视频素材AI管理工具, 能读视频的多模态模型其实很多,靠截图的方式能够理解视频的内容, 但也仅限于知道视频的内容,因为这些模型不太能理解视频里各个镜头和画面的时间关系。 这次看到 Ant Ling 新出的多模态模型 Ling-3.0-flash-VL, MoE架构,总参数124B、有效激活5.5B参数,支持256K长上下文和VideoRoPE时空编码。 激活参数更小,说明成本更低! 这个VideoRoPE时空编码,据说是靶向解决我上面说的那个问题! 第一时间测试了一下!! 我丢给它一个演讲的视频,让它告诉我讲了什么,有什么重点, 另外我告诉它,我想基于这个演讲视频剪辑一个高光短视频,需要它帮我找到一些高光时刻,然后告诉我准确的时间码,并且为这个高光短视频写一个文案。 这已经不是单纯的“视频总结”之类的简单任务, 它需要按照时间线给出: 高光时间段+核心观点+入选理由+建议标题+开头钩子+发布文案。 这应该才是多模态模型能够发挥价值的地方!! 普通模型可以告诉你“一小时的视频讲了什么”,但内容创作真正需要的是:这一小时里,到底哪些能够用,要怎么用? 让我比较惊喜的是,它不光给了我高光视频剪辑要用的分镜、脚本、文案,甚至还给了我转场、和BGM的建议! 完全就是一份可以照做的剪辑执行单!! 这说明和它对原视频的理解已经远超我的预估!! 我在想,也许可以把这套能力接入剪辑工具,整个工作流就还可以继续延伸: 读取视频 → 理解内容 → 定位高光 → 输出时间码 → 调用工具裁剪 → 生成标题和发布文案。 完全实现视频剪辑自动化!! 当然,理想是丰满的,AI挑出的素材不一定全都符合审美和叙事偏好, 时间码和上下文完整性也需要人工复核。 要想创作出好的视频作品,必然还是需要人的参与! 不过,用AI搞定素材的初筛,也是目前的超级刚需啊!!

沐阳

22,618 views • 19 days ago

产品都写出来了,宣传还只能甩链接、贴截图? 我这个不会剪辑的人,把网站链接丢给 Pexo,聊出了下面这条带旁白、字幕和配乐的产品片。 这次用的是 Pexo。 Pexo 是一款 AI 视频创作工具,可以直接跟它聊天做视频。想做什么、画面怎么改,用大白话说就行,我这种没剪辑经验的也能上手。 先说下背景。 我平时写代码,不做视频。这次想在 X 上正经介绍一下自己的产品,才发现最烦的不是写帖,是片子。 不会 AE。也不想为了发一条,把晚上搭进去学剪辑。 产品叫赏金平台。达人发加热任务,普通人去点赞、评 论、转发、引用,做完领红包。站点能用了,就缺一条能 看懂“这是干什么的”的介绍视频。 我把网站 URL 丢进 Pexo,跟它说:给我做一条产品介 绍,发 X 用,让人 15 秒内看懂这是个什么东西。 它没马上吐视频。 先跟我对齐。给谁看、多长、要不要口播、画面偏产品演 示还是偏故事。有点像在跟一个会做片子的人对需求。 我用大白话回了几句。确认完,它自己去跑。 回来的是成片。旁白、字幕、动效、配乐都在,不用再把 素材拖进时间轴上拼。这点对我这种只想把产品讲清楚的 人,挺关键。 后面还能接着聊。开头散了就让它收一收,某句口播太长 就让它改短。全程没碰时间轴,也没去挑用的是哪个模 型。 想改画面里的具体位置,还可以用 Mark to Fix。比如片 尾那个“立即注册”按钮,想往下挪一点,就直接在画面上 圈出来,在右侧批注框写:“按钮往下移一点,和上面的 标题拉开些距离。”提交后让它改,再看效果。 下面这条,就是拿网站链接聊出来的。 你要是也有个刚做出来的产品,想配条介绍视频,又不想先学剪辑,可以把 URL 丢给 Pexo 试试。

程序员端哥

16,636 views • 7 days ago

AI 视频制作也接近了 GPT 时刻,视频智能体背后的工作原理🧵 AI 产品都有个可用性易用性的临界点,临界点之下,属于专业玩家的玩具,需要各种提示词技巧、专业知识才能用起来;临界点之上,就真正变成了普通人也可以用起来并且有用的工具。就像 AI 聊天,在 ChatGPT 之前,我们常笑话它们是人工智障,在 ChatGPT 之后,它是真的变成了一个有帮助的助手,能帮助我们完成很多任务,所以我们通常把 AI 产品跨过可用性通用型临界点叫 GPT 时刻。 类似的比如前不久 GPT-4o 发布的图片模型,提示词很简单,不需要像 MidJourney 那样需要专业的提示词才能生成好的图片作品,普通人都可以把自己天马行空的想法变成真实有趣的作品,我这样非专业的都玩了好一段时间。 像 AI 视频类产品我一直没怎么玩,因为对于我这样的非专业人士来说,做好视频太难了,创意和提示词反倒相对容易一点,主要是得写脚本、画图、声音、多条视频,剪辑,做好一条视频要费很多时间精力。 不过上面这条视频倒是没花我多少时间,我就输入了一条提示词: > 生成视频,主题是“西游记人物自拍视频,用自拍的方式来讲述《西游记》经典场景”,视频长度为2分钟。 发送到纳米AI然后等着就成了,整体看着还挺有趣,有画面有声音有剧情。让我觉得 AI 视频终于也接近了 GPT 时刻,普通人也可以通过简单的提示词就能做出还不错的视频作品,动动嘴就能出视频。对于创作者,也可以快速制作视频 Demo,将创意想法快速落地。

宝玉

26,346 views • 1 year ago