Video yükleniyor...

Video Yüklenemedi

Ana Sayfaya Dön

AI 视频制作也接近了 GPT 时刻,视频智能体背后的工作原理🧵 AI 产品都有个可用性易用性的临界点,临界点之下,属于专业玩家的玩具,需要各种提示词技巧、专业知识才能用起来;临界点之上,就真正变成了普通人也可以用起来并且有用的工具。就像 AI 聊天,在 ChatGPT 之前,我们常笑话它们是人工智障,在 ChatGPT 之后,它是真的变成了一个有帮助的助手,能帮助我们完成很多任务,所以我们通常把 AI 产品跨过可用性通用型临界点叫 GPT 时刻。 类似的比如前不久 GPT-4o 发布的图片模型,提示词很简单,不需要像 MidJourney 那样需要专业的提示词才能生成好的图片作品,普通人都可以把自己天马行空的想法变成真实有趣的作品,我这样非专业的都玩了好一段时间。 像 AI 视频类产品我一直没怎么玩,因为对于我这样的非专业人士来说,做好视频太难了,创意和提示词反倒相对容易一点,主要是得写脚本、画图、声音、多条视频,剪辑,做好一条视频要费很多时间精力。 不过上面这条视频倒是没花我多少时间,我就输入了一条提示词: > 生成视频,主题是“西游记人物自拍视频,用自拍的方式来讲述《西游记》经典场景”,视频长度为2分钟。 发送到纳米AI然后等着就成了,整体看着还挺有趣,有画面有声音有剧情。让我觉得 AI 视频终于也接近了 GPT 时刻,普通人也可以通过简单的提示词就能做出还不错的视频作品,动动嘴就能出视频。对于创作者,也可以快速制作视频 Demo,将创意想法快速落地。

26,346 görüntüleme • 1 yıl önce •via X (Twitter)

11 Yorum

宝玉 profil fotoğrafı
宝玉1 yıl önce

西游记自拍视频完整提示词: 比如下面这个也挺好玩,提示词一样很简单: > 模仿央视《致富经》风格制作一条视频,介绍大凉山村民借助最新基因复活技术,养殖驯养真实恐龙发家致富的经验,播音和视频风格要尽可能模仿《致富经》,时长2分钟 Propmpt:

宝玉 profil fotoğrafı
宝玉1 yıl önce

纳米 AI 的超级搜索背后是一套多智能体架构,在收到用户输入的提示词后,由一个主智能体负责调度决策,选择合适的工具或子智能体完成任务,返回多模态结果(例如:报告、PPT、网页、视频等),整个过程不需要人工干预,搜完即得。

宝玉 profil fotoğrafı
宝玉1 yıl önce

拿它处理视频的部分来说,就像下面这张图一样,当你把生成视频要求发给纳米 AI 时,有个大模型负责统筹调度: - 首先调用搜索工具,检索生成视频需要的资料 - 然后根据要求和资料创作视频脚本 - 再开始视频脚本去生成关键帧的图片,保持图片风格一致 - 根据视频脚本生成每一段脚本的语音音频 - 基于关键帧照片去生成分段视频 - 将每一段的音频和视频剪辑在一起 - 将分段视频拼接在一起 - 为视频生成背景音乐 - 将视频和背景音乐合成一起生成最终视频 - 生成最终报告

宝玉 profil fotoğrafı
宝玉1 yıl önce

所以它就像一个像一个小视频团队,在帮你干活,里面有分工,有的负责写脚本,有的负责拍视频、配音、剪辑,而有个大语言模型在里面像导演一样,指挥这些工具/子智能体工作,直到“导演”觉得结果满足要求了。 如果你搞清楚它的工作原理,那么你还可以更进一步,比如你帮它把视频脚本写好,而不是一句话提示词,这样可以更精准的生成视频。当然不会写也没关系,你提供思路,让 AI 帮你写一份视频脚本,不满意就给 AI 提要求让它修改,直到满意为止。

宝玉 profil fotoğrafı
宝玉1 yıl önce

比如下面这个视频就是我先让 AI 创作,写好了脚本,再把整个脚本输入纳米 AI,那么它就能帮你按照脚本生成一个完整的视频。 完整提示词:

宝玉 profil fotoğrafı
宝玉1 yıl önce

当然纳米 AI 的超级视频智能体还处于 Beta 状态,为了得到理想的视频有时候需要多生成几次,大部分时候结果都挺不错的。就像上面我分享的视频,除了致富经那条生成了几条,其他都是一次成型。 在纳米AI 手机APP和PC都可以使用,我习惯用PC端是因为可以更方便的看整个生成的过程,另外还可以多个窗口一起跑。左侧点击AI搜索,直接输入指令,勾选上“深度研究”,会自动调用“超级视频智能体beta”

宝玉 profil fotoğrafı
宝玉1 yıl önce

建议你也可以自己去纳米AI(

毅行出海 Sven profil fotoğrafı
毅行出海 Sven1 yıl önce

“西游记人物自拍”这个prompt太有意思了!AI视频的趣味性确实被挖掘出来了。这种结合经典IP和现代元素的创作方式,能激发更多人的创作灵感,让传统文化焕发新生。

宝玉 profil fotoğrafı
宝玉1 yıl önce

是的,这样精力可以放在写 Prompt 而不是视频处理上

蓄水养鱼(Ø,G) profil fotoğrafı
蓄水养鱼(Ø,G)1 yıl önce

生成的速度怎么样?

宝玉 profil fotoğrafı
宝玉1 yıl önce

不算快,但PC上可以并行开多个窗口

Benzer Videolar

绝了!这应该是最适合接入视频剪辑工作流的AI!! 因为它真正能看懂视频,并且够快够便宜! 对于做视频,不管是专业还是非专业选手,最耗费时间的其实就是找素材,和选素材! 好几个小时的素材,可能真正能用上的就几分钟! 而为了找到合适的,往往需要把每一条都从头看完, 根据脚本反复拖动时间轴、记录和剪切可用的素材。 这非常费时间,一点也不AI。 我也试过用很多AI来解决这个需求,包括一些所谓的视频素材AI管理工具, 能读视频的多模态模型其实很多,靠截图的方式能够理解视频的内容, 但也仅限于知道视频的内容,因为这些模型不太能理解视频里各个镜头和画面的时间关系。 这次看到 Ant Ling 新出的多模态模型 Ling-3.0-flash-VL, MoE架构,总参数124B、有效激活5.5B参数,支持256K长上下文和VideoRoPE时空编码。 激活参数更小,说明成本更低! 这个VideoRoPE时空编码,据说是靶向解决我上面说的那个问题! 第一时间测试了一下!! 我丢给它一个演讲的视频,让它告诉我讲了什么,有什么重点, 另外我告诉它,我想基于这个演讲视频剪辑一个高光短视频,需要它帮我找到一些高光时刻,然后告诉我准确的时间码,并且为这个高光短视频写一个文案。 这已经不是单纯的“视频总结”之类的简单任务, 它需要按照时间线给出: 高光时间段+核心观点+入选理由+建议标题+开头钩子+发布文案。 这应该才是多模态模型能够发挥价值的地方!! 普通模型可以告诉你“一小时的视频讲了什么”,但内容创作真正需要的是:这一小时里,到底哪些能够用,要怎么用? 让我比较惊喜的是,它不光给了我高光视频剪辑要用的分镜、脚本、文案,甚至还给了我转场、和BGM的建议! 完全就是一份可以照做的剪辑执行单!! 这说明和它对原视频的理解已经远超我的预估!! 我在想,也许可以把这套能力接入剪辑工具,整个工作流就还可以继续延伸: 读取视频 → 理解内容 → 定位高光 → 输出时间码 → 调用工具裁剪 → 生成标题和发布文案。 完全实现视频剪辑自动化!! 当然,理想是丰满的,AI挑出的素材不一定全都符合审美和叙事偏好, 时间码和上下文完整性也需要人工复核。 要想创作出好的视频作品,必然还是需要人的参与! 不过,用AI搞定素材的初筛,也是目前的超级刚需啊!!

沐阳

22,618 görüntüleme • 18 gün önce

你有没有遇到过这种情况:有个好项目? 或者写了篇好文章,想做成视频让更多人看到,却因为不会剪辑,不知道从哪下手? 这次我找了个好搭档——Pexo Pexo,一款 AI 视频创作工具。 跟它聊聊你想做什么视频,它就能帮你生成;哪里不满意,接着说,它就能继续改。 它是给我们提供了一个新的尝试性做法,我们可以把已经整理好的知识,也就是文章或者是解题思路,然后可以根据一个具体的例子,然后自己去确定一下画风,让他去给我们做出视频。 Pexo 提供的 Mark to Fix 如果你是和我一样第一次使用,你也会感觉到非常的惊艳,在内容修改的时候非常的方便,直接可以圈出画面中的位置再说明修改要求。 1、主要可以选择对应的元素 然后过 直接让模型帮你修改 用简单的对话方式就可以完成 2、不满意的地方随时都可以调整,时间线和画面内容也可以动态修改 3、背景音乐和素材图片到整个视频的合成都是通过对话方式完成的 对于我们这一些创作者来说,视频更容易传播,以及更容易让人去接受。因为长篇的文字反而不是那么的很让人能够沉迷地看进去。当然文字和视频搭配起来会更好一些。 这个体验的入口: 我也给大家争取到了官方福利,使用邀请码MMHC5S,可以领取100积分,限前50名,有需要的可以去试试

小墨同学

13,853 görüntüleme • 5 gün önce