Загрузка видео...

Не удалось загрузить видео

На главную

3分钟制作大电影,AI视频的「导演时代」来了。 昨晚我花了2小时, 实测刚出的「AI电影生成」即梦Seedance 2.0, 唠几点真实感受。 1.真人质感已经走完0到90步。 动效、光影、皮肤纹理基本等同于电影级制作。你看下马斯克他们的人物质感非常真实。 动效师基本可以下岗了。 2.我尝试做了10几个小视频。有虚拟+真实对比度场景进行测试。 主题有Labubu在外滩大战蜜雪冰城, 宫崎骏女主逛街南京东路。 动画与真实世界的融合度超出预期。 3.最惊艳的是运镜和分镜。 比如我prompt只写了一句「镜头跟随人物穿过走廊到江边」,它自己规划了跟拍、推拉、升降一整套镜头语言, 出来的效果简直像有人扛着斯坦尼康实拍的。 4.音画同步。 你仔细听,ai主动根据画面配的电闪雷鸣声音。 当然BGM中文配音还是有些弱智,尝试了几次都不理想。 5.缺点也很明显。 画面中的文字大概有20%概率变成乱码;最长只能生成15秒,但生成时间大概只需3分钟。 整体感受是,Seedance 2.0赢在镜头可控性,你是在做导演的体验感。 中国AI实力确实不能低估。 但15秒就是现在所有AI视频模型的天花板。 什么时候能稳定输出更长时间,AI视频才能真正从玩具变成工具。 这一天不会太远了。

90,199 просмотров • 8 месяцев назад •via X (Twitter)

Комментарии: 0

Нет доступных комментариев

Здесь появятся комментарии из оригинального поста

Похожие видео

最近身边很多朋友都在讨论,AI会不会取代影视行业里的实拍? 但如果你真的做过内容、拍过片子、交付过客户,就会越来越清楚一件事: 视频行业真正高效、也最有竞争力的方式,不是纯AI,也不是死守纯实拍,而是AI+实拍的结合。 AI的优势,是快,是低成本,是能迅速把脑子里的想法“具象化”;它特别适合做概念预演、气氛镜头、复杂转场、难以实拍的想象性画面,也适合把一个普通团队的创意上限拔高。 但它的问题也很明显,人物真实感、情绪细节、品牌信任感,即便是最强的Sd2.0,其实还是差着那一口“活人气”。 而纯实拍的价值,恰恰就在这里!! 真实的人、真实的光线反馈、真实的微表情,这些东西决定了内容有没有温度,有没有说服力,有没有质感。 尤其是商业化内容,能够真正产生溢价的,往往不是炫技,而是信任,是人与人的情感互动。 所以未来最强的创作者,不是最会拍的人,也不是最会跑AI的人,而是最会把两者编排在一起的人。 用实拍去托住人物的真实感,用AI去放大表达力;把该真实的部分拍下来,把该夸张、该想象、该提升效率的部分交给AI。 说得更直白一点,AI不是来替代镜头的,AI是来解放镜头的。 它把那些过去要花很多钱、很多时间、很多人力才能完成的部分,比如特效、比如调色、比如光影氛围、比如布景、比如道具,变成了一个人也能调度和解决的事情。 但真正决定作品质感下限和商业价值上限的,依然是真实本身。 视频来自:边境悍匪

沐阳

844,574 просмотров • 6 месяцев назад

之前用 Seedance 2 做了个做酸菜鱼的视频, 生成到第10秒的时候,美女的手直接伸进滚烫的锅里搅拌。AI完全不知道那样会烫。 当时觉得好笑,后来越想越觉得,这不只是 bug这么简单,现在的 AI 根本还没到理解物理世界怎么运转这一层。 这半年做了太多AI视频了,每次满心欢喜等它生成,结果经常是人物动作接不上、物体空间瞬移、手还没碰到东西物体就动了,各种幻觉 bug,真的挺折磨。 最近看到黄碧薇教授 Biwei Huang 的 Aether AI 官宣融资,认真看了一下方向,感觉它解释了很多视觉 AI 里反复出现的问题。 Aether AI 做的是因果世界模型。这个词听起来很学术,但放到视频生成里其实很好理解。 今天的视频模型,Sora、即梦、Veo,已经能生成非常真实的画面。杯子掉落、水洒出来、机械臂抓取,看起来越来越像真的。但它们很多时候是在根据海量视频经验预测下一帧,类似画面后面通常会发生什么,就生成什么。 所以桌子高了 2cm,机械臂就可能失效。明明伸过去的角度看起来对,杯子却自己飞起来了。画质够了,数据也不少,但模型没有真正理解这个动作为什么会带来这个结果。 Aether AI想做的,就是让 AI 学到变量之间的底层规律,比如桌子高度变了会带来什么影响,物体受力之后会怎么运动,一个动作会导致什么后果。 这类东西学进去,模型才能在没见过的场景里稳定推演、举一反三。对视频生成、机器人、自动驾驶、3D 世界模拟都会很关键。 视觉 AI 下一阶段的方向,可能就是从生成看起来合理的画面,走向理解画面为什么会这样变化。 黄教授 Biwei Huang 做因果AI 超过 12 年,这次 Aether AI 融资,我觉得是一个值得关注的信号:因果世界模型正在从学术前沿走向产业。 想了解的可以戳一下官网看看:

Adam也叫吉米

73,143 просмотров • 3 месяцев назад

大半夜体验完 Manus AI, 达到了今天的使用限制,说一下自己的感受🧵 整体来讲,真的很强大, 主要体现在 Manus 能够: 🔧展示完整的推理逻辑,有个 Manus 电脑的东西为你呈现所有过程和进展; 🏗️调用各种API 协同完成任务; 📃最终非常实际的交付给你一个可用的文件。 🌟「真正能干活」的AI Agent,这个定位真的太准确了。 以下是一些实例: 1️⃣基础任务完成度高 比如最近日本可以看樱花了,整理一个具体的旅行清单包括日程、推荐景点、住宿、交通等等; 家里领导喜欢看红楼梦,梳理一下红楼梦的人物关系。 以下是分别让他做的一个 pdf 文档和可以互动的网页,完成度是真的很高,不过人物关系上有一点小错误,无伤大雅。 其他比如让他阅读视频给到总结,甚至让他剪辑播客都是可以的(只是效果不太好)。 但是我尝试让他给我画一些图🗺️,这方面还有所欠缺,给到的理由是第三方 API 接口出错。同时网上说她可以做ppt,确实是可以的,但是能做ppt的工具都存在一个共同问题,逻辑还行,但就是丑。所以“美术”相关工作我理解还是做不了的。 另外,他是一个完成特定任务的助手,不要把它当作聊天机器人,不然他每次跟你聊天都要思考十几分钟,真的很难受。 2️⃣测一测他懂不懂Web3 给了两个任务: a) 我们今天发了一个depin的研报,花了一个多月,自认为还行,让他给这个研报评分,并且给到其他更好的文章推荐。 我们的depin报告如下 他给到的内容如图3,更详细的评价文档我传了一个Google 链接,放在最后了,各位可以自行查看(包括前面的红楼梦人物关系图)。 整体来看,他快速学习和阅读了大量 web3 depin 的报告,并且从多个维度给出了我们报告的评价,以及推荐的其他报告和对应的评价。 b) 假设我是一个 交易所cmo,如何做华语市场的传播策略,包括华语媒体和华语kol的整理和评级。很遗憾,我已经等了一个多小时他还没思考完,如果明天有结果,我也会传到Google link里。(Manus 可以离线、多任务思考,所以可以同时开启多个任务,或者关机后之前的任务仍然会运行) 不过我看到了他的实时分析过程,在阅读各个媒体、kol 的官网文章,历史推文等等,形成自己的分析。见图4 所以我理解在他的大脑里是有 web3 内容,并可以实时学习的。 3️⃣除了懂,他能否与 Web3 交互 以上的推理其实都和 Web3 没有实际关系,我更关心他能否拿到链上数据,甚至能够交互。比如是否知道 $SOL $ETH 能在哪些地方质押,收益如何等等,还有一些深入的分析问题。 很遗憾,今天的使用次数达到限制了。明天再说吧👋 -------------------------------------------- 等待 Manus 思考结果的时候,我也看了一些其他的博主评价和官方的介绍,我觉得有一点说的很好: “没有开源,就没有 Manus AI” 从一个体验过多个AI产品的小白角度,我其实觉得 Manus 会这么火爆的原因主要在于:调用了多种 API 接口,配合自己的推理算法最终呈现了一个很好的产品。 这让我想到 ai16zdao 每周都有新的人贡献 plugin(比如 微信,deepseek),让这个网络不断壮大; Virtuals Protocol 通过打通 agent 得底层框架,形成 agent 经济体;还有 Hey Anon 不只是有链上数据,还能直接帮你交互等等。 某一天,web2 和 web3 的 AI 产品肯定会更加紧密的相互协作,并出来几个不错的case。 最近有一些 betting 的产品已经初现端倪。 Manus 也会开源自己的能力,为了更大的 AGI 世界。 如果真到了那一天,我就真的要失业了🥲 ( Google drive 素材链接:

Zolo 🌊

40,430 просмотров • 1 год назад

生成视频已经满足不了人类的欲望了,生成世界才是未来!地球Online的虚拟世界版要来了。。。​ ​ 以前我们玩游戏都是一个固定好的世界,比如绝地求生、英雄联盟或者王者荣耀。。。但是我曾经还是畅想过在一个完全「未知」的世界升级打怪,不过从来没觉得这会变成现实,但是最近有一个词叫做「世界模型」非常火,我已经不止一次听说过它的名号。​ ​ 世界模型的定义是:一种能够学习并模拟环境状态变化的 AI 模型。 它能根据过去的观察和当前动作,预测:当前状态+动作→下一个状态。例如:汽车当前速度、道路情况、方向盘操作→汽车下一秒的位置和周围环境。​ ​ 也就是说如果置身「世界模型」之内,未来的每一刻都会根据你上一刻的行为而变化,这就很有意思了,如果大家都玩由「世界模型」支撑的游戏,那么每个人的游戏体验都会是独一无二的,这真的有可能颠覆现在的传统行业。​ ​ 之前更多停留在“听说”的阶段,但是 Alaya World 可能真的会让这个想法第一次变为现实,我在它的官网做了一个demo——选择魔法,整个世界为之变色👇。​ ​ Alaya World模型以 720p / 24 FPS 实时流式生成了可探索的世界。而且生成过程中可以自由移动来调整视角,通过提示词随时召唤魔法,并支持超过 1 分钟的稳定长时连续生成。​ ​ 但是除了“好玩”之外,「世界模型」肯定会比单纯生成视频更加烧钱,那为什么这些像Alaya Lab这种顶级实验室都在往里面疯狂砸钱。它到底能通过什么方式变现?我特意查了一下它的应用场景,不查不知道,一查吓一跳,「世界模型」真的是在下一盘大棋:​ ​ 1.帮机器人训练提效降本:在虚拟环境里模拟不同物体、房间和突发情况,让机器人反复练习抓取、行走和操作,不需要在现实中摆放物品,减少设备损坏的风险,从而降低训练成本。​ ​ 2.帮助自动驾驶测试危险场景:模拟行人突然出现、前车急刹、暴雨大雾等现实中很难主动制造的情况,让自动驾驶系统提前进行大量测试,提高安全性。​ ​ 3.帮助游戏和影视生成场景:生成可以移动和互动的虚拟空间,从而减少游戏地图、影视场景和3D内容的制作时间。​ ​ 4.帮助企业提前模拟现实决策。工厂、仓库或建筑公司可以先在虚拟环境中测试设备摆放、生产流程和人员路线,确认方案是否合理后,再在现实中实施,减少试错成本。​ ​ 所以对应的「世界模型」可以通过卖API和算力赚钱、通过软件订阅赚钱、通过企业定制赚钱,简单来说,现在AI视频模型能盈利的渠道它都有,而且甚至能够更广泛。​ ​ 我感觉我每一次赚钱都是抓住了风口,包括Youtube shorts的YPP、小红书虚拟AI产品、X AI自媒体,那下一个关于AI的机会在哪?我很看好「世界模型」,接下来我也会更加仔细研究这个赛道,希望在下一个十年不会下桌🫡​ ​ Alaya Word也已经开源: 相关技术论文感兴趣的朋友也可以去读一下(我是让AI解释的哈哈哈):

逸尘

20,391 просмотров • 2 месяцев назад

4月3日,阿里通义实验室发布了Wan2.7-Video 一句话改视频!AI 视频从【能演】进阶到【能导】 - 全模态输入,支持"一句话改视频"、最长15秒续写、风格转换 亮点一:元素级增删改 这个功能把我整懵了! 之前我们要删个火车、改个道具,只能重新生成。现在直接说一句:「删掉视频中的火车」,就像改 Word 文档一样简单! 官方 demo 里,把视频里的胶片替换成盘子,把多余人影删掉,都是一句话搞定。这精准度,这效率,绝了。 亮点二:环境与风格秒切换 「把晴天变雨天」、「把夏季变冬季」、「把写实风格变成水彩画」... 这些以前需要专业后期团队搞半天的工作,现在一句话就完成了。而且不是简单的滤镜叠加,是真正理解场景后重新渲染。 雨天场景:雨滴、积水、倒影、阴沉光线,全套细节都有了。 冬季场景:雪花、结冰、雾气、冷色调,氛围感拉满。 亮点三:角色控制,台词自动匹配口型音色 这个功能,杀疯了! 你想改句台词?直接输入新台词,AI 自动调整口型、音色、表情,甚至语气的停顿和情绪都能匹配。 行者之前做漫剧,改台词是最痛苦的。要重新配音、重新对口型、调整表情...现在,一句话搞定。 声画同步,一步到位,这对创作者来说,简直是神器。 亮点四:专业级运镜,40+细分表情 支持希区柯克式变焦、360 度环绕、FPV 无人机俯冲等高难度运镜。 40+细分表情,从微微笑到狂笑,从轻蔑到愤怒,细腻程度超出想象。 亮点五:多主体参考,业内最高 最多支持 5 个视频主体同时参考。这意味着什么? 你可以同时参考:A 视频的运镜 + B 视频的角色表情 + C 视频的舞蹈动作 + D 视频的特效风格 + E 视频的服装造型。 然后生成一个融合了所有这些元素的新视频。 这是业内最高的多主体参考能力,之前其他工具大多只能参考 1-2 个。 亮点六:续写+尾帧控制 传统 AI 视频续写有个问题:前一秒还在跑步,续写后突然停了,产生"刹车感"。 Wan2.7 解决了这个问题,续写更流畅,尾帧控制更精准。

行者AI视频

15,840 просмотров • 6 месяцев назад

豆包上可以体验 Seedance 2.0 了,我已经试了一下。 最近 Seedance 2.0 在海外火得一塌糊涂,邀请码一码难求。 Seedance 2.0 已经不需要我多介绍了,是字节自研的视频生成模型,支持文生视频、图生视频、分身视频,还自带音效生成。 豆包视频生成模型Seedance 2.0今天正式接入豆包App、电脑端和网页版。 打开豆包App对话框,选择新增的“Seedance 2.0”入口,输入相关提示词,即可生成5秒或10秒视频。也可以选择“分身视频”,经过真人验证,创建自己的视频分身,体验更多创意玩法。 我重点说两个最值得玩的功能。 【1】文生视频 一句话描述你想要的画面,直接出视频。动作自然、镜头连贯,已经不是那种一眼假的 AI 视频了。复杂场景也能处理,比如多人互动、多镜头转场,生成质量在目前的视频模型里属于第一梯队。 你可以试试这种提示词: > 拍一段多场景转场的城市记录片,先是弄堂里挂红灯笼,然后在淮海路排队买年货,最后在厨房炸春卷。加上旁白和上海方言对话,带点复古滤镜。 这种复杂度的文生视频,Seedance 2.0 能搞定。 也可以整点好玩的,比如我记得马斯克和扎克伯格以前说要打架来着,后来取消了,现在可以在豆包里面用 Seedance 2.0 还原一下。 > Elon Musk (哪吒造型,但是脸型发色形似马斯克)和 Mark Zuckerberg(敖丙造型,但是脸型发色形似扎克伯格)的激烈对打,哪吒动画片风格,类似于哪吒和敖丙经典对战场景,只是人物形象换掉 > 马斯克:我 XAI 天下第一 > 扎克伯格:不对,我羊驼 LLAMA 才天下第一

宝玉

35,538 просмотров • 7 месяцев назад