Video yükleniyor...

Video Yüklenemedi

Ana Sayfaya Dön

最近 FLUX 生成擦边视频和网红图看起来很火啊。 其实我有个比较成体系的网红图生成方案。 主要是一些保证正式感的参数和流程,还有一些保证擦边内容质量的东西。 之前的问题是已有的视频模型面部表情过于僵硬,海螺刚好解决了这个问题。 看看要不要整理一下。

164,899 görüntüleme • 1 yıl önce •via X (Twitter)

10 Yorum

歸藏(guizang.ai) profil fotoğrafı
歸藏(guizang.ai)1 yıl önce

刚刷到的,新号,这几天搞的,这就起量了

歸藏(guizang.ai) profil fotoğrafı
歸藏(guizang.ai)1 yıl önce

AI图片检测结果:

歸藏(guizang.ai) profil fotoğrafı
歸藏(guizang.ai)1 yıl önce

西乔老师这个也很厉害,这类流程商业价值都很大也相对复杂。

奇点 profil fotoğrafı
奇点1 yıl önce

国内的生图平台还是太敏感了,很多都不能生成,生成视频又走样。海螺勉强好点。

今天午餐吃甚麼? profil fotoğrafı
今天午餐吃甚麼?1 yıl önce

昨天看到黎明的新歌MV,馬上想起藏師傅 他這個是全AI視頻,超級複雜繁瑣,平均兩三秒一個畫面,總抽卡數起碼是以千為單位的,還得搭配歌詞,想分鏡,修後期🤒

歸藏(guizang.ai) profil fotoğrafı
歸藏(guizang.ai)1 yıl önce

工作量太大了

August profil fotoğrafı
August1 yıl önce

感觉以后不管生产内容的都是先生图,再用视频模型让图动起来的模式了。

通透马说 profil fotoğrafı
通透马说1 yıl önce

晃头的动作很欧美

AI geesehoward profil fotoğrafı
AI geesehoward1 yıl önce

要是图生视频能本地运行就好了, 现在在线的本质还是抽卡,花钱抽卡抽到自己不想要的成本太高,也不符合经济学,利润不够成本

歸藏(guizang.ai) profil fotoğrafı
歸藏(guizang.ai)1 yıl önce

luma 有 Comfyui 插件,价格也不贵,可以接受了

Benzer Videolar

AI 视频生成,到各种 AI Agent,我一直在思考一个问题:AI 最终会如何改变人类创造和体验数字世界的方式? 最开始,AI 帮助我们生成文字和图片;后来,它开始生成越来越逼真的视频。但无论画面质量提升到什么程度,这些内容依然存在一个限制——我们仍然只是观看者。我们可以欣赏 AI 创造出来的场景,却无法真正进入其中,也无法与这个世界产生互动。 最近体验 Alaya World Alaya Lab 后,我第一次感觉,AI 视频生成正在探索一个新的方向:它不只是生成一段视频,而是在尝试生成一个可以被探索的世界。 Alaya World 是 Alaya Lab 推出的交互式视频世界模型。用户可以通过文字、图片或者视频作为初始条件,让模型生成一个动态世界。不同于传统视频生成模型“输入 Prompt,输出一段固定视频”的方式,Alaya World 更像是在探索过程中持续构建环境,用户可以在生成的世界中移动视角,并通过交互指令触发新的事件。 这也是我认为世界模型和普通视频生成模型最大的区别。 过去的视频生成模型解决的是“如何生成一段更加真实的视频”,而世界模型尝试解决的问题是“如何让一个世界持续存在”。如果你进入一个虚拟城市,向前探索,然后回头,你期待看到的是同一个城市,而不是一个重新随机生成的场景。 这背后涉及世界模型最核心的挑战:长时间生成的一致性。模型不仅需要知道下一帧画面应该是什么,还需要理解空间关系、历史状态以及用户行为对世界造成的影响。 Alaya World 在技术层面通过空间记忆机制、历史信息保留以及抗漂移训练等方式,提高长时间生成过程中的稳定性。目前模型支持 720p / 24 FPS 实时流式生成,并展示了超过一分钟的连续探索能力。 让我觉得这个方向有意思的地方,是它可能会重新定义未来数字内容的生产方式。 以游戏行业为例,过去一个虚拟世界需要大量人工制作:美术设计地图、程序编写规则、策划设计剧情。开发者需要提前创造一个固定世界,而玩家进入后按照既定规则体验。 但如果世界模型进一步发展,未来的游戏可能不再只是“开发者搭建世界,玩家进入世界”,而是“开发者定义规则,AI 实时生成世界”。玩家体验的不再是一个完全预设好的内容,而是一个随着交互不断变化的环境。 当然,Alaya World 目前仍然处于早期阶段。实时生成所需的算力成本、复杂环境理解能力,以及更长期、更稳定的世界一致性,都还有很多问题需要解决。但它让我看到一个值得关注的趋势:AI 的竞争可能不会只停留在生成更漂亮的图片和视频,而是进一步走向创造更真实、更连续、更可交互的世界。 过去,人类通过电影记录想象,通过游戏创造虚拟空间。而未来,也许我们只需要描述一个想法,AI 就可以帮助我们生成一个能够进入其中、探索其中的世界。 从生成内容,到生成世界,这可能是 AI 下一阶段最值得期待的变化之一。

Ashlyn He

12,459 görüntüleme • 1 ay önce

惊艳!这个真的太有用了!!! 做过视频的人才知道!这个有多么刚需!! 各种生成式模型发展到现在,其实一直有一个痛点没有很好的解决! 即便是最强大的Seedance2.5模型,能够带来稳定的画面表现, 但是要想得到比较好的画面音效,可能并不容易, 更糟心的是,如果生成一条视频,画面很棒但音效有瑕疵! 除了大量抽卡,或者靠后期优化,基本没有其他办法! 万万没想到,Pika居然针对视频音效出了新模型!这需求洞察力真是绝了! 这次 Pika 一口气发布了 4 款 Audio Models,主打 least expensive,生成更快,成本更低,我对比了一下,常见声音模型里,价格几乎最低! 我觉得最实用、也最好玩的就是Video-to-audio,上传一段视频,它会根据画面内容自动生成(或补全)相匹配的环境音、音效、音乐甚至是人物配音。 下面这个视频就是一段30秒的无声视频,然后用Pika Soundtrack 直接生成的音效音轨,我特意用了一段声音要求比较复杂的画面,不光要壁炉的柴火声,还要小猫的叫声和呼噜声,以及窗外的雨声,更重要的还要表现出声音之间的层次和空间关系,最后的成片真的完成度很高!! 如果几个模型搭配着用,还能一次搞定BGM+音效+旁白。 这简直让AI生成内容的可控性上升了好几个level!

沐阳

20,131 görüntüleme • 1 ay önce

Pixverse 发布 R1 实时视频世界模型 藏师傅也试了一下 前几天测试的 Pixverse R1 终于发布了,这是一个可以实时生成并且可以随时通过提示词介入修改后续内容的世界模型。 极限情况下可以实时生成 1080P 的高清视频,感觉成本再下来一点以后 AI 游戏和交互式的影视内容有戏了啊。 ------ 简单介绍一下使用体验,目前他们在一个单独的平台测试需要邀请码。 你可以选择预制的的三个主题进行体验,三个主题分别是巨龙巢穴、二战主题、海底世界,正式版本会增加到 6 个。 也可以创建自己的主题,选择画面比例、风格输入主题相关提示词就可以了。 生成之后主要的互动就是在他播放的过程中输入提示词来改变当前视频生成的剧情走向。 而且这里生成的视频居然还是带音乐、音效混合旁白的,比以前所谓的实时生成的模型强了不少。 ------ 算法和架构上主要的优化有: 这是个原生的多模态模型支持将文本、图像、视频、音频统一为连续的 Token 流,接受任何模态的输入。 PixVerse-R1 改成了非扩散的自回归架构,用来实现无限连续的生成,还使用了增加注意力机制,确保长时间生成的内容一致性。 为了适配实时视频生成的性能,他们将原来的迭代降噪逻辑进行了多项优化,他们叫瞬时响应引擎 (IRE),主要包括三个优化: Temporal Trajectory Folding:传统模型从噪点到清晰图像需要迭代几十步,他们直接暴力压缩到仅需 1–4 步。 Guidance Rectification:直接将传统的 CFG 逻辑蒸馏到了模型参数内部,节省了时间。 Adaptive Sparse Attention:生成高分辨率的视频的时候让模型学会学会“抓大放小”,自动识别重要区域进行精细计算,大幅降低计算负载。 ------- 目前由于成本问题需要邀请码才能测试,生成的分辨率是 480P,过几天会提高到 720P。

歸藏(guizang.ai)

16,373 görüntüleme • 8 ay önce