Loading video...

Video Failed to Load

Go Home

多目标与多关节的实时「物理姿态追踪系统」(Multi-Object Marker Tracking)。 开发者展示了通过高频相机与平面标记,同时、无延迟追踪多个实体目标与人形娃娃关节三维姿态的演示。 👇 深度拆解:

18,565 views • 3 months ago •via X (Twitter)

0 Comments

No comments available

Comments from the original post will appear here

Related Videos

【AI视频X绘画每日一词】一镜十姿 过去做AI时装视频,最常见的问题不是人物不够漂亮,而是每换一个姿势,脸、衣服和身体比例也跟着变了。 「一镜十姿」要做的,是让同一个人物在同一空间里连续完成十个不同姿态:身份不变、服装不变、影棚不变,只让身体语言与画面节奏不断升级。 🎯 核心提示词 上传图1作为人物身份与服装的唯一参考。 生成一段15秒、9:16竖版、时尚杂志大片质感的连续表演视频。 人物严格保持图1的脸型、五官、发型、肤色、年龄、体型及服装结构。场景为极简专业摄影棚,背景、地面、灯位和人物站位保持稳定。 人物依次完成十个具有明显轮廓差异的时装姿态: 正面站立、肩部前倾、单手叉腰、身体侧转、回头凝视、交叉迈步、轻甩衣摆、低位俯身、向镜头逼近、最终封面定格。 每个姿态都由上一个动作自然生长出来:转身必须经过重心移动,迈步必须完成脚掌落地,甩动衣摆后保留真实惯性。关键姿态短暂停顿0.3—0.5秒,让观众能够看清身体轮廓。 摄影机使用50毫米镜头沿Z轴稳定缓慢后退,与人物始终保持合理距离。利用摄影闪光、衣摆掠过镜头、甩发和快速转身形成节奏强调,但不切换场景。 硬质侧光勾勒身体线条,柔和正面补光保留面部细节。真实布料褶皱、头发惯性、鞋底接触阴影与自然运动模糊,整体具有高级时装编辑感。 禁止换脸、年龄漂移、服装变色、衣服结构重组、肢体复制、关节反折、脚步滑行、人物瞬移、背景跳变、无意义环绕、十张图片式硬切和每个动作重新起步。 💡 核心逻辑 一镜十姿由三把锁构成: 身份锁,保证始终是同一个人; 服装锁,证明这是同一场拍摄; 动作链,让十个姿态属于一次连续表演。 真正高级的地方,不是姿势数量多,而是上一个动作的力量能够传递到下一个动作。 ⚙️ 关键控制点 先用四至六个姿态测试身份稳定性,再扩展到十个。姿态之间至少改变手臂轮廓、身体朝向或重心位置中的两项,不能只是轻微挪动手掌。 如果制作静态图,可以从视频中提取六个3:4独立关键帧;六张保持人物和服装一致,但至少覆盖正面、侧面、背身回望、低机位、近景和全身六种画面关系。 验收时重点检查三个位置:转身时的人脸、交叉迈步时的双腿、甩衣摆时的手指。这三个瞬间最容易出现身份与肢体错误。 📌 一句话总结 普通摆拍是在重复姿势,一镜十姿是让同一个角色用身体完成一场连续的视觉表演。

Derek Wen|德里克文

16,197 views • 1 month ago

刚去小米店摸了下它的折叠机有感,大家有没有注意到在安卓这边折叠机都叫“Fold”,而苹果选了“Duo”。 其实从字面意思来看,Fold就是折叠,强调这个动作,很直观,但苹果使用了Duo这个从拉丁语来的词,它其实是有一组,一对的意思,是个组合。重点从“能折”转到“两种体验(一个手机两个形态,手机+iPad)是一对、能一起用合二为一,强调的是体验。 现在在回过头来看苹果的那个折叠动画,就解释了这个Duo,它从手机形态打开到iPad形态,或者反过来闭合起来,动画是连续的,强调只是变了形态,从人的大脑认知来看也是一样,你看到的东西没有消失后又出现一次。并没有安卓那样,从一个形态关闭后,又重新打开了另一个形态,中间过程不连续,是断开的。所有安卓折叠机都是这样,你在外屏打开一个app,在展开的时候,内屏是从黑到重新打开app的一个过程。所以并不能简单理解苹果的和其它安卓在这方面,就是多做了个过场动画那么表面。 另外苹果在这个时候推出Duo,一个呢,当然也是供应链技术发展到了苹果认为相对成熟的时候,二呢,也是它的AI布局,目前Apple Intelligence在今年也会迎来大更新,苹果相信在手机+iPad这个二合一的组合形态下,人们可以更好的体验AI的各种操作。简单的任务可以在手机形态下进行,复杂点的比如Codex和Claude这样的编程任务,也方便在iPad这个形态下进行。 如果说安卓或者是更早的微软Surface Duo开启了折叠这个形态,那么Apple可以说是重新定义了它。后续发展会更有意思,感谢自己处在这个科技飞速发展的时代,可以亲自见证这些迭代的过程。 当然我个人现在并不会买第一代的Duo,毕竟它相机过于拉胯了,这个是我个人非常看重的一个工具。 大家Enjoy!😊

小鹏Digital

28,951 views • 24 days ago

深夜坐地铁人不多,忙完一天归家的感觉真不错 #每日豆包免费生成 提示词: 首帧继承:以上传图片作为视频首帧与唯一视觉基准,严格保持同一人物身份与面容特征,不换脸,不改变五官比例、脸型轮廓、眼睛形态、发型发色、高马尾造型、肤色、白色修身短袖、深色牛仔裤、地铁内环境、座位位置、地铁车厢区域、光照方向、画面比例与整体手机摄影质感。保持现代地铁车厢明亮冷白光环境、真实空间透视、生活化抓拍氛围与原始构图完全一致。 10秒一镜到底,节奏精准踩点但运镜绝对丝滑自然,无任何硬切换。真实高端手机后置人像模式拍摄风格,2x轻长焦视角。从当前胸部以上半身构图开始,镜头以稳定器质感缓慢向人物左前方环绕约30度,同时持续轻微前推,每一次鼓点只对应自然的镜头节奏变化与人物微表情变化。 第1秒,人物保持双腿自然交叠姿态,安静玩手机,嘴角带有若有若无的浅笑;第2秒踩点时,镜头轻微前推上移,人物轻轻抬起下巴,眼神更加聚焦镜头;第3秒,镜头继续向上移动,人物自然眨眼一次,耳侧碎发轻微晃动,人物后面的地铁车窗同时倒映成拍摄者的身影,身影为年轻帅气男性;第4秒踩点时,人物微微歪头约5度,笑意变得更加柔和;第5秒,镜头继续环绕,展现更立体的三分之二侧脸轮廓,人物目光始终跟随镜头;第6秒踩点时,人物轻轻放松肩膀,身体重心自然变化,展现真实站姿;第7秒,镜头略微升高,突出眼神、鼻梁与面部轮廓光影层次,背景人流自然经过形成空间纵深;第8秒踩点时,人物目光短暂看向地铁车厢内指示牌方向,随后缓慢回到镜头;第9秒,镜头轻微前推至更近距离构图,人物露出更加温暖自然的微笑;第10秒最终踩点落下,人物微微歪头并直视镜头,眼神清澈明亮,笑容自然舒展,镜头停留在最具亲和力与真实感的近景画面定格结束。 动作真实自然,符合真实地铁车厢内场景逻辑,无摆拍感,无夸张演技。重点展现正面、微侧面、三分之二侧颜、眼神交流与自然微笑等多个角度的美感。保留真实皮肤纹理、细微绒毛、自然呼吸起伏、发丝细节、衣物褶皱与真实肢体重心变化。背景乘客自然坐在地铁车厢两边座位上,地铁隧道内灯光与车厢内环境保持真实运行状态,形成真实地铁车厢内氛围。 画面质感:真实高端手机原相机直出风格,接近iPhone Pro系列或旗舰安卓后置人像模式效果,自然HDR,真实视频噪点,轻微动态模糊,真实镜头呼吸感,轻微稳定器运动轨迹。保留自然肤质与毛孔细节,不过度磨皮,不过度锐化。整体色彩以白色、银灰色、深蓝色为主,呈现干净、通透、现代都市丽人感与高质量生活记录短视频风格。 背景配乐:高级感电子流行节拍融合轻柔钢琴旋律与都市氛围音色,每秒均有明确但克制的踩点节奏。镜头推进、歪头、眨眼、目光移动与微笑变化精准对应音乐鼓点,形成流畅自然且富有节奏感的沉浸式观感。 负面要求:禁止穿模,禁止换脸、禁止改变年龄、禁止改变发型发色、禁止改变服装与饰品、禁止改变地铁车厢结构与背景布局、禁止新增主要人物、禁止动漫化、禁止卡通化、禁止CG感、禁止AI塑料皮肤、禁止过度磨皮、禁止过度锐化、禁止夸张表情、禁止夸张肢体动作、禁止眼神漂移、禁止手部畸形、禁止面部变形、禁止背景扭曲、禁止闪烁跳帧、禁止镜头瞬移、禁止硬切镜头、禁止突兀推拉、禁止光照突变、禁止服装穿模、禁止低清晰度、禁止色彩失真、禁止不真实景深变化,确保全程保持首帧一致性、真实手机摄影质感、一镜到底流畅运镜与高级都市丽人镜头感。9:16。

AIVideoHub 🕊️

38,327 views • 2 months ago