Загрузка видео...

Не удалось загрузить видео

На главную

兄弟萌只用一张照片,你就能变成任何人 这可能是今年最危险的开源项目:Deep-Live-Cam 只需要 一张照片, 你就可以在摄像头里——变成任何人。 而且是: 实时(Real-time)换脸 + 视频通话直接用 GitHub 已经 81.5k+ (持续爆涨) 它到底有多离谱? 把深度伪造(Deepfake)变成实时工具 你可以: -实时视频换脸(直播 / Zoom / Discord) -一键生成 Deepfake 视频 -多人同时换脸(多人场景也能跑) -做梗图 / Meme / 内容创作 而且操作极其简单: 选脸 → 选摄像头 → 点击开始 1. 实时(不是后期) 大多数 deepfake 还是渲染视频, 这个是直接在摄像头里跑 2. 只需要一张图 不需要训练模型,不需要数据集 3. 多平台 + 硬件加速...

23,011 просмотров • 4 месяцев назад •via X (Twitter)

Комментарии: 0

Нет доступных комментариев

Здесь появятся комментарии из оригинального поста

Похожие видео

真正言出法随的AI视频工具,终于被我找到了!! 而且还是个100%开源的视频世界模型项目! 这个用来做视频真的很高级! 先说一个长期的“痒点”,做AI视频为了保证空间场景的一致性, 不得不生成一大堆各种角度的场景的图片作参考约束, 要确保正反打都不会穿帮,要确保镜头转过去再转回来场景不走形, 但其实,这个方法很原始! 但如果,直接可以生成一个高度一致性的空间, 让人物站在该有的位置,并且还能够自由控制镜头在空间里的运动, 所有一致性的困扰,就全部解决了!! AlayaWorld Alaya Lab 就完全是这个思路, 根据任何图片和视频,实时渲染一个自由空间, 先固化一个场景,然后人物和道具进场,先搭景再拍摄, 这样做视频的体验,就无限接近于真实片场! 你就像一个导演,站在片场里,并且拥有“言出法随”的能力! 改天气、换演员、换服装、甚至直接换场景,可玩性和可控性全部拉满, 突发奇想的指令或者是已经设置好“技能”,就可以实时渲染出来! 而且这个时长不受限制,一个空间里,“拍摄”多久都可以。 想想就很爽,这种创作体验,是前所未有的!! 不光是视频,这也完全是彻底改变游戏行业的存在。 尤其是那种沉浸感很强的第一人称游戏! 越说越激动,这个项目现在是完全开源的, 有兴趣的朋友,真的可以关注一下这方面的趋势, 我觉得在这个探索世界模型的阶段, 这个,就是最好的落地应用!!

沐阳

29,332 просмотров • 17 дней назад

昨天母亲节,我回来家里陪妈妈吃饭,当小学教师的表妹让我给她演示下AI都有什么作用😂 刚好看到ring-2.6-1t 免费,我就试了下做个小红书很火的班级灵宠系统,本来以为应该要花点时间,但没想到速度惊人的同时质量也过硬! 这个 demo 让我最强烈的感受是:ring-2.6-1t 不像是在“回答我”,更像是在把我的想法直接推到现实里。 我只是生成了一个小学班级灵宠积分系统:学生打卡、做作业、考高分,就能给宠物攒积分、升级、冲排行榜的prompt。换成以前,这可能会停在一份 PRD、一张功能表,或者一段“你可以这样做”的建议里。 但ring-2.6-1t 直接把它变成了一个能打开的网页小工具。 你能看到全班宠物墙,能给学生加分扣分,能看等级进度,排行榜也会跟着变化。那一刻很微妙:它不再只是“懂你要什么”,而是把你脑子里的模糊需求,变成了一个可以被点击、被验证、被修改的东西。 这也是我觉得它最有价值的地方。 很多真实工作,其实不需要一套宏大的系统。我们只是需要一个临时的操作台:拆费用、排任务、调动画、做报名页、整理素材。用完就可以丢掉,但在那个时刻,它真的帮你把事情往前推了一步。 ring-2.6-1t的厉害,不是替你完成工作,而是先给你造出一个工作现场。然后,你在里面完成工作。 不得不说,我的表妹已经决定好好学习AI了,或许这就是好模型的意义。 Ring-2.6-1T 模型已经在openrouter发布了,限时免费一周,地址是

阿川 | AI thinking

13,343 просмотров • 2 месяцев назад

看到 Gemini 3 Flash 发布的时候, 第一反应是:终于有人跟 OpenAI 打价格战了。 更快、更便宜、还能免费用—— 这才是独立开发者和小团队真正需要的东西。 价格到底便宜多少? 简单说:如果你之前用 GPT-4o 或 Gemini 3 Pro 跑应用,换成 Gemini 3 Flash,成本预计能直接降 50%-70%。 ZenMux 已经第一时间上线了 Gemini 3 Flash,并且每天有免费额度——你可以直接在 chat 里调用,不用单独申请 API,不用写代码集成。 我扒了推特上互动最高的几个帖子,发现大家兴奋的点主要是: 【零代码生成 3D 交互场景】 有人用简单文本提示,生成了一个 Three.js 场景:数百万粒子悬浮在屏幕上,可以用手势控制它们形成任意形状。不需要懂 Three.js,不需要懂 WebGL,甚至不需要懂 HTML。 【从截图到完整落地页】 有人从零开始做了一个完整的产品落地页。先上传参考网站截图,然后逐步添加图标、动画、效果。整个过程像在跟设计师对话,而不是在写代码。 【5 分钟做出能用的 App】 有人做了个视频录制工具,AI 实时根据你说的内容给提示词,防止你卡壳。还有人做了手语识别 app,带置信度分数、采样设置、实时提示。 现在,你可以用更低的价格重新实现一边这些! 验证想法的成本降到接近零——你可以在一个下午内做出 5 个不同方向的原型,丢给用户测试,看哪个有反馈再深入。

Cell 细胞

23,039 просмотров • 7 месяцев назад

AI 视频制作也接近了 GPT 时刻,视频智能体背后的工作原理🧵 AI 产品都有个可用性易用性的临界点,临界点之下,属于专业玩家的玩具,需要各种提示词技巧、专业知识才能用起来;临界点之上,就真正变成了普通人也可以用起来并且有用的工具。就像 AI 聊天,在 ChatGPT 之前,我们常笑话它们是人工智障,在 ChatGPT 之后,它是真的变成了一个有帮助的助手,能帮助我们完成很多任务,所以我们通常把 AI 产品跨过可用性通用型临界点叫 GPT 时刻。 类似的比如前不久 GPT-4o 发布的图片模型,提示词很简单,不需要像 MidJourney 那样需要专业的提示词才能生成好的图片作品,普通人都可以把自己天马行空的想法变成真实有趣的作品,我这样非专业的都玩了好一段时间。 像 AI 视频类产品我一直没怎么玩,因为对于我这样的非专业人士来说,做好视频太难了,创意和提示词反倒相对容易一点,主要是得写脚本、画图、声音、多条视频,剪辑,做好一条视频要费很多时间精力。 不过上面这条视频倒是没花我多少时间,我就输入了一条提示词: > 生成视频,主题是“西游记人物自拍视频,用自拍的方式来讲述《西游记》经典场景”,视频长度为2分钟。 发送到纳米AI然后等着就成了,整体看着还挺有趣,有画面有声音有剧情。让我觉得 AI 视频终于也接近了 GPT 时刻,普通人也可以通过简单的提示词就能做出还不错的视频作品,动动嘴就能出视频。对于创作者,也可以快速制作视频 Demo,将创意想法快速落地。

宝玉

26,346 просмотров • 1 год назад