Loading video...

Video Failed to Load

Go Home

🔥兄弟们,AI生成脑洞场景的黑科技直接杀疯了!📸✨ CopilotKit(28k star开源大神级框架)整了个Scene Creator Copilot demo,用Gemini 3 + LangGraph,聊天式一键生成人物、背景、完整场景! 随便甩一句“Luke Skywalker in a cubicle”(卢克·天行者在格子间上班),AI先给你整出纯白背景的Luke照片 → 再生成办公格子间背景 → 最后智能组合成完整场景,还支持你中途审批、编辑、拒绝(真·Human-in-the-Loop,绝不翻车)! 全程聊天交互,实时看进度,生成后还能继续迭代:换姿势、改表情、加道具,随便脑洞多大都行!完美适合做meme、故事板、创意图、甚至小说插画! 核心功能接地气说: 1️⃣ 自然语言描述人物/背景/场景 2️⃣ 多步自动生成 + 实时预览 3️⃣ 你说了算:Approve/Execute/Edit/Abort 4️⃣ Generative UI,边聊边出图超丝滑 开源免费,demo已130 star,主项目28k star冲疯! 速去上手玩(只需Google AI API key,几秒启动): … Repo(速来star冲一波!): 谁先整出个绝活场景晒晒?快来报到!😂💥✌🏻

14,634 views • 6 months ago •via X (Twitter)

0 Comments

No comments available

Comments from the original post will appear here

Related Videos

测试即将发布的录屏软件 #ScreenSage,我也是拼了这张老脸第一次录出镜讲解的视频,做得不好大家多多鼓励。 #10 摄像头去背景:用 Screensage 轻松制作专业教学视频 💡后期摄像头去背景 💡人像边框 💡与动态布局配合,专业感十足! 你可以: 💁‍♂️A Roll:聚焦摄像头,带背景+边框 🖥️操作演示:画中画右下角,去背景+人物描边 👨‍🏫演示+人物互动:画中画中间,演示🖥️作背景+人物去背景💁‍♂️作前景 效果看视频演示内容👇 --- 前几天 Journeyman 给我说,它使用 Screen Studio 最大的痛点就是后期无法给摄像头做虚化、去背景换背景,问我好不好做。 我很高兴,因为好做,有计划做,6月份做。 前两天做图有点头疼,想写会代码换换心情,心想要不就做做看吧,然后一个小时 PUA AI 把去背景做了出来。 不过我一直觉得单纯去背景效果不太好,夜里一醒脑子就想怎么让这个功能更好。然后我想起了看过的「综艺感剪辑」教学,他们常常给人像加一层白色描边,感觉高级多了。 于是早上一醒就睡不着了,赶紧起床肝完描边功能,发了篇预告推特(「赛博菩萨」)。 今天花时间录了下教程,第一次做出镜讲解,录完发现人总是左摇右晃、说话气息很弱,不过好在 ScreenSage 直出的讲解视频质量过硬,出片还算能接受。请大家多多鼓励。给大家抱拳了🙏

野原新之栋 Sintone

28,928 views • 1 year ago

看到 Gemini 3 Flash 发布的时候, 第一反应是:终于有人跟 OpenAI 打价格战了。 更快、更便宜、还能免费用—— 这才是独立开发者和小团队真正需要的东西。 价格到底便宜多少? 简单说:如果你之前用 GPT-4o 或 Gemini 3 Pro 跑应用,换成 Gemini 3 Flash,成本预计能直接降 50%-70%。 ZenMux 已经第一时间上线了 Gemini 3 Flash,并且每天有免费额度——你可以直接在 chat 里调用,不用单独申请 API,不用写代码集成。 我扒了推特上互动最高的几个帖子,发现大家兴奋的点主要是: 【零代码生成 3D 交互场景】 有人用简单文本提示,生成了一个 Three.js 场景:数百万粒子悬浮在屏幕上,可以用手势控制它们形成任意形状。不需要懂 Three.js,不需要懂 WebGL,甚至不需要懂 HTML。 【从截图到完整落地页】 有人从零开始做了一个完整的产品落地页。先上传参考网站截图,然后逐步添加图标、动画、效果。整个过程像在跟设计师对话,而不是在写代码。 【5 分钟做出能用的 App】 有人做了个视频录制工具,AI 实时根据你说的内容给提示词,防止你卡壳。还有人做了手语识别 app,带置信度分数、采样设置、实时提示。 现在,你可以用更低的价格重新实现一边这些! 验证想法的成本降到接近零——你可以在一个下午内做出 5 个不同方向的原型,丢给用户测试,看哪个有反馈再深入。

Cell 细胞

23,039 views • 7 months ago

#AI开源项目推荐:VisualStoryWriting 可视化故事创作:让你笔尖起舞,文思泉涌 想象一下,在你写作的同时,你笔下的世界就活生生地展现在眼前——时间线、世界地图、人物关系图……这一切都会被自动可视化。 更神奇的是,你对这些视觉元素的任何修改,都会立刻同步到你的故事文本中(比如,在地图上拖动一个角色,他在文中的位置也随之改变)。 这就是我们将要在 UIST2025 大会上分享的论文精髓。 我们开发了一款智能文字处理器,它能自动生成三种可视化视图:人物关系图、故事地图和场景时间线。这些视图能清晰地展示角色间的互动、他们在世界各地的足迹,以及故事场景的先后顺序,极大地帮助作者审阅和编辑自己的作品。 审视角色的移动轨迹,从此变成了一项直观的视觉任务。想改变一个角色在某个场景中的位置?太简单了,直接在地图上把他从一个地方拖到另一个地方就行。 调整故事场景的顺序,也只需要在时间轴上拖拽几下,就像整理幻灯片一样轻松。 想要创造一个新角色,或是让他们之间产生新的互动?同样简单,在关系图里新建一个节点,再连上一条线就搞定了。 我们邀请了经验丰富和初出茅庐的创作者们进行了两轮用户研究。结果发现,这些自动生成的可视化图表,能有效地帮助参与者规划故事的宏观修改、追踪故事元素,并探索情节的多种可能性,极大地激发了他们的创造力。 当然,能够帮助作者的可视化方式还有很多。因此,我们提出了一个设计框架,希望能启发未来更多样的可视化故事创作工具的设计。 我们的工作为未来的写作辅助工具奠定了基础——它不再仅仅依赖文字,更能借助视觉的

宝玉

35,626 views • 11 months ago

真正言出法随的AI视频工具,终于被我找到了!! 而且还是个100%开源的视频世界模型项目! 这个用来做视频真的很高级! 先说一个长期的“痒点”,做AI视频为了保证空间场景的一致性, 不得不生成一大堆各种角度的场景的图片作参考约束, 要确保正反打都不会穿帮,要确保镜头转过去再转回来场景不走形, 但其实,这个方法很原始! 但如果,直接可以生成一个高度一致性的空间, 让人物站在该有的位置,并且还能够自由控制镜头在空间里的运动, 所有一致性的困扰,就全部解决了!! AlayaWorld Alaya Lab 就完全是这个思路, 根据任何图片和视频,实时渲染一个自由空间, 先固化一个场景,然后人物和道具进场,先搭景再拍摄, 这样做视频的体验,就无限接近于真实片场! 你就像一个导演,站在片场里,并且拥有“言出法随”的能力! 改天气、换演员、换服装、甚至直接换场景,可玩性和可控性全部拉满, 突发奇想的指令或者是已经设置好“技能”,就可以实时渲染出来! 而且这个时长不受限制,一个空间里,“拍摄”多久都可以。 想想就很爽,这种创作体验,是前所未有的!! 不光是视频,这也完全是彻底改变游戏行业的存在。 尤其是那种沉浸感很强的第一人称游戏! 越说越激动,这个项目现在是完全开源的, 有兴趣的朋友,真的可以关注一下这方面的趋势, 我觉得在这个探索世界模型的阶段, 这个,就是最好的落地应用!!

沐阳

30,167 views • 25 days ago