好玩,不用任何外部美术资源,仅靠代码在 Three.js 里程序化生成一条完整的丛林小径场景。 12000 行手写 JavaScript 搭出一条穿越石质废墟和瀑布的丛林小径,场景里没有一张贴图文件、一个模型或一段录音。树叶、树皮、石头、角色皮肤和全部 60 段音频都在加载时由代码算出来。... show more

Geek
19,579 görüntüleme • 26 gün önce
我开源了我沉淀一年的skill,涵盖写作、深度调研、产品界面优化、代码和文档对齐、角色与文章配图、chatcut自动化剪辑、代码的交付收尾.... 契机: 1.小黄skil篇 陈硕有个设计师小伙伴做了个skill,这个skil是和这个skil是和Ian (伊恩)老师在github上斩获10000stars的小黑skill的共创,出了一个新的形象:小黄 做完才发现,画出一个可爱的角色并不难,难的是:让它在不同文章、动作、场景,甚至2D/3D的变化里,始终还是同一个角色 小黄有固定的角色 DNA:暖黄色种子形身体、爱心天线、椭圆眼睛、腮红和细手脚 它还能读一篇文章,找到真正值得解释的“认知锚点”,再把一个判断、关系或转折画成配图 以下是具体效果和内容呈现👇

陈硕KAI
23,493 görüntüleme • 22 gün önce
李飞飞的 World Labs 发布了他们新的世界模型 Atlas,这个看起来比上一代厉害多了。 通过一张图片就可以创建一个非常完整的 3D 空间场景,你可以在里面随意运动,它也能理解时间的演变规律。 它能将一张或多张输入图像整合进一个共享的空间上下文中,让每张图像都锚定在三维空间中的具体位置,再以此继续生成后续内容,既能保证当前场景的一致性,又能想象出没有看到的内容。... show more

歸藏(guizang.ai)
139,272 görüntüleme • 19 saat önce
爽了,AI视频终于卷起来了,MiniMax H3 牛逼!!! Seedance 2.0 30% 的价格 + 2K... show more

余温
77,303 görüntüleme • 1 ay önce
Google推出了一种在 StableDiffusion 图像生成中保证内容特征一致性的方式。 这个其实是现在图像生成中一个非常重要的问题,故事可视化、游戏开发资产设计、广告等都需要在生成的时候具备角色或者内容的一致性。 从演示来看效果非常好人物角色和其他内容的特征都保持的非常好,他们有一个示例是一个男人的一生十几张不同年龄段的图片都很像能看出来是一个人。 而且这个项目还可以跟 SD 已有的控制方式结合,比如局部重绘和 Controlnet... show more

歸藏(guizang.ai)
125,824 görüntüleme • 2 yıl önce
谷歌也发布了一个根据输入图片和音频就能生成对应人物讲话视频的项目VLOGGER。看起来没有阿里那个自然。 项目简介: 它可以根据一张人物图像,生成由文本和音频驱动的说话人视频。该方法建立在最近生成式扩散模型取得成功的基础之上。 VLOGGER 包含两个关键组件: 1) 一个随机的人体到 3D 运动的扩散模型;... show more

歸藏(guizang.ai)
31,198 görüntüleme • 2 yıl önce
发现一个开源的 AI 视频生成项目,GitHub 已经 7k star 了——InfiniteTalk 它支持图像转视频和视频转视频两种模式,都是语音驱动的。 给一张图片加一段音频,能直接生成说话的视频;给一段已有视频换音频,也能重新配音。... show more

阿西_出海
20,133 görüntüleme • 2 ay önce
我的天,Higgsfield已经进化到这种程度了吗? 一年前我 YouTube 做到 15 万订阅,还多亏了 Higgsfield 的帮助。那时候它还只能凑合生成视频,现在竟然已经开始进入游戏开发领域了。。。 ... show more

逸尘
31,674 görüntüleme • 2 ay önce
被ETH跌抑郁了,就做了一个打V神/小V的小游戏 vitalik.eth 发泄一下🤣 打了一会儿挺解压的。 用 DAPPOS 的AI——xbubble制作的。 自己是一个代码也没用,也不用自己配置环境,全程就对话。 最初生成的不太好,提出了优化条件试了几次,最后发现,要手动选择Compound... show more

TVBee🦅
20,683 görüntüleme • 2 ay önce
一个叫Luna的虚拟女生,每月靠15秒卧室舞蹈视频赚11万美金。 Luna根本不存在。完全是AI生成的。 幕后操手是个19岁加拿大学生,在自己卧室用Python和RTX显卡撑起整个运营。 头发物理效果靠自定义视频扩散模型逐帧生成。 灯光阴影渲染得像真的坐在房间里,不是贴图。 整个流程全自动:抓热门音乐、生成视频、发到40多个账号。他根本不用动手。 周4000万播放量,零运营成本,没签约没旅程没休息日。 背景那张海报是唯一真实的东西了。

路飞 🏴☠️ AI 研究员🧐
325,549 görüntüleme • 1 ay önce
看到好多人在现有影视作品里截几张图或者截段视频, 然后给Seedance2.0做参考, 生成出来的效果不错就大夸特夸, 但越想越不对, 这模型不就是拿海量的这些作品训练的吗?? 另外,还是不建议这么玩, 直接用原角色人物,真的极容易有版权风险! 之前生图,不少人大量用了真实的品牌和产品, 部分账号,就突然无了,... show more

沐阳
10,878 görüntüleme • 6 ay önce
卧槽 影眸科技(Hyper3D) 发布的世界生成模型 WorldGen 有点东西 它和其他可交互世界模型有不一样,它可以从一张 2D 图片,生成是一个完整的自带物理规律 3D... show more

小互
126,808 görüntüleme • 2 gün önce
我去,美团把数字人视频生成模型开源了。外面数字人 Agent 一天卖 50 万,美团直接做了个 LongCat-Video-Avatar 塞进同一个仓库里开源了。 给一张人脸图加一段音频,数字人张嘴念稿,嘴唇、眼神、表情全自动对上。 它不是那种玩具开源,是实打实对标... show more

产品经理老王霸
172,592 görüntüleme • 2 ay önce
穿搭玩法已经做到第 4 个模板了。👀 这次继续用 Seedance 2.0, 让角色在一条视频里连续完成 7 套换装。... show more

小宇Chengzi
58,436 görüntüleme • 24 gün önce
深圳有个22岁的学生,用一部900块的红米手机。 就三月份这一个月,这部手机帮他赚了14700美元。他爸妈到现在还以为他在备考。 手机每隔半小时,自动打开六个中文新闻App。自动翻看新闻标题,截屏,然后把摘要扔给Claude。 AI再把这些新闻和Polymarket上的价格做对比,给出投注建议。 Polymarket→ 整个过程,这个学生一行代码都没写。 靠的是一个开源项目叫PhoneDriver。 原理很简单:AI像人一样看手机屏幕,自己判断要点哪、滑到哪。 你只要用大白话把任务描述清楚就行。... show more

TGweb3
54,631 görüntüleme • 4 ay önce
深圳有个22岁的学生,用一部900块钱的红米手机,就三月份这一个月,愣是帮他赚了14700美元,他爸妈到现在还以为他在备考呢。 手机每隔半小时,自动打开六个中文新闻App,翻看新闻标题、截屏,然后把摘要扔给Claude。AI再把这些新闻和Polymarket上的价格做对比,给出投注建议。 👉 Polymarket官网入口: 整个过程,这个学生一行代码都没写。靠的是一个开源项目叫PhoneDriver。原理很简单:AI像人一样看手机屏幕,自己判断要点哪、滑到哪。你只要用大白话把任务描述清楚就行。手机不用开任何API,也不用碰App的底层代码,模型只看你看到的那些像素。 这个学生的玩法,说穿了也简单。中文新闻是用中文发的,什么监管动作、贸易决策、经济数据,路透社翻译出来之前几个小时,早就挂在微博和今日头条上了。而Polymarket上定价的,是英语世界的交易员。中文新闻出来,到市场反应之间,有20到50分钟的时间差。 他用的六个App里,有三个对爬虫见一个封一个。但PhoneDriver不解析数据,它就像正常人一样用App,只不过比人快,而且不休息。96%的移动应用都没有公开的API,但每个应用都有屏幕。对PhoneDriver来说,这就够了。 如果想在Polymarket上使用跟单交易,我推荐使用:

区块链行情研究
617,805 görüntüleme • 4 ay önce
一个14岁的中国学生,从网上淘了点零件:一块4美元的树莓派Zero,一块3美元的PiSugar电池,再加一块6美元的3.5寸小屏幕。总共13美元,一个从速卖通发来的包裹。 他自己动手焊接、组装好,装上Ollama,塞进去一个Gemma 2b模型——全程不用联网,没有服务器,不花订阅费,也不需要什么API密钥。 然后,他就用这个巴掌大的小东西,把GTA VI的预alpha版给撬开了。那个Rockstar捂得严严实实、外人根本碰不到的版本。 屏幕上跳出了调试控制台,Lucia的物品栏,水体的物理参数……全是只有开发者才能看见的东西。 Rockstar花了十年,两千号工程师守着那个版本。 这孩子就花了13美元和几个晚上。

区块链行情研究
260,699 görüntüleme • 4 ay önce
刚看到 Fable 5 在波音 747 建模测试上的表现,真的有点吓人。 这不是简单的画图,而是用 Three.js 写的完整... show more

Vincent
16,645 görüntüleme • 2 ay önce
小白们辛辛苦苦 Vibe coding 出来的网站,可能只是程序员们的玩物罢了🥲 今天早上在个人站上面加了一个「催 Penny 写代码」的模块,顺便抓取了 GitHub 的日历。扬言「被催多少次,就写多少天代码」。... show more

Penny777 🦊
37,644 görüntüleme • 8 ay önce
用了一段时间 Seedance 2.0,我用了几百次,试着做了短剧、商业广告、文旅宣传片、生活互动小视频、个人vlog,聊点真实感受。 AI 视频从"生成"进入了"创作"时代。以前我们在"用 AI 做视频",现在是"用 AI 拍片"。... show more

Adam也叫吉米
27,863 görüntüleme • 6 ay önce
YouMind 一键生成 ppt 的效果,现在在市面上几乎没有对手。 我把自己的血糖检测与饮食数据同时给给到 ChatGPT 和 YouMind,同样的指令:根据数据报告生成一份精美的、可视化的ppt,给医生看。 背后的生图模型都是gpt-image-2.0,对两者均没有做额外的风格指令、或指定任何skill,可以看到明显的交付区别。 YouMind的产出不仅美观、而且还考虑到了医患场景下的专业度、简洁度、和规范视觉。而GPT的嘛...已无力吐槽。

nene
18,640 görüntüleme • 1 ay önce