歸藏(guizang.ai)'s banner
歸藏(guizang.ai)'s profile picture

歸藏(guizang.ai)

@op7418171,515 subscribers

关注人工智能、LLM 、 AI 图像视频和设计(Interested in AI, LLM, Stable Diffusion, and design) 歸藏的 AIGC 周刊|公众号:歸藏的AI工具箱

Shorts

李飞飞的 World Labs 发布了他们新的世界模型 Atlas,这个看起来比上一代厉害多了。 通过一张图片就可以创建一个非常完整的 3D 空间场景,你可以在里面随意运动,它也能理解时间的演变规律。 它能将一张或多张输入图像整合进一个共享的空间上下文中,让每张图像都锚定在三维空间中的具体位置,再以此继续生成后续内容,既能保证当前场景的一致性,又能想象出没有看到的内容。 它主要支持三大任务: 生成图像和视频:能从一张或多张参考图出发,以像素级精确的相机控制生成不同角度的图像或完整视频,最长可输出 1 分钟 1440p 的视频 3D 场景重建:用一张或几十张图片重建真实的 3D 场景,直接生成点云、3D 高斯泼溅(3D Gaussian Splatting)等三维结果(图片越多还原越真实),效果甚至超过了专门针对 3D 高斯泼溅优化的模型 时空仿真:能把几台普通手机拍摄的视频重新取景成“子弹时间”效果,还可以为机器人训练生成测试数据

李飞飞的 World Labs 发布了他们新的世界模型 Atlas,这个看起来比上一代厉害多了。 通过一张图片就可以创建一个非常完整的 3D 空间场景,你可以在里面随意运动,它也能理解时间的演变规律。 它能将一张或多张输入图像整合进一个共享的空间上下文中,让每张图像都锚定在三维空间中的具体位置,再以此继续生成后续内容,既能保证当前场景的一致性,又能想象出没有看到的内容。 它主要支持三大任务: 生成图像和视频:能从一张或多张参考图出发,以像素级精确的相机控制生成不同角度的图像或完整视频,最长可输出 1 分钟 1440p 的视频 3D 场景重建:用一张或几十张图片重建真实的 3D 场景,直接生成点云、3D 高斯泼溅(3D Gaussian Splatting)等三维结果(图片越多还原越真实),效果甚至超过了专门针对 3D 高斯泼溅优化的模型 时空仿真:能把几台普通手机拍摄的视频重新取景成“子弹时间”效果,还可以为机器人训练生成测试数据

121,439 views

坏了!这下真能玩了 用 Seedance 2.0 直接把GPT Image 2 生成的 ARPG 《金瓶梅》游戏做成动态的了 UI 交互和两个画面之间的衔接都做了

坏了!这下真能玩了 用 Seedance 2.0 直接把GPT Image 2 生成的 ARPG 《金瓶梅》游戏做成动态的了 UI 交互和两个画面之间的衔接都做了

1,334,793 views

Ox Alpha 做的这个还是动态的

Ox Alpha 做的这个还是动态的

31,865 views

又跑了一条《黑神话:林冲》的游戏演示,这个效果超级好! GPT-Image-2.0 + Seedance 2.0 所有的交互 UI 全都是动的,而且还有台词。 要不是画面这个涂抹感,我真看不出来!

又跑了一条《黑神话:林冲》的游戏演示,这个效果超级好! GPT-Image-2.0 + Seedance 2.0 所有的交互 UI 全都是动的,而且还有台词。 要不是画面这个涂抹感,我真看不出来!

300,510 views

再开一个帖子记录一下我发现的一些 Sora 2 的玩法 感觉这次抽卡属性更重,需要少写点,让 AI 去发挥更能整出抽象活来 比如让 Sora 2 整一个最近很火的《力工梭哈定律》小剧场。 提示词:用16bit 像素画风的故事表现这个定义:

再开一个帖子记录一下我发现的一些 Sora 2 的玩法 感觉这次抽卡属性更重,需要少写点,让 AI 去发挥更能整出抽象活来 比如让 Sora 2 整一个最近很火的《力工梭哈定律》小剧场。 提示词:用16bit 像素画风的故事表现这个定义:

644,602 views

Seedance 2.0 在海外上线以后,很多用户也拿它来做产品宣传动画。 这哥们的提示词写法非常牛皮! 刚好我最近给 CodePilot 做了一个新的 logo,然后就参考了一下,做了新的产品宣传动画。 顺便我总结成了一个提示词,你可以为你的产品也定制类似的 Seedance 2.0 提示词。

Seedance 2.0 在海外上线以后,很多用户也拿它来做产品宣传动画。 这哥们的提示词写法非常牛皮! 刚好我最近给 CodePilot 做了一个新的 logo,然后就参考了一下,做了新的产品宣传动画。 顺便我总结成了一个提示词,你可以为你的产品也定制类似的 Seedance 2.0 提示词。

214,575 views

搞了个好玩的,Nano Banana Pro 帮你生成任意位置的打卡照! 用 Gemini 3 写了个工具,只需要在地图上选点,然后上传你的人脸照片,就可以生成你在这个地方的打卡照。 会根据当前位置的天气和时间生成图片,你的衣服也会根据现在的时间以及天气去变化。 人脸一致性真的太高了,我去。

搞了个好玩的,Nano Banana Pro 帮你生成任意位置的打卡照! 用 Gemini 3 写了个工具,只需要在地图上选点,然后上传你的人脸照片,就可以生成你在这个地方的打卡照。 会根据当前位置的天气和时间生成图片,你的衣服也会根据现在的时间以及天气去变化。 人脸一致性真的太高了,我去。

334,333 views

太离谱了,卧槽,这我真得说脏话了! 动效和 APP 宣传视频 Seedance 2.0 居然也能做! 用他给我写的 Claude Code 桌面端 Codepilot 做了个演示动画视频 这质量,拉满了啊,等后面清晰度上来完全可用了 我只提供了我的提示词、应用介绍和应用效果图 以往这些都只能渲染的,非常麻烦

太离谱了,卧槽,这我真得说脏话了! 动效和 APP 宣传视频 Seedance 2.0 居然也能做! 用他给我写的 Claude Code 桌面端 Codepilot 做了个演示动画视频 这质量,拉满了啊,等后面清晰度上来完全可用了 我只提供了我的提示词、应用介绍和应用效果图 以往这些都只能渲染的,非常麻烦

211,174 views

FLLUX 3 正式可用了 目前支持最长 20 秒、1080P 原生分辨率的视频,后面还会开放 2K 和 4K 分辨率。 此外,它还支持草稿模式,可以以极低成本快速探索创意,然后再重新以完整的质量进行渲染。草稿一次只需要 0.06 美元。 目前支持的功能包括: • 文生图 • 文生视频 • 图生视频 • 生成对应音频和不错的文本渲染能力

FLLUX 3 正式可用了 目前支持最长 20 秒、1080P 原生分辨率的视频,后面还会开放 2K 和 4K 分辨率。 此外,它还支持草稿模式,可以以极低成本快速探索创意,然后再重新以完整的质量进行渲染。草稿一次只需要 0.06 美元。 目前支持的功能包括: • 文生图 • 文生视频 • 图生视频 • 生成对应音频和不错的文本渲染能力

25,721 views

Seedance 2.0 的 4K 分辨率我已经在即梦上线。 看了一下,15 秒是 1200 积分,需要选择 Seedance VIP 版本。 4K 分辨率生成的视频码率为 50M,感觉是为那些做商业片和商业短剧的公司准备的。

Seedance 2.0 的 4K 分辨率我已经在即梦上线。 看了一下,15 秒是 1200 积分,需要选择 Seedance VIP 版本。 4K 分辨率生成的视频码率为 50M,感觉是为那些做商业片和商业短剧的公司准备的。

55,693 views

我去,Sora 你都学了点啥,这女主播声音夹的太标准了 提示词:一个美丽的中国女主播正在直播玩《GTA5》的画面,左上角有摄像头画面,还有直播软件的 UI

我去,Sora 你都学了点啥,这女主播声音夹的太标准了 提示词:一个美丽的中国女主播正在直播玩《GTA5》的画面,左上角有摄像头画面,还有直播软件的 UI

210,323 views

整个大活,我用 AI 写了个工具 帮大家更低成本、更可控的用 AI 生成漂亮的网页! 优雅的解决上个版本提示词不可控和有时候没那么漂亮的问题 👇下面是使用方式和我的开发过程

整个大活,我用 AI 写了个工具 帮大家更低成本、更可控的用 AI 生成漂亮的网页! 优雅的解决上个版本提示词不可控和有时候没那么漂亮的问题 👇下面是使用方式和我的开发过程

244,105 views

字节今天发布了 Seedance 1.5 Pro 视频生成模型 也支持音画同出,比较离谱的是他们支持方言 这一手老陕西人吃面的时候说的陕西话,太牛批了 纯文生视频

字节今天发布了 Seedance 1.5 Pro 视频生成模型 也支持音画同出,比较离谱的是他们支持方言 这一手老陕西人吃面的时候说的陕西话,太牛批了 纯文生视频

110,233 views

Sora 2 很好的把握住了短剧的精髓,太顶了 台词、表演、剧情、配乐都很在线,要是能长点的话真可以跟朋友们拍短剧了! 提示词在下面👇:

Sora 2 很好的把握住了短剧的精髓,太顶了 台词、表演、剧情、配乐都很在线,要是能长点的话真可以跟朋友们拍短剧了! 提示词在下面👇:

132,333 views

太猛了!谷歌 Gemini 直接塞了一个N8N 进去 ​ 把 Opal 塞到了 Gem 功能里面,自然语言创建工作流 ​人人都可以创建自己的带界面的AI应用了,还能分享给其他Gemini用户使用,不消耗你的额度 用这个把我的屏幕使用时间提示词可视化变成了网页。一键生成海报、文本和播客 顺便写个教程👇

太猛了!谷歌 Gemini 直接塞了一个N8N 进去 ​ 把 Opal 塞到了 Gem 功能里面,自然语言创建工作流 ​人人都可以创建自己的带界面的AI应用了,还能分享给其他Gemini用户使用,不消耗你的额度 用这个把我的屏幕使用时间提示词可视化变成了网页。一键生成海报、文本和播客 顺便写个教程👇

99,030 views

测了一下,没想到 Seed 2.1 Pro 还不错啊 补上了 Agent 和 Coding 短板的豆包应该会成为我日后关于内容创作的主要模型。 更多的案例和提示词在文章里

测了一下,没想到 Seed 2.1 Pro 还不错啊 补上了 Agent 和 Coding 短板的豆包应该会成为我日后关于内容创作的主要模型。 更多的案例和提示词在文章里

32,887 views

哈哈,居然真可以! 找了一个抖音擦边视频让 Sora 2 复刻,可以按秒进行动作编排了

哈哈,居然真可以! 找了一个抖音擦边视频让 Sora 2 复刻,可以按秒进行动作编排了

113,525 views

Seedance 2.0 直接把这种口播视频也自动化了 我完全可以 Agent 产出,音频跟本人不一致的问题目前也可以自动化解决 只需要一张你的人脸照片和文本 以后虚空生产视频播客一点问题没有

Seedance 2.0 直接把这种口播视频也自动化了 我完全可以 Agent 产出,音频跟本人不一致的问题目前也可以自动化解决 只需要一张你的人脸照片和文本 以后虚空生产视频播客一点问题没有

71,633 views

Videos