Loading video...

Video Failed to Load

Go Home

随着GPT 6 Astra的发布,建模能力和速度更上一层楼,我非常建议aigc创作在有复杂运镜、特定动作、长镜头的情况下使用白模辅助来生成 但是,值得注意的是,白模的精细度最好不要太精致,否则会大大约束了模型的发挥空间,那就会导致两种结果 1.模型会1:1完全复刻你的白模视频,但是你的白模又是一个“粗模”的预演参考,最后生成出来就会四不像 2.要么你就非常细致的完成这个白模的细节,只留下材质让ai模型完成,这就有点悖论了,你建模都弄得这么完美还要ai生成干啥? 所以除了你必须要求的一些特定动作或者运镜,其他一律生成粗模,连丧尸或者某个物体都可以用圆柱代替,然后提示词补强,这才是最佳用法

27,250 views • 5 days ago •via X (Twitter)

32 Comments

Foyege's profile picture
Foyege5 days ago

原片在这,后续出配合白膜的提示词怎么写教程

Flying puppy25's profile picture
Flying puppy255 days ago

就喜欢看你教白模,牛逼的天花板👍

Foyege's profile picture
Foyege5 days ago

后面再出详细的

Flying puppy25's profile picture
Flying puppy255 days ago

每次看到白模都头疼, 摆个静止的没问题,但是运动起来我总觉得有点难。😭

𝑨𝒇𝒓𝒊𝒏's profile picture
𝑨𝒇𝒓𝒊𝒏5 days ago

That's a smart tip for complex AIGC shots.

jacky2055's profile picture
jacky20555 days ago

也做了一次尝试:

𝟡𝟜 ᴾᴸᴬʸᶠᴼᴿᴳᴱ's profile picture
𝟡𝟜 ᴾᴸᴬʸᶠᴼᴿᴳᴱ5 days ago

观后感:我要玩 生化危机

Foyege's profile picture
Foyege5 days ago

生化危机!启动!

古一's profile picture
古一5 days ago

学到了

Foyege's profile picture
Foyege5 days ago

真的能帮上你吗 古一老师 哈哈哈

波妞PONYO's profile picture
波妞PONYO5 days ago

是的,最近就踩雷了这个~

Foyege's profile picture
Foyege5 days ago

太精细其实提示词也能控,就是增加了抽卡的概率,文字越多越容易乱

gdd's profile picture
gdd5 days ago

现在遇到的最大的问题就是白模上色,有的时候复杂的运镜真的一点都绑定不上,博主可以分享一下你的绑定提示词吗,用于人物和镜头双向运动的白模上色提示词

Foyege's profile picture
Foyege5 days ago

等我出教程。 视频和文章都会出

Rion Wu's profile picture
Rion Wu4 days ago

学到了🫡

探路AI's profile picture
探路AI5 days ago

是的,1比1 复刻白模,人物的动作会变的僵硬,没那么自然

Foyege's profile picture
Foyege5 days ago

所以不要太精细,用提示词去补充

Whoever's profile picture
Whoever5 days ago

视频生视频是不是非常贵,如果用sd2.5?

Foyege's profile picture
Foyege5 days ago

在libtv的话有参考视频会多300积分,其他平台不知道了,你可以问一下codex seedance2.5有公开收费文档

Whoever's profile picture
Whoever4 days ago

好的,谢谢。你用的是LIBTV对吗

oliver ma's profile picture
oliver ma5 days ago

为什么我用粗模做的移动,无论提示词怎么写跑步,SD2.5死活不给跑?

Foyege's profile picture
Foyege5 days ago

白模的关系没约束好

ity's profile picture
ity5 days ago

15s 的粗模需要建模多长时间?

Foyege's profile picture
Foyege5 days ago

十分钟左右吧

PixelAIGC's profile picture
PixelAIGC5 days ago

太专业了,学不完学不完

Foyege's profile picture
Foyege5 days ago

没呢 一点自己制作的拙见 哈哈

Foyege's profile picture
Foyege4 days ago

另一条靠blender控构图和分镜的案例

z ww's profile picture
z ww5 days ago

等后续教程

COSMOS's profile picture
COSMOS4 days ago

wf

Nibili's profile picture
Nibili5 days ago

平面场景想要景深效果更好,是不是要用3D?请问你的场景怎么做的呢

Foyege's profile picture
Foyege5 days ago

你说景深是大光圈还是空间纵深感啊?

Nibili's profile picture
Nibili4 days ago

空间纵深感

Related Videos

OpenAI 的大神 Andrej Karpathy 前几天在他的 YouTube 频道讲了一堂课,系统的介绍了大语言模型,内容深入浅出,非常赞,抽空将它翻译成了双语,由于内容较长,我将分批上传,以下是第一部分精校后的双语视频,字幕文稿如下: Intro: Large Language Model (LLM) talk 大家好。最近,我进行了一场关于大语言模型的 30 分钟入门讲座。遗憾的是,这次讲座没有被录制下来,但许多人在讲座后找到我,他们告诉我非常喜欢那次讲座。因此,我决定重新录制并上传到 YouTube,那么,让我们开始吧,为大家带来“忙碌人士的大语言模型入门”系列,主讲人 Scott。好的,那我们开始吧。 LLM Inference 首先,什么是大语言模型 (Large Language Model) 呢?其实,一个大语言模型就是由两个文件组成的。在这个假设的目录中会有两个文件。 以 Llama 2 70B 模型为例,这是一个由 Meta AI 发布的大语言模型。这是 Llama 系列语言模型的第二代,也是该系列中参数最多的模型,达到了 700 亿。LAMA2 系列包括了多个不同规模的模型,70 亿,130 亿,340 亿,700 亿是最大的一个。 现在很多人喜欢这个模型,因为它可能是目前公开权重最强大的模型。Meta 发布了这款模型的权重、架构和相关论文,所以任何人都可以很轻松地使用这个模型。这与其他一些你可能熟悉的语言模型不同,例如,如果你正在使用 ChatGPT 或类似的东西,其架构并未公开,是 OpenAI 的产权,你只能通过网页界面使用,但你实际上没有访问那个模型的权限。 在这种情况下,Llama 2 70B 模型实际上就是你电脑上的两个文件:一个是存储参数的文件,另一个是运行这些参数的代码。这些参数是神经网络(即语言模型)的权重或参数。我们稍后会详细解释。因为这是一个拥有 700 亿参数的模型,每个参数占用两个字节,因此参数文件的大小为 140 GB,之所以是两个字节,是因为这是 float 16 类型的数据。 除了这些参数,还有一大堆神经网络的参数。你还需要一些能运行神经网络的代码,这些代码被包含在我们所说的运行文件中。这个运行文件可以是 C 语言或 Python,或任何其他编程语言编写的。它可以用任何语言编写,但 C 语言是一种非常简单的语言,只是举个例子。只需大约 500 行 C 语言代码,无需任何其他依赖,就能构建起神经网络架构,并且主要依靠一些参数来运行模型。所以只需要这两个文件。 你只需带上这两个文件和你的 MacBook,就拥有了一个完整的工具包。你不需要连接互联网或其他任何设备。你可以拿着这两个文件,编译你的 C 语言代码。你将得到一个可针对参数运行并与语言模型交互的二进制文件。 比如,你可以让它写一首关于 Scale AI 公司的诗,语言模型就会开始生成文本。在这种情况下,它会按照指示为你创作一首关于 Scale AI 的诗。之所以选用 Scale AI 作为例子,你会在整个演讲中看到,是因为我最初在 Scale AI 举办的活动上介绍过这个话题,所以演讲中会多次提到它,以便内容更具体。这就是我们如何运行模型的方式。只需要两个文件和一台 MacBook。 我在这里稍微有点作弊,因为这并不是在运行一个有 700 亿参数的模型,而是在运行一个有 70 亿参数的模型。一个有 700 亿参数的模型运行速度大约会慢 10 倍。但我想给你们展示一下文本生成的过程,让你们了解它是什么样子。所以运行模型并不需要很多东西。这是一个非常小的程序包,但是当我们需要获取那些参数时,计算的复杂性就真正显现出来了。 那么,这些参数从何而来,我们如何获得它们?因为无论 run.c 文件中的内容是什么,神经网络的架构和前向传播都是算法上明确且公开的。

宝玉

1,124,245 views • 2 years ago

Qwen3-Next-80B-A3B 实测! 能跟头部模型对打吗? 直接说结论, 能完成我这个大象牙膏测试的一部分, 已经很厉害了, Python 杯子倒水那个测试表现也可圈可点. 来看测试中暴露出来的问题: 首先这个模型生成的样式特别多变, 可以看测试中生成的前端页面的样式和布局, 几乎每次都不一样. 所以实际使用中, 可能会存在稳定性的问题, 建议 prompt 中多做约束, 避免模型过度发挥. 不过这并不全是坏处, 如果拿这个大模型写文, 反而可能会超常发挥, 每次写出来的东西都不一样, 不会呆板. 另外目前发现最大的问题是, 给到模型一大堆数据, 让模型整理一个网页, 结果模型偷懒了, 直接把代码和数据省略掉了, 这个应该还是 GPT-4 时代的问题 (24年上半年) 出现了. 这里猜测可能是高稀疏性专家混合模型或者多词元预测造成的问题, 这两个都会在生成中选择最经济的生成模式, 因此可能会倾向于生成"此处代码省略"这样的代码来替代原本要生成一大堆代码的场景. 召回倒是没太大问题, 鞭炮连锁爆炸那个测试, 虽然模型没有成功写出来, 但是最长的一次还是生成了1100行代码, 我仔细看了下, 基本都考虑到了我 prompt 中要求的逻辑, 只不过实现的代码有 bug 跑不起来而已. 综合来讲, 我觉得这应该是 100B 以内的模型无敌手了, 考虑到定位可能是个新的技术试验模型, 所以期待千问推出更大规模 (例如400B-A15B) 的模型, 带来更好的性能. 测试 prompt: #Qwen3Next #大模型竞技场 #Qwen3

karminski-牙医

30,709 views • 1 year ago