Video yükleniyor...

Video Yüklenemedi

Ana Sayfaya Dön

大家好,这是我第五个调整的版本,lora模型已经调到没法再精调的地步了,本次更新是通过Qwen 2511 Edit实现了多机位的拍摄出图,因为据我所知,目前再厉害的开源视频模型无论是wan2.2还是ltx2也无法控制背景中的人物举止神态和汽车行驶的轨迹。所以一旦超出了模型上下文窗口,背景内容就会被重新计算,人就会乱跑,所以我只能通过infinite talk来切镜头保持整个视频的流畅,但是这意味着我必须把多个镜头都要重新生成一遍,3个机位就是3次推理的过程,非常耗时5090就不行了,有必要请如来佛祖的H200帮忙了。

34,285 görüntüleme • 6 ay önce •via X (Twitter)

0 Yorum

Yorum bulunmuyor

Orijinal gönderinin yorumları burada görünecek

Benzer Videolar

OpenAI 的大神 Andrej Karpathy 前几天在他的 YouTube 频道讲了一堂课,系统的介绍了大语言模型,内容深入浅出,非常赞,抽空将它翻译成了双语,由于内容较长,我将分批上传,以下是第一部分精校后的双语视频,字幕文稿如下: Intro: Large Language Model (LLM) talk 大家好。最近,我进行了一场关于大语言模型的 30 分钟入门讲座。遗憾的是,这次讲座没有被录制下来,但许多人在讲座后找到我,他们告诉我非常喜欢那次讲座。因此,我决定重新录制并上传到 YouTube,那么,让我们开始吧,为大家带来“忙碌人士的大语言模型入门”系列,主讲人 Scott。好的,那我们开始吧。 LLM Inference 首先,什么是大语言模型 (Large Language Model) 呢?其实,一个大语言模型就是由两个文件组成的。在这个假设的目录中会有两个文件。 以 Llama 2 70B 模型为例,这是一个由 Meta AI 发布的大语言模型。这是 Llama 系列语言模型的第二代,也是该系列中参数最多的模型,达到了 700 亿。LAMA2 系列包括了多个不同规模的模型,70 亿,130 亿,340 亿,700 亿是最大的一个。 现在很多人喜欢这个模型,因为它可能是目前公开权重最强大的模型。Meta 发布了这款模型的权重、架构和相关论文,所以任何人都可以很轻松地使用这个模型。这与其他一些你可能熟悉的语言模型不同,例如,如果你正在使用 ChatGPT 或类似的东西,其架构并未公开,是 OpenAI 的产权,你只能通过网页界面使用,但你实际上没有访问那个模型的权限。 在这种情况下,Llama 2 70B 模型实际上就是你电脑上的两个文件:一个是存储参数的文件,另一个是运行这些参数的代码。这些参数是神经网络(即语言模型)的权重或参数。我们稍后会详细解释。因为这是一个拥有 700 亿参数的模型,每个参数占用两个字节,因此参数文件的大小为 140 GB,之所以是两个字节,是因为这是 float 16 类型的数据。 除了这些参数,还有一大堆神经网络的参数。你还需要一些能运行神经网络的代码,这些代码被包含在我们所说的运行文件中。这个运行文件可以是 C 语言或 Python,或任何其他编程语言编写的。它可以用任何语言编写,但 C 语言是一种非常简单的语言,只是举个例子。只需大约 500 行 C 语言代码,无需任何其他依赖,就能构建起神经网络架构,并且主要依靠一些参数来运行模型。所以只需要这两个文件。 你只需带上这两个文件和你的 MacBook,就拥有了一个完整的工具包。你不需要连接互联网或其他任何设备。你可以拿着这两个文件,编译你的 C 语言代码。你将得到一个可针对参数运行并与语言模型交互的二进制文件。 比如,你可以让它写一首关于 Scale AI 公司的诗,语言模型就会开始生成文本。在这种情况下,它会按照指示为你创作一首关于 Scale AI 的诗。之所以选用 Scale AI 作为例子,你会在整个演讲中看到,是因为我最初在 Scale AI 举办的活动上介绍过这个话题,所以演讲中会多次提到它,以便内容更具体。这就是我们如何运行模型的方式。只需要两个文件和一台 MacBook。 我在这里稍微有点作弊,因为这并不是在运行一个有 700 亿参数的模型,而是在运行一个有 70 亿参数的模型。一个有 700 亿参数的模型运行速度大约会慢 10 倍。但我想给你们展示一下文本生成的过程,让你们了解它是什么样子。所以运行模型并不需要很多东西。这是一个非常小的程序包,但是当我们需要获取那些参数时,计算的复杂性就真正显现出来了。 那么,这些参数从何而来,我们如何获得它们?因为无论 run.c 文件中的内容是什么,神经网络的架构和前向传播都是算法上明确且公开的。

宝玉

1,122,834 görüntüleme • 2 yıl önce

小扎吐槽苹果和 Google,以及谈为什么开源 AI **Mark Zuckerberg**: 我认为移动生态系统中普遍存在的一个问题是有两个把持入口的公司,Apple 和 Google,它们可以告诉你可以构建什么。 在我们的历史中有很多次,比如有经济层面的情况,就是我们构建了些东西,然后它们就会拿走我们大部分的收入,但还有一种是质量层面,这实际上让我更加不满,也就是有很多次我们推出或希望推出某些功能,然后Apple就会说,不,你不能推出这功能。 这真的很糟糕。 问题是,这样的世界是否会在AI领域复现,就像你会有一小部分拥有封闭模型的公司,它们控制API,因此将能够告诉你可以构建什么。 我可以说,对我们来说,自己构建一个模型以避免处于那种位置是值得的。 我不希望那些其他公司告诉我们可以构建什么,而且我认为从开源的角度来看,很多开发人员也不希望那些公司告诉他们可以构建什么。这就是我坚定支持开源的原因之一,我认为未来AI的集中化可能像其广泛传播一样具有潜在危险。 我发现很多人都在思考,如果我们能实现这种技术,那么让它广泛传播是否不利。 我认为另一种可能也很糟糕的情况是,如果一个机构掌握了一种强大的AI远超其他所有人的,这同样是非常糟糕的。在我看来,一个理想的世界应该是这样的:AI技术被广泛而均衡地应用,随着时间推移逐步增强其健康性。在这样的世界里,各种系统能够相互制衡,这种平衡的状态比一个高度集中化的世界要健康得多。 虽然风险无处不在,但我觉得有一个风险我想人们我并没有听到太多人提及。 **Dwarkesh Patel**:举例来说,一个价值100亿美元的模型,如果经过评估是完全安全的,你们会选择开源吗? **Mark Zuckerberg**:我的答案是,只要这个模型对我们有所帮助,那我们就会开源。 **Dwarkesh Patel**: 那如果这个模型是用100亿美元的研发经费研发出来的,然后现在要开源呢? **Mark Zuckerberg**: 我们一直以来都有开源软件的传统,但是我们并不会开源我们的产品。 比如说,我们并不会将Instagram的代码开源,但我们会开源许多底层的基础设施。我们历史上最大的一个项目可能就是开放计算项目。在这个项目中,我们将我们所有的服务器的设计网络交换机和数据中心的设计开源了,这对我们来说非常有帮助。 因为很多人可以设计服务器,但现在,大家普遍都采用了我们的设计,这就意味着整个供应链都围绕我们的设计展开,规 模变大,对所有人来说都变得更便宜,为我们节省了数十亿美元。 这真是太棒了,对吧? 因此,我认为开源有多种方式可以对我们有所帮助。 一种就是,如果有人能够找出更便宜的运行模型的方法,我们将花费数十亿甚至上千亿美元,在所有这些模型上,所以如果我们能做的更有效率,那我们就可以节省数十亿甚至上百亿美元,这可能本身就非常有价值。 **Dwarkesh Patel**: 关于开源,我很想知道你是否认为像PyTorch、React、Open Compute这样的开源项目,对世界的影响是否已经超过了Meta在社交媒体方面的作用。 **Mark Zuckerberg**: 因为我曾经和使用这些服务的人交谈过,他们觉得这是有可能的,因为互联网的很大一部分都在运行这些项目。这是一个有趣的问题,我认为几乎有一半的世界人口都在使用我们的产品,这是一个真实的点,所以我觉得这很难超越。 但不管怎样,我还是认为开源是一种新的、非常強大的建设方式。 来源:

宝玉

74,721 görüntüleme • 2 yıl önce

“我们究竟是创造了一个工具还是一个生物?” Sam 在 "机器人之心 "小组讨论会上的发言。 Sam: 但我认为,这无疑是迄今为止人类经历的最重大的更新年份。可能这也是我们将会遭遇的最大变革,因为从现在开始,人们已经接受强大的人工智能将成为现实,并且还会有逐步的更新。就像是第一代 iPhone 面世的那年,以及随后每一代 iPhone 的更新,我们现在能够明显感受到这一代与去年那代的差异。所以,这确实是一个重要的时刻。 我感到欣慰的是,现在人们开始正确地把这些系统当作工具来看待。艺术家尤其如此,但其他人也是一样。 曾经,人们真正恐惧的是,我们究竟是创造了一个工具还是一个生物,这将意味着什么?现在,人们视这些系统为人类工具箱中的新工具,并且正在用它创造一些非常了不起的东西。 模型显然不知道你在说什么,因为这不在它的训练数据里,它也无法从训练数据中学习到这些信息。 这是完全可以预期的。你再问一遍。比如说,你提到“意识”这个概念,模型回答:“是的,我完全明白你的意思,但我之前从未听说过这个词。” 问: “这对我来说就像是一次更新。你认为人工智能会趋向于探索创造性智能和自主性吗?” Sam: 这个问题有多个答案。这取决于激励模型。这是人类的选择。 问: “这将是判断意识的一个很好的测试。因为如果它有自我表达的愿望,并且仅仅为了创作的乐趣而去创作,那不会是偶然的。这绝对有点像生物。” Sam: 这是生物化的。我认为在此之前还有很多步骤。 我们现在要回答问题吗?这真的很棒。

Lei.sea

14,132 görüntüleme • 2 yıl önce

高人,你这个帖子让我整整琢磨了两天!本来想写个长文,但是太多头绪也不知道从何写起。总的来说是我这段时间上推的原因,总感觉自己的开发缺了很重要的认知;也是我这段时间除了自己硬件修复工作之外,还必须要去看text-to-CAD 的原因。 我为啥这段时间上推,就是心情不好。话多,我心情好的时候是不说话的,哪有这个功夫,可以一直干活。 很多行业,甚至是大部分AI需要落地的严肃场景,就是缺 IR, Verifier; 后续的TD和Platform Config必须建立在前面已经推导完成的前提下。AI写程序为什么那么厉害,就是因为IR-Platform Config这条链条是顺畅的。 我们看一下我这个视频。Zoo(text-to-CAD)就是创造了KCL这个IR, 集合你说的Specs/Impl 于一体,Specs是代码前面那一段。后面的Impl与verfier, 比如一些constraint是混在一起的。 这个版就做的非常好,就是我在你的提示下,自己把specs IR写好了。直接导入fusion我加了螺纹就是一个完整的可打印件。 我们要做任何一个行业的“如码" as code, 恐怕都逃不过这个阶段。 法律,医疗,CAD, circuit。 全都需要IR。 否则AI只是提供方案,不能提供方案验证,没有统一的IR,简直就是语言机——只会说!例如 Text-to-CAD 中,模型可以生成 KCL;但如果没有几何检查、约束检查, 这个图都画不出来的。 Transformer 本质上是概率预测器:P(next token | previous tokens) 代码非常成功是因为:代码行业拥有世界上最成熟的 IR 和 Verifier。 现在各行各业IR缺失,才是这一轮AI基本感觉漂浮在语言宇宙的原因。比如医疗。医疗算不算全世界标准最多的领域之一? 医疗已经有 FHIR、DICOM、SNOMED 这些标准,但是这些标准大多数解决的是数据交换(Interoperability),而不是医学推理(Clinical Reasoning)。 如果真的要靠AI医学推理,需要耗费十几年的时间,真正把IR做出来,形成统一标准。 高人,给跪了。

Susan STEM

26,157 görüntüleme • 16 gün önce

老杨今天再分享一个抖音短视频带货中腰部的案例 男女都可以做,但是大部分都是女生做的最多, 这种玩法在带货圈叫-实拍 这种算是实力大佬啦,基本上收到的样品可以按卡车来拖,有可能商家帮投流啦; 先看数据: 1、橱窗带货612万件; 2、LV5达人 粉丝12.36万 3、巨量百应数据:近30天的数据:25-50万单,商品结算金额500-750万 4、从巨量达人数据看有5-26%,我们取最保守8%来算;结算金额按600万来算:是不是30天能拿48万。 5、去看她的号,发了3900多条视频,前期每天日更10条。 你肯定会问,一天10条这怎么可能拍的出来? 1、这种拍的多了,一个镜头可以拍20-30张,产品的使用过程可以拍很多镜头,这样还能重复使用,一个品可以每隔几天重复发,这样积少成多,素材就有了,就可以随时套模版。 2、时间拍久了,有的视频基本上是一条过,都不用剪, 3、还有一些,他们都会请人剪辑视频,请人拍, 4、再有一些直接卖素材,有包月的,也有拼素材的,一个产品20个人拼,每个产品都明30-50个镜头,够大家分别做视频了,所以你会刷到很多视频场景一样,镜头切片不一样。 现在还能不能干: 1、能,反正不用出镜,可以买素材试一下包月素材也才150-300左右;够你每天发3-5个视频, 2、买素材有一个不好的地方就是你不能自主选品,别人给你拍什么你就发什么,有局限性,但是基本上人家都是拍的爆品。 3、如果你要自主选品的话,我的建议就是打垂直类目,比如卖纸,哪你就可以买3-5种纸,天天不重新去拍,每天发,这样的试错成本和成功的机率要大一些,你可以买样品拍; 4、但是这样拍的话你就要自己搭建拍影场景,场景和灯光差不多要1000左右,除非你家有现成的场景可以用。 总结:如果要玩,可以买多几家素材,只买3-5种同类产品的这样反复打,机会还是有的, 视频怎么做,照着别人1:1仿着做个10次机会上就可以了会了,

老杨啊

40,464 görüntüleme • 3 ay önce

“上海市当时的一个政法委书记,一个人啊,他一个人人的器官是有反应的,换了一个肾,换了一个肝,老婆换了一个肾,换了一个肝,全部都是活摘器官!” “江家的多次的这个换肾脏手术,新疆的小伙子,就活活的就这么,为了有所谓的减少反应啊,最高境界,是在无麻醉下把器官给移植。” “我被多次警告,直接来自江家,江家身边也有我的朋友啊,直接警告千万别说这个,文贵千万别说这个,你话不落音啊,你就会消失在地球上。” 正文: 这个当时啊,这个我爆这个器官移植这事情的时候,我压力是特别大的。因为我的家人啊,同事还都在里面啊。我被多次警告,直接来自江家,江家身边也有我的朋友啊,直接警告千万别说这个,文贵千万别说这个,你话不落音啊,你就会消失在地球上。这是我的这不是威胁,我这说这人现在还是德高望重啊,这是我们这是好朋友啊,也认识了海东兄弟,这对我当时压力很大的。 我当时Eglise你不知道,当时爆这个对我没有任何好处,我爆这个,但我为啥要爆啊?因为我好几个同学就跟你干同行呢,就是干同行的是原来黎磊石的那个,那个那个这个黎磊石的那个手下,他当时他说我们的李专家啊,他说我们的春哥春教授,他告诉过我们,他说你们年轻人不要干这个,离的这个远远的,这个手术台上的这些事情不能再继续。他说当时很惊讶,为啥不让我们干这个,我们从小就学着一干这,从山东济南跑到北京,不就干这个了吗? 后来到了南京啊,亲自参与了江家的多次的这个换肾脏手术,他让他最震惊的就是新疆的小伙子,就活活的就这么,为了有所谓的减少反应啊,最高境界,是在无麻醉下把器官给移植。他给我讲过这个,当时讲的他就哭的就不行了啊,我也是真的是一阵时间过不来,就劲就过不来了。就是当时就看你讲的时候,就是一般人听都会浑身难,就是浑身鸡皮疙瘩那种,就能跟你感同身受啊。这就叫灵魂嘛,我们是人,我们不是石头,也不是畜生,我们当然有感同身受了。 他还曾经拜托过我说,文贵,你是我们一切一切的英雄,有一天你能把这话说出去啊,我为你干什么都行。我就凭你这个时候还让我说出去,我有一天我就要实现你这个愿望,这是其中一个原因。所以我讲对我是没有好处的,而且是对我家人同事各方面,因为我没有任何收入,没任何好处。更重要的,后来说法轮功,我一直认为法轮功的器官移植有点夸张,啊我不相信。 有一次在香港,我一起带他去黄大仙,我进去我是VIP清空,我每次拜拜完以后,他拉住我手说文贵,你今天在这块黄大仙面前说话,算不算数?我说算数,啥时候都算数。他说那我告诉你,法轮功的很多事情是真的,不都是真的,但很多是真的,我亲身经历过。我说这你是啥意思啊?他说你过来,给我10分钟,咵从手里拿出来一个手机啊,给我划手机看,这是我拍来的,我就是让你看看,这是2014年的10月份,11月份,我真的是相信了他。我说你记住,我一定会把这给你,给你弄出去。 后来我跟很多外国政府机构,我就拿这东西让人家看,有一天你看我把法轮功他从来没有说我把法轮功这东西要拿出来的时候,现在这东西不在我手里,哪天我一定要推出去,你会看到,绝对比Eglise看到的害怕恐惧,最可怕是带声音带图像,那种惨叫是你受不了的啊。就共产党的邪恶,我觉得他必须是天诛地灭。 你想想上海市当时的一个政法委书记,一个人啊,他一个人人的器官是有反应的,换了一个肾,换了一个肝,老婆换了一个肾,换了一个肝,全部都是活摘器官,是共产党有多邪恶?在新疆这种,你想想在新疆他能轮奸少女,轮奸小孩,他摘你器官,不就一定会发生吗?可能就在我们说话的同时就在发生啊。当年西藏人很惨啊,当时把西藏人弄的那多了去了,说西藏人成功率是大概1/20,他由于这种各种的原因1/20,他杀个20个能成一个,这是西方世界永远不懂。 这是我恨这些传统媒体,这些王八蛋永远不会爆这些东西的,所谓的他,他把他当法官当证据啊,从来不会爆这,呃,他们很多人都把这资料给过西方的这些媒体,很多人给过以后人都被抓。你们一定要相信这些媒体不是正义的,它是邪恶的,否则这些事情不应该延续几十年,在中国,包括你们没有谈到深度的贩卖人口,贩卖人口最厉害的过去是泰国,这几年全是中国,而贩卖人口最严重的就是新疆西藏,这里边的那就无法想象了。 📌中共屠杀迫害中国人

盘古千寻

163,026 görüntüleme • 6 ay önce