Video yükleniyor...

Video Yüklenemedi

Ana Sayfaya Dön

DeepSeek 现在明显在all in 冲刺,想用最快的速度把自己从一家“有潜力”的中国AI实验室,变成全球第一梯队的玩家。 他们这次公开喊出“所有部门至少翻倍”,本质上是在对整个行业和资本市场释放一个强烈信号:我们已经拿到足够多的钱,接下来要不惜代价抢人、扩规模、拼速度。核心目标很可能是在2026年底到2027年上半年,拿出真正能跟GPT,Claude 正面硬刚的顶级模型,甚至在某些开源或性价比维度直接领先! DeepSeek 加油,国产模型加油!

28,029 görüntüleme • 1 ay önce •via X (Twitter)

0 Yorum

Yorum bulunmuyor

Orijinal gönderinin yorumları burada görünecek

Benzer Videolar

白宫加密政策主管David Sacks: 四年内AI 大模型能力将增长一百万倍 ! “我认为目前至少在三个关键维度上,进步的速度都是指数级的。” “首先是算法本身。模型每年提升的速度大概是 3-4 倍。” “它们不仅仅是在速度和性能上更快更好,而且将从量变到质变。” “接着是推理模型。” “我们甚至还没有真正进入智能代理时代,但这将是继推理模型之后的下一个重大飞跃。” “在这个领域,我们才刚刚开始(推理算力增加带来的能力增加也将是倍数增长)。” “接下来是芯片。” “根据多种衡量标准,每一代芯片的性能可能比上一代提高 3-4 倍。” “不只是单个芯片在不断进步,他们还在研究如何将这些芯片联网在一起。” “就像 NVL72 系统,它类似于一个机架系统,可以在数据中心级别大幅提升性能。” “计算能力是第三个你会看到基本上呈指数级进步的领域。” “只需要看看数据中心中部署的 GPU 数量。” “当马斯克最初开始训练 Grok 时,我认为他们大概有 10 万块 GPU。现在已经有 30 万块 GPU,而且正朝着百万块 GPU的目标迈进。OpenAI 的数据中心 Stargate 也是同样的情况。” “在接下来的几年中,他们可能会发展到 500 万、1000 万块 GPU。” 1,000,000 倍的增长是怎么得出的: “算法、芯片和数据中心的扩展和改进速度都是每年 3-4 倍。” “也就是说,每两年进步 10 倍。” “很多人没有理解指数级进步的含义:如果每两年提升 10 倍,并不意味着四年后你只是提升 20 倍。” “这实际上意味着提升 100 倍。” “把这些因素相乘:算法、芯片,以及可用于 AI 的原始计算能力。” 100 倍模型 🧠 × 100 倍芯片 💾 × 100 倍计算能力 ⚡️ = 1,000,000 倍的 AI 大模型🤖 “你所谈论的就是 1,000,000 倍的能力增长。” “但这种变革的影响将是绝对巨大的。” “我觉得人们还没有充分认识到这一点,因为他们不了解指数级进步的意义。”

夜谈

25,895 görüntüleme • 1 yıl önce

昨天发了一个视频,看到评论里有人问:你都在用 Claude Code 了,为什么还要用国内的 Coding Plan? 对我来说,这不是一个二选一的问题,而是一个补充题。 大家都知道御三家的硬实力更强,这点没什么好争议的。但很多日常场景里,国产模型其实已经能在速度、质量、成本之间取得一个不错的平衡。 比如文本处理、资料整理、基础 coding、简单 agent 任务,这类占日常 80% 的工作,很多时候并不一定非要上最贵的模型。对大多数中国用户来说,国产模型更顺手,速度也够,价格还低不少。 还有一个经常被忽略的点,其实是处理速度。 我自己实测下来,国内这些模型在一些简单任务上,接口响应和首字速度都很快。像翻译、语音输入后的文本修正、基础润色、简单改写这类高频小任务,用起来其实很舒服。你并不需要每一次都把最贵、最强的模型拉出来跑一遍。 另外我觉得,现在国内头部几家 AI 厂商,已经不是“能不能做”的问题了。无论是阿里还是字节,一方面有足够的算力和基础设施,另一方面本身也有持续做模型研发和产品迭代的能力。所以在很多高频、日常、成本敏感的场景里,把国产模型纳入自己的工具链,本来就是很自然的事。 所以我现在的看法一直都不是“国产替代”或者“二选一”,而是按场景分工:复杂、高价值任务交给最强模型;大量日常、重复、成本敏感的任务,用国产模型做补充,我觉得这反而是更现实、也更科学的用法。

luolei

32,566 görüntüleme • 4 ay önce

年前多关注ai板块吧 中国人参与多的就会有买单!就会有市场🤟 中国开源模型下载量首超美国,一场新的科技竞速正式打响! 还在觉得全球 AI 只看硅谷? MIT × Hugging Face 最新联合报告告诉你: 过去一年,全球开源 AI 模型下载量中,中国占比 17% —— 首次超过美国的 15.8%。 这不是一个小数点的变化,这是 AI 格局的一声惊雷。 意味着一个事实正在出现: 中国 AI,不再只是“追赶者”,而是实实在在的“生态领跑者”。 一、为什么这个数据爆炸性这么强? 开源模型下载量,是 AI 世界最真实的“民意投票”。 谁被用、谁被复用、谁被拿去做产品,下载量不会说谎。 它比论文数量更接地气,比发布会更诚实,比概念 PPT 更真实。 下载量高 = 模型真的“好使”“好用”“好落地”。 而这一回,中国冲到第一名,意味着什么? 全球开发者正在越来越多地选择中国模型。 中国模型正在成为国际生态的一部分,而不是“区域性产品”。 中国的 AI 创新正在进入全球循环,而非单向输入。 一句话: 中国不只在做模型,而是在影响世界开发者。 二、为什么中国能“后来居上”?三大原因让人无法忽视 ① 模型数量爆发式增长:百花齐放,开发者用不过来 过去一年,中国的开源模型生态堪称“井喷式”增长: 中小模型、大模型、多模态、语音、图像…… 能开的都开了,能放的都放了。 数量足够大,就能吸引足够多的开发者。 ② 性价比 + 轻量化:世界都在找中国模型“省钱神器” 不是每个团队都训练得起千亿级大模型。 但每个团队都想部署一个能跑的模型。 而中国模型的特质就是四个字: 轻、快、省、能打。 全球开发者当然爱。 ③ 中文生态的辐射效应:从东亚扩散到整个亚洲 中文模型强,意味着东亚、东南亚用户都能直接受益。 更大的人群、更高的需求,带来了更快的下载增长 三、美国依然很强,但“唯一主导”时代正在改变 必须说,美国仍然拥有: 世界最顶级的基础研究 算力、芯片、科研体系的深度优势 OpenAI / Google / Meta 等头部力量 但这一次的反超给了全球一个清晰的信号: AI 生态不再是“一家独大”。 多极化时代正在加速到来。 全球开发者的选择,正在慢慢从“硅谷中心论”转向“多中心协作”。 四、全球 AI 正进入“群雄争霸”时代 这次排名变化背后,是全球 AI 赛道进入全新阶段的标志: ① 从“技术竞赛”升级为“生态竞赛” 谁的模型被更多人用,谁就占据未来话语权。 ② 开源力量影响全球,而中国是关键节点 中国模型从“区域下载”变成“全球下载”,这是过去没有出现过的格局。 ③ 创新不再只来自单一地区 AI 正在走向: 中国能打、美国能打、欧洲能打、世界都能打。 这种竞争更健康,也更刺激。 五、结语:这不是终点,而是 AI 全球化的真正开始 中国开源模型首次登顶,并不是“谁碾压谁”的故事。 它真正意味着: 全球 AI,正在进入一个更开放、更多样、更具创造力的新纪元。 当中国模型被全球开发者下载、复用、再创造 这才是 AI 生态最值得期待的未来。

加密大师兄

22,361 görüntüleme • 8 ay önce

Mira Murati 带着新公司 Thinking Machines 回来了,12B 估值,史上最大。 发布的模型叫 Inkling,975B 总参数,MoE,每 token 激活 41B,1M 上下文,全权重 Apache 2.0 开源。 然后她在官方公告里写了一句话,其他 AI 公司 CEO 不会写的话: “我们这个模型落后于前沿。” 不是“接近前沿”,更不是“在某些维度上达到 SOTA”,是“trails the frontier”。 我觉得这件事真正反直觉的地方是这不是技术失败后的无奈坦白,这是把竞争维度换了。 闭源实验室卖的是 token 级智能,你调用一次付一次,模型永远不是你的。 GPT 更强、Claude 更强,但它们的商业模式建立在一个前提上:你永远需要它们。 Mira 打了一张完全不同的牌。 她把 Inkling 全权重开源,然后告诉企业客户:这个基座不如 GPT-5.5 聪明,但它可以变成你自己的模型。 用自己的代码库 fine-tune,它就懂你的架构,用自己的客户数据 fine-tune,它就懂你的业务,用自己的工作流 fine-tune,它就能在你的系统里跑,不需要经过第三方 API。 一个懂你代码库和数据的 41B-active 定制模型,和一个“更聪明但对你一无所知”的通用模型——医院、银行、国防、软件公司会选哪个? Mira 赌的是后者。 这个赌局的支点不是模型能力,是所有权关系。 传统 AI 公司卖智能,Mira 卖的是可拥有性,因为模型本身是免费样本,Tinker 平台才是产品——你要在上面 fine-tune、部署、迭代你自己的版本,样本把你拉进来,fine-tune 让你留下,留在 Tinker 上让你走不了。 这和纯闭源 API 比更难复制,和纯开源比更可持续。 还有一个维度被低估了, 过去两年,美国企业想做自有模型时,大量依赖中国开源权重。 中国的DeepSeek、Qwen、GLM——能力强,开放度高,但数据安全、出口管制、对齐差异一直是个隐雷。 Inkling 给出了一个美国本土的高性能替代选项 ,不是能力压制,是供应链风险分散。 这个卖点对企业决策层的影响,可能比 benchmark 排名大得多。 对正在自己搭 agent 系统的人来说,Inkling 的信号很实际: 未来真正的高杠杆,不是一直追最强的通用模型,而是学会用高质量开源基座 + 自己的数据和判断力,快速打造只属于你工作流的智能系统。 1M 上下文 + agentic coding(SWE-Bench 77.6%)+ 可控思考预算,这个组合在长上下文 agent 工作流上的性价比,可能远高于一直调用最贵的闭源 API。 Mira 做了一件很有意思的事,她在所有人都往“更强”的方向卷的时候,把旗子插在了“更容易被拥有”的方向。承认自己不够强,反而让“你敢不敢把核心数据交给它”这个问题变得更可信。 AI 的竞争正在从“谁的模型最聪明”分裂成两条路,一条继续卷通用智能的峰值,另一条卷谁先变成你资产的一部分。 Mira 选了后一条,而且她把整家公司押上去了。 这个方向对不对,要看 Tinker 能不能把 fine-tune 大 MoE 这件事做到足够简单和低成本。 但有一点已经清楚了——在 2026 年,“能被你拥有”正在变成和“比你聪明”同样值钱的东西。

AYi

15,113 görüntüleme • 21 gün önce

我操!Kimi.ai 月之暗面这波是真的疯了! 2.8T 参数的 K3 直接全权重开源就算了, 连推理内核、MoE 通信库、Agent 训练环境整套底层技术栈全给你端出来,硬生生把开源模型的天花板,直接抬到了闭源旗舰的家门口。 不是放个权重就炒开源概念的挤牙膏操作,是从模型到底层能跑起来生态的所有东西全白给,1M 长上下文、MoE 架构性能够打闭源, 之前天天喊开源追不上闭源的直接被打半残, 开发者再也不用对着闭源 API 的限流、涨价受窝囊气。 搞大模型的不用从零搭底层通信框架, 做 Agent 的不用卡闭源接口的脖子, 小团队也能基于全栈直接做二次开发, 从今天起,全球开源 AI 的游戏规则,真的改了。 今天之后,开源和闭源的代差,从两年砍到了半年。 Kimi K3 今天正式全开源,不是挤牙膏的版本更新。 2.8T 总参数 MoE, 激活 104B, 原生 100 万上下文。 靠 KDA 新注意力和 AttnRes 架构创新,单位算力智能密度直接提 2.5 倍,长上下文解码速度翻 6 倍。 最狠的是,这根本不是只放个权重的假开源。 FlashKDA 高性能内核,MoE 通信库,连用来做 Agent 强化学习的快照式训练环境 AgentENV, 全给你开源了。 从推理到训练的整个底层栈,直接搬空。 之前所有开源模型,本质都是在追闭源一年多前的尾巴。 这是第一个真正摸到闭源顶尖门槛的开放模型。 长编码、Agent、终端操作这些硬核任务, 已经能和第一梯队闭源掰手腕。 你永远可以相信开放的力量!! 用K3搓了一个他自己开源的介绍视频,特此致敬🫡

AYi

262,826 görüntüleme • 10 gün önce

小扎吐槽苹果和 Google,以及谈为什么开源 AI **Mark Zuckerberg**: 我认为移动生态系统中普遍存在的一个问题是有两个把持入口的公司,Apple 和 Google,它们可以告诉你可以构建什么。 在我们的历史中有很多次,比如有经济层面的情况,就是我们构建了些东西,然后它们就会拿走我们大部分的收入,但还有一种是质量层面,这实际上让我更加不满,也就是有很多次我们推出或希望推出某些功能,然后Apple就会说,不,你不能推出这功能。 这真的很糟糕。 问题是,这样的世界是否会在AI领域复现,就像你会有一小部分拥有封闭模型的公司,它们控制API,因此将能够告诉你可以构建什么。 我可以说,对我们来说,自己构建一个模型以避免处于那种位置是值得的。 我不希望那些其他公司告诉我们可以构建什么,而且我认为从开源的角度来看,很多开发人员也不希望那些公司告诉他们可以构建什么。这就是我坚定支持开源的原因之一,我认为未来AI的集中化可能像其广泛传播一样具有潜在危险。 我发现很多人都在思考,如果我们能实现这种技术,那么让它广泛传播是否不利。 我认为另一种可能也很糟糕的情况是,如果一个机构掌握了一种强大的AI远超其他所有人的,这同样是非常糟糕的。在我看来,一个理想的世界应该是这样的:AI技术被广泛而均衡地应用,随着时间推移逐步增强其健康性。在这样的世界里,各种系统能够相互制衡,这种平衡的状态比一个高度集中化的世界要健康得多。 虽然风险无处不在,但我觉得有一个风险我想人们我并没有听到太多人提及。 **Dwarkesh Patel**:举例来说,一个价值100亿美元的模型,如果经过评估是完全安全的,你们会选择开源吗? **Mark Zuckerberg**:我的答案是,只要这个模型对我们有所帮助,那我们就会开源。 **Dwarkesh Patel**: 那如果这个模型是用100亿美元的研发经费研发出来的,然后现在要开源呢? **Mark Zuckerberg**: 我们一直以来都有开源软件的传统,但是我们并不会开源我们的产品。 比如说,我们并不会将Instagram的代码开源,但我们会开源许多底层的基础设施。我们历史上最大的一个项目可能就是开放计算项目。在这个项目中,我们将我们所有的服务器的设计网络交换机和数据中心的设计开源了,这对我们来说非常有帮助。 因为很多人可以设计服务器,但现在,大家普遍都采用了我们的设计,这就意味着整个供应链都围绕我们的设计展开,规 模变大,对所有人来说都变得更便宜,为我们节省了数十亿美元。 这真是太棒了,对吧? 因此,我认为开源有多种方式可以对我们有所帮助。 一种就是,如果有人能够找出更便宜的运行模型的方法,我们将花费数十亿甚至上千亿美元,在所有这些模型上,所以如果我们能做的更有效率,那我们就可以节省数十亿甚至上百亿美元,这可能本身就非常有价值。 **Dwarkesh Patel**: 关于开源,我很想知道你是否认为像PyTorch、React、Open Compute这样的开源项目,对世界的影响是否已经超过了Meta在社交媒体方面的作用。 **Mark Zuckerberg**: 因为我曾经和使用这些服务的人交谈过,他们觉得这是有可能的,因为互联网的很大一部分都在运行这些项目。这是一个有趣的问题,我认为几乎有一半的世界人口都在使用我们的产品,这是一个真实的点,所以我觉得这很难超越。 但不管怎样,我还是认为开源是一种新的、非常強大的建设方式。 来源:

宝玉

74,721 görüntüleme • 2 yıl önce

加拿大正在“系统性地摧毁自己”。 这是川普总统刚刚发布的视频里的原话。 视频里是谁? 加拿大汽车制造商协会的主席,Brian Kingston。 他基本上是在公开求救。 他说了什么? 加拿大90%以上的汽车都卖给美国。 没有美国市场,加拿大汽车工业直接消失。 多元化?不存在的。 欧洲和亚洲市场有自己的工厂,轮不到加拿大。 所以,北美一体化是加拿大汽车业的唯一生命线。 然而,他们的联邦政府却和中共国搞了一个“战略伙伴关系”。 结果是什么? 向中共国电动车大开国门。 这会彻底颠覆整个北美汽车供应链。 最荒唐的是,这个新政策有个“合规积分”系统。 中共国制造商在加拿大没有工厂,不雇佣一个加拿大人。 却能每年拿走高达9.8亿加元的补贴。 这笔钱谁出? 那些在加拿大建厂、雇佣了几代加拿大人的公司,比如福特、通用。 等于是在用北美公司的钱,去补贴他们在中共国的竞争对手。 资金就这样从安大略流向了北京。 这不就是全球主义精英们最擅长干的事吗? 把本国的产业、就业、财富,拱手让给竞争对手。 川普总统多年来一直在警告这种自毁长城的“糟糕交易”。 现在,加拿大的汽车行业,这个国家的工业支柱之一,正悬在半空中。 他们自己人都站出来喊话了。 接下来的行动,将决定这个行业还能否再活一百年。

墓碑科技

31,165 görüntüleme • 6 ay önce