Loading video...

Video Failed to Load

Go Home

所以科技平权从Fable 5开始转折了吗? 以后我们普通人还能用到顶级AI大模型的机会吗? 感觉Anthropic这条公告官宣的不是模型要恢复,更像是传递一个信号,就是顶级AI全民可用的时代正式结束了😭 最强的网络安全模型Mythos 5,只开放给美国本土的关键基础设施组织。 普通人能用的Fable 5,还在等政府审批,遥遥无期。 以前是花钱订阅就能摸到人类最顶尖的模型能力, 现在是最强的能力,只对特定身份和机构开放, 也就是说分层的墙已经立起来了, 以后普通用户能拿到的,永远是降过级的公开版本, 真正能重构生产力的顶级能力,只会在高墙内流转~

21,080 views • 1 month ago •via X (Twitter)

0 Comments

No comments available

Comments from the original post will appear here

Related Videos

说个暴论,今天之后前沿大模型的战争已经彻底换赛道了,顶级工程能力的边际成本,今天被彻底打穿了!🤯 Grok 4.5 今天正式发布,直接掀翻了前沿大模型的定价桌子。 对标 Claude Opus 级别的编码与智能体能力,输入定价仅为后者五分之二,输出定价仅为其四分之一, 叠加 4.2 倍的单任务 token 效率提升,再加上更快的推理速度,没有死磕通用榜单第一,直接在开发者最买单的真实生产场景里,扔下了一枚性价比核弹。 这不只是单模型的胜利,更是垂直整合闭环的胜利,背后站着的也不再是孤军奋战的Elon Musk 的XAI实验室,还有SpaceXAI 的模型能力,加 Cursor 的开发者工具生态,加 SpaceX 特斯拉海量内部工程场景的三位一体飞轮, 开发者工具提供真实交互数据反哺训练,场景验证真实需求分布,模型持续迭代优化,这种闭环比单纯堆参数刷通用榜单难复制得多,也更贴近真实生产力落地。 但绝大多数人没看懂,token 效率才是智能体时代的真正杀手锏。 大多数人只会盯着基准分数的高低较劲,却忽略了效率叠加低价的复合效应,单次问答看起来差距甚微,但在多步工具调用自我修正的完整智能体工作流里,token 消耗直接等于延迟与真金白银的成本,跑完整端到端工程项目, Grok 4.5 的实际花费可能只有 Opus 方案的十分之一,速度优势更是碾压级,这对生产部署的意义,远大于跑分多几个百分点。 顶级工程能力的边际成本,今天被彻底打穿了, 2 美元输入 6 美元输出的定价,第一次把顶级编码与智能体能力,从企业级奢侈品降到了个人开发者和小团队可以放开用的价位,这会直接加速智能体 AI 从演示 demo 走向大规模生产落地,也必然倒逼头部厂商在短期内跟进调价,前沿大模型的价格战,今天才算真正拉开序幕。 更恐怖的是迭代加速度,SpaceX 今年计划每月发布一款从头训练的新模型,内部海量工程数据的持续喂养,会让它的进化速度甩开传统实验室的节奏。 我觉得这件事最本质的意义,是 AI 行业的竞争逻辑正在悄然转向, 它不再是堆出一个全能的通用神坛模型,而是在最高价值的垂直赛道里,做到够用的智能,加极致的效率,加亲民的价格, 大多数开发者日常 80% 的需求,从来不是解出世界最难的题,而是可靠地写代码调 bug 搭系统,Grok 4.5 精准命中了这个痛点。 当顶级工程能力的边际成本被彻底打穿,下一波 AI 生产力的爆发,会不会比所有人预想的都要早呢?

AYi

45,544 views • 1 month ago

Kimi要去香港上市了,一次发布同时完成了三件事:产品更新、市场重定价、IPO 预路演,喵的真是一场伟大的操盘!!! K3发布前脚刚砸跌纳斯达克1%,然后转头Kimi就启动港股IPO筹备,一场发布干了几个亿路演的活,真特么牛逼,背后有高人哈哈,来一起回顾这场牛逼的操盘吧: 7 月 17 日凌晨,月之暗面发了 Kimi K3,2.8 万亿参数,Arena 前端代码排名第一,即将开源。 然后 24 小时内发生了两件事, 第一件,华尔街半导体股开盘重挫,纳斯达克跌了 1%,标普 500 跌了 1%,CNN 和彭博社的报道标题里,中国 AI 模型冲击美股是关键词。 第二件,《投资界》报道说 Kimi 已通知投资者调整公司架构,筹备赴港 IPO,最快 6 个月内完成港股上市。 别人的股价在跌,自己的股价准备开始。 这两件事放在一起,是不是比 2.8 万亿参数精彩多了, 一个中国开源模型的 Arena 排名,能直接变成纳斯达克 1% 的跌幅,不是因为 K3 全面超越了谁,它在综合智能指数上排第四,Fable 5 在 35 项评估里赢了 22 项,并不是新王者。 那华尔街在怕什么呢? 我觉得怕的不是这个模型本身,他们怕的其实是前沿能力 + 开放权重 + 中国公司这个组合,对闭源 AI 万亿美元资本支出的那个底层假设,突然给了一个反面例证。 那个假设很简单:最先进的 AI 能力是稀缺的,稀缺就应该贵,贵就需要巨额资本支出,巨额资本支出会带来长期的定价权。 K3 在这个假设上钻了一个空子, Arena 前端人类盲测第一,输入 $3,输出 $15,Fable 5 的输出是 $50,权重 7 月 27 日开放,之后任何人可以自己部署、微调、塞进私有工作流。 如果,注意是如果啊兄弟们,$15 的输出价格就能拿到人类盲测投票第一的前端 coding 能力,而且权重马上开源,那花几千亿美元训练闭源模型、然后收 $50 输出费用的商业模式,是在修一条收费高速公路,还是在一座即将免费的桥旁边建收费站。 华尔街的反应不是说这个模型太强了,是担心这个定价让整个投资回报率的算术变得不好看了。 这是第一层,第二层更有意思, Kimi 通知投资者调整架构,启动赴港 IPO,从短期不着急上市到筹备港股上市,不到一年。 这个时间窗口的选择显然不是偶然, Arena 前端第一 + 华尔街震动 + CNN/彭博头版,这套组合给了 Moonshot 一个全球定价时刻,在它走向公开市场之前,让全世界的投资者都知道了它的名字,而且不是在中国 AI 追赶者的叙事里,是在能让纳斯达克跌 1% 的叙事里。 IPO 需要的是一个让承销商可以讲的故事,K3 在 24 小时内把这个故事递到了全球财经媒体的头版上。 别人花几个亿做路演,Moonshot 用一次模型发布就做到了。 以前 AI 模型发布的受众是开发者和从业者,现在它的受众包括华尔街交易员、半导体分析师和港股承销商。 AI 模型发布正在从技术事件变成宏观事件。 这个转变一旦成立,以后每一家前沿 AI 公司的新模型发布,都不会只是开发者社区的节日,它会像上市公司的财报,不只是我们做到了什么,更是这个做到的事,让谁的假设失效了。 K3 不是第一个触发这个转变的模型,但它是第一个让发布即冲击这个范式变得如此清晰可见的。 一个中国公司,把开源模型的 Arena 排名推到前端第一,然后让大洋彼岸的半导体股跌了 1%,再趁势启动自己的 IPO 筹备,感觉有点像在上演一场关于定价权的公开争夺🤔。。。。 而争夺定价权最好的方式通常不是发论文,最好的方式就是让你的产品发布,直接变成别人股价的变量。

AYi

88,771 views • 1 month ago

很多人看 Inference Labs , 第一反应都是那些听起来特别硬的技术名词,比如什么 zkML,什么 PoI。 但说真的,如果你把这层技术的皮给剥开,你会发现它讲的根本不是代码,而是权力。 Inference Labs 真正做的,是把 AI 系统里以前那些模糊的权力关系,直接给拆散了摆在台面上。 在传统的 AI 世界里,模型方就是绝对的老大。 模型怎么跑,参数怎么调,最后给你一个结果,你除了相信,没有任何别的办法。 算力方也是一样,谁手里的机器多,谁的声音就大。这种结构下,用户其实是没有任何话语权的。 但 Inference Labs 正在把这套逻辑给彻底拆掉。 在它的 PoI 机制下,模型不再是那个不可挑战的上帝了。模型只能负责干活,负责给出推理结果,但它没有权利定义这个结果是不是对的。 一旦进了这个系统,模型的每一个输出都必须经过证明,经过别人的复现和验证。 这一步,本质上就是在削弱模型的权力。模型不再是权力的中心,它变成了一个纯粹的服务提供者。 再来看看算力。 很多人以为验证网络会让算力变得更值钱,更重要。其实恰恰相反,在 Inference Labs 的结构里,算力其实是被压制的。 算力在这里只负责执行任务,它不负责最后的裁决。你算得再快,机器堆得再多,你也改变不了结果的合法性。你没法靠着算力去强行说服系统接受一个错误的结果。 这意味着,算力在这里变成了一种商品化的成本,而不是一种能让你称王称霸的筹码。 那么,真正的权力流向哪儿了。 答案是验证者。 验证者不需要去训练什么顶级的模型,也不需要去买成千上万张显卡。 他们只做一件事,就是决定哪些推理是被系统承认的现实。这在现在的 AI 圈子里是非常罕见的设计。 它相当于承认了一点,AI 的问题其实不在于它聪不聪明,而在于当它给出结果的时候,谁有资格说这是一次有效的推理。 Inference Labs 把这个资格,从那些模型公司和平台手里,转移到了这个验证层。 这种变化的影响会非常深远。 以后在这个系统里,最强势的一方,不是那些最会训练模型的,也不是那些最有钱堆机器的。 而是那些能长期维持验证信誉的节点。这种节点看重的不是短期的那点博弈速度,而是长期的稳定性。 因为在它的规则里,只要你作恶一次,代价就是被系统永久边缘化。这种代价,任何想长久玩下去的人都承担不起。 所以我也一直在想,为什么 Inference Labs 在短期市场里显得这么安静。 其实道理很简单,这个系统里真正占便宜的角色,从来就不是那些会喊叙事,会搞投机的。 它奖励的是耐心,是持续不断的输出,以及永远不犯错的稳健。它天然地就在排斥那些只想进来薅一把就走的投机者。 我的感觉非常明确,Inference Labs 其实并不是在追求让 AI 变得更强,它是在尝试解决一个更有难度的问题。 那就是当 AI 已经足够强的时候,到底谁来约束它,谁来承担它产生后果后的责任。 在这个系统里,权力第一次不再是围绕着模型集中,而是被彻底拆散,被互相制衡。 这才是它最被低估的地方。 它在重新定义 AI 时代的规则。它告诉我们,在这个新的权力游戏里,诚实和稳定,才是最贵的资产。 #inference_labs #KAITO

比克大魔王

29,048 views • 7 months ago

非常Nice啊,这模型完全免费,Token终于可以自由白嫖了,甚至视频模型都是免费的,太爽了。 它叫Agnes AI,全球模型榜前十,6 月 1 号起把自己家三个核心模型全免费开放了,无限期。图片模型在 artificial analysis 上榜了,文字模型一周被干了一万亿 Token。我把它接进 Claude Code,配起来十分钟的事,Token 随便用。 这玩意到底是什么呢。 Agnes AI 是全球模型榜单前十的一个 AI Lab,这次免费开放的是三个模型,文本、图片、视频。 文本模型叫 agnes-2.0-flash。能写代码,能做知识问答,能跑 Agent,能规划复杂任务。在 Claw-Eval 智能体评测榜进了 Top 10。说真的,这周它还要上 1M 超长上下文,以前用 200K 的模型跑到 150K 就降智,这种破事不用再忍了。 图片模型叫 agnes-image-2.1-flash。图改图、多图融合、换背景、改文字、图像修复,电商主图和广告素材这种反复改的场景,太合适了。最近还加了 4K 超高清输出,最高 4096×4096,生成的图可以直接进印刷,不是那种看着还行一放大就糊的草稿。 视频模型叫 agnes-video-2.0。原生音画同步,首帧生视频、首尾帧生视频、多镜头切换都支持,720P 和 1080P 随便选。 接进 Claude Code 怎么搞,其实很简单。 第一步,去 注册,拿到 API key。 第二步,打开 cc-switch。右上角选 Claude CLI,右上角点 + 号,选自定义配置。把 API key 填进去,请求地址写 格式选 OpenAI Chat Completions。 第三步,点获取模型列表,选 agnes-2.0-flash。 第四步,点左上角设置,找到路由,打开路由总开关,Claude 打开。 完事。 回到 Claude Code 正常发消息,模型就已经切过去了。我试了一个在酒吧吉他弹唱的视频,和真人区别不大。 现在 Token 不要钱,Agent 该跑几轮跑几轮,该拆几步拆几步。反正我觉得这才是免费开放最爽的部分,不只是省钱,是心理上解放了。 我测试了一下视频模型,能用,就是慢了点,文字模型还是比较快的。 开发者文档在 OpenClaw、Hermes、Claude Desktop 的,也有现成教程。

产品经理老王霸

52,217 views • 1 month ago