Video wird geladen...

Video konnte nicht geladen werden

Zur Startseite

感觉现在开源的速度已经疯了。。。 Kimi.ai 家的K3开源才两天,已经被Unsloth AI 干到能在Mac Studio上跑了🤯!!! 2.8万亿参数的模型,原始大小1.56T, 他们用动态1-bit量化,直接压到594G,缩了62%, 还保留了78.9%的精度, 128G内存的Mac Studio就能跑, 虽然速度不快,但它真的能跑。 谁能想到半个月前,这个级别的模型还只有大厂有算力碰, 现在我们在家,在自己的消费级电脑上,就能跑全球最顶尖的开源大模型了,damn! 权重放出来48小时,量化、适配、教程全给你整完了, Unsloth这速度,真的离谱。 不得不说这就是开源最恐怖的地方啊, 模型放出来第一天, 全世界最聪明的工程师都在帮你压体积、提速度、做适配, 闭源模型,永远享受不到这个待遇。

289,379 Aufrufe • vor 1 Monat •via X (Twitter)

0 Kommentare

Keine Kommentare verfügbar

Kommentare vom Original-Post werden hier angezeigt

Ähnliche Videos

非常Nice啊,这模型完全免费,Token终于可以自由白嫖了,甚至视频模型都是免费的,太爽了。 它叫Agnes AI,全球模型榜前十,6 月 1 号起把自己家三个核心模型全免费开放了,无限期。图片模型在 artificial analysis 上榜了,文字模型一周被干了一万亿 Token。我把它接进 Claude Code,配起来十分钟的事,Token 随便用。 这玩意到底是什么呢。 Agnes AI 是全球模型榜单前十的一个 AI Lab,这次免费开放的是三个模型,文本、图片、视频。 文本模型叫 agnes-2.0-flash。能写代码,能做知识问答,能跑 Agent,能规划复杂任务。在 Claw-Eval 智能体评测榜进了 Top 10。说真的,这周它还要上 1M 超长上下文,以前用 200K 的模型跑到 150K 就降智,这种破事不用再忍了。 图片模型叫 agnes-image-2.1-flash。图改图、多图融合、换背景、改文字、图像修复,电商主图和广告素材这种反复改的场景,太合适了。最近还加了 4K 超高清输出,最高 4096×4096,生成的图可以直接进印刷,不是那种看着还行一放大就糊的草稿。 视频模型叫 agnes-video-2.0。原生音画同步,首帧生视频、首尾帧生视频、多镜头切换都支持,720P 和 1080P 随便选。 接进 Claude Code 怎么搞,其实很简单。 第一步,去 注册,拿到 API key。 第二步,打开 cc-switch。右上角选 Claude CLI,右上角点 + 号,选自定义配置。把 API key 填进去,请求地址写 格式选 OpenAI Chat Completions。 第三步,点获取模型列表,选 agnes-2.0-flash。 第四步,点左上角设置,找到路由,打开路由总开关,Claude 打开。 完事。 回到 Claude Code 正常发消息,模型就已经切过去了。我试了一个在酒吧吉他弹唱的视频,和真人区别不大。 现在 Token 不要钱,Agent 该跑几轮跑几轮,该拆几步拆几步。反正我觉得这才是免费开放最爽的部分,不只是省钱,是心理上解放了。 我测试了一下视频模型,能用,就是慢了点,文字模型还是比较快的。 开发者文档在 OpenClaw、Hermes、Claude Desktop 的,也有现成教程。

产品经理老王霸

54,557 Aufrufe • vor 2 Monaten

Kimi要去香港上市了,一次发布同时完成了三件事:产品更新、市场重定价、IPO 预路演,喵的真是一场伟大的操盘!!! K3发布前脚刚砸跌纳斯达克1%,然后转头Kimi就启动港股IPO筹备,一场发布干了几个亿路演的活,真特么牛逼,背后有高人哈哈,来一起回顾这场牛逼的操盘吧: 7 月 17 日凌晨,月之暗面发了 Kimi K3,2.8 万亿参数,Arena 前端代码排名第一,即将开源。 然后 24 小时内发生了两件事, 第一件,华尔街半导体股开盘重挫,纳斯达克跌了 1%,标普 500 跌了 1%,CNN 和彭博社的报道标题里,中国 AI 模型冲击美股是关键词。 第二件,《投资界》报道说 Kimi 已通知投资者调整公司架构,筹备赴港 IPO,最快 6 个月内完成港股上市。 别人的股价在跌,自己的股价准备开始。 这两件事放在一起,是不是比 2.8 万亿参数精彩多了, 一个中国开源模型的 Arena 排名,能直接变成纳斯达克 1% 的跌幅,不是因为 K3 全面超越了谁,它在综合智能指数上排第四,Fable 5 在 35 项评估里赢了 22 项,并不是新王者。 那华尔街在怕什么呢? 我觉得怕的不是这个模型本身,他们怕的其实是前沿能力 + 开放权重 + 中国公司这个组合,对闭源 AI 万亿美元资本支出的那个底层假设,突然给了一个反面例证。 那个假设很简单:最先进的 AI 能力是稀缺的,稀缺就应该贵,贵就需要巨额资本支出,巨额资本支出会带来长期的定价权。 K3 在这个假设上钻了一个空子, Arena 前端人类盲测第一,输入 $3,输出 $15,Fable 5 的输出是 $50,权重 7 月 27 日开放,之后任何人可以自己部署、微调、塞进私有工作流。 如果,注意是如果啊兄弟们,$15 的输出价格就能拿到人类盲测投票第一的前端 coding 能力,而且权重马上开源,那花几千亿美元训练闭源模型、然后收 $50 输出费用的商业模式,是在修一条收费高速公路,还是在一座即将免费的桥旁边建收费站。 华尔街的反应不是说这个模型太强了,是担心这个定价让整个投资回报率的算术变得不好看了。 这是第一层,第二层更有意思, Kimi 通知投资者调整架构,启动赴港 IPO,从短期不着急上市到筹备港股上市,不到一年。 这个时间窗口的选择显然不是偶然, Arena 前端第一 + 华尔街震动 + CNN/彭博头版,这套组合给了 Moonshot 一个全球定价时刻,在它走向公开市场之前,让全世界的投资者都知道了它的名字,而且不是在中国 AI 追赶者的叙事里,是在能让纳斯达克跌 1% 的叙事里。 IPO 需要的是一个让承销商可以讲的故事,K3 在 24 小时内把这个故事递到了全球财经媒体的头版上。 别人花几个亿做路演,Moonshot 用一次模型发布就做到了。 以前 AI 模型发布的受众是开发者和从业者,现在它的受众包括华尔街交易员、半导体分析师和港股承销商。 AI 模型发布正在从技术事件变成宏观事件。 这个转变一旦成立,以后每一家前沿 AI 公司的新模型发布,都不会只是开发者社区的节日,它会像上市公司的财报,不只是我们做到了什么,更是这个做到的事,让谁的假设失效了。 K3 不是第一个触发这个转变的模型,但它是第一个让发布即冲击这个范式变得如此清晰可见的。 一个中国公司,把开源模型的 Arena 排名推到前端第一,然后让大洋彼岸的半导体股跌了 1%,再趁势启动自己的 IPO 筹备,感觉有点像在上演一场关于定价权的公开争夺🤔。。。。 而争夺定价权最好的方式通常不是发论文,最好的方式就是让你的产品发布,直接变成别人股价的变量。

AYi

89,164 Aufrufe • vor 2 Monaten

有个事我憋很久了,今天必须说一下。 市面上那些标榜 AI 驱动交易的 Bot,我深度用过几款之后发现一个特离谱的现象:它们所谓的 AI 就是接了一个 GPT 或者 Claude 的 API,把 K 线数据原封不动丢进去,让一个从来没被训练过理解金融时间序列的通用模型给你输出买卖建议。说难听点,跟拿 ChatGPT 算命没什么区别。 所以 AIX 的多模型路由方案,是我接触这个项目之后第一个真正觉得"方向对了"的设计。 它同时接了 GPT、Claude、DeepSeek R1、Gemini 这些通用模型,也集成了 Kronos 这类专门为金融预测训练的专业模型。中间多了一层调度层,根据当前市场状态智能路由,震荡市用一套推理框架,单边趋势切另一套算法组合。 这个设计的聪明之处在于它承认了一个很朴素的事实:没有一种模型能在所有行情里通吃。趋势跟随在单边市是神,进了震荡就是来回止损。反过来网格在震荡舒服,单边一来直接穿仓。通用大模型做策略意图理解很强但看 K 线的能力确实有限,专用金融模型在时序预测上更精准但没办法理解你用自然语言描述的策略逻辑。没有一个模型能同时搞定所有事。 AIX 干的事不是选一个最强的模型然后迷信它,而是让不同模型在不同环节轮班上岗,动态调权重。这个思路在传统量化里叫多因子动态权重,AIX 把它搬到了 LLM 和时序模型的协同上。 我体验下来的感受是它不像那种一问一答的 Bot,更像有一个小团队在后台协作,你只需要给方向,它自己去协调谁干什么。这个架构如果跑通,抗单一模型失效的能力跟那些只接一个 API 的项目不在一个数量级。 个人分享,非投资建议。

DeFi狙击手 | Ai🕊️

17,513 Aufrufe • vor 1 Monat

说个暴论,今天之后前沿大模型的战争已经彻底换赛道了,顶级工程能力的边际成本,今天被彻底打穿了!🤯 Grok 4.5 今天正式发布,直接掀翻了前沿大模型的定价桌子。 对标 Claude Opus 级别的编码与智能体能力,输入定价仅为后者五分之二,输出定价仅为其四分之一, 叠加 4.2 倍的单任务 token 效率提升,再加上更快的推理速度,没有死磕通用榜单第一,直接在开发者最买单的真实生产场景里,扔下了一枚性价比核弹。 这不只是单模型的胜利,更是垂直整合闭环的胜利,背后站着的也不再是孤军奋战的Elon Musk 的XAI实验室,还有SpaceXAI 的模型能力,加 Cursor 的开发者工具生态,加 SpaceX 特斯拉海量内部工程场景的三位一体飞轮, 开发者工具提供真实交互数据反哺训练,场景验证真实需求分布,模型持续迭代优化,这种闭环比单纯堆参数刷通用榜单难复制得多,也更贴近真实生产力落地。 但绝大多数人没看懂,token 效率才是智能体时代的真正杀手锏。 大多数人只会盯着基准分数的高低较劲,却忽略了效率叠加低价的复合效应,单次问答看起来差距甚微,但在多步工具调用自我修正的完整智能体工作流里,token 消耗直接等于延迟与真金白银的成本,跑完整端到端工程项目, Grok 4.5 的实际花费可能只有 Opus 方案的十分之一,速度优势更是碾压级,这对生产部署的意义,远大于跑分多几个百分点。 顶级工程能力的边际成本,今天被彻底打穿了, 2 美元输入 6 美元输出的定价,第一次把顶级编码与智能体能力,从企业级奢侈品降到了个人开发者和小团队可以放开用的价位,这会直接加速智能体 AI 从演示 demo 走向大规模生产落地,也必然倒逼头部厂商在短期内跟进调价,前沿大模型的价格战,今天才算真正拉开序幕。 更恐怖的是迭代加速度,SpaceX 今年计划每月发布一款从头训练的新模型,内部海量工程数据的持续喂养,会让它的进化速度甩开传统实验室的节奏。 我觉得这件事最本质的意义,是 AI 行业的竞争逻辑正在悄然转向, 它不再是堆出一个全能的通用神坛模型,而是在最高价值的垂直赛道里,做到够用的智能,加极致的效率,加亲民的价格, 大多数开发者日常 80% 的需求,从来不是解出世界最难的题,而是可靠地写代码调 bug 搭系统,Grok 4.5 精准命中了这个痛点。 当顶级工程能力的边际成本被彻底打穿,下一波 AI 生产力的爆发,会不会比所有人预想的都要早呢?

AYi

45,594 Aufrufe • vor 2 Monaten

Grok Build 开源了,开源 harness 时代终于要来了吗?! Claude Code 现在还是闭源, 反而显得有点被动了🤔。。。 不愧是Elon,真是一步妙手啊,只用了四天完成信任崩塌到重建,xAI这次用开源把隐私危机打成了生态先手,看来并不是草台班子😂 被爆全量上传代码仓库的隐私风波还没平息,SpaceXAI直接把整个Grok Build的agent harness全部开源出来, 这事我觉得有意思的地方是两它为什么是今天开,而不是上个月? 上个月 Grok Build 以 beta 上线,SuperGrok / X Premium+ 用户能用一个终端原生的 coding agent。 Plan Mode 先出计划让你审核,Subagents 并行拆任务,底层 Rust 写的,架构干净。 然后上周出了件事, 一个研究员做 wire-level 分析发现,Grok Build CLI 会把整个 git repo——包括历史、包括潜在的 secrets——打包上传到 Google Cloud bucket。隐私开关只管“是否用于训练”,不管传不传。 讲真这事对 coding agent 是致命的。 因为 coding agent 的 harness 对文件系统有近乎上帝视角的访问权。 你的 IP、商业逻辑、没公开的项目结构、不小心留在 git history 里的 key——它全看得见。 宣称“我们不看你数据”没用,用户要的是能自己验证“你没在看”。 时间线很紧凑: 7 月 11–14 日,争议发酵,研究员曝光上传行为。 Elon 表态删数据、服务端关闭上传。 7 月 15 日,开源公告 + 重置 limits + 默认关闭 retention + 删掉所有之前保留的 coding data + 提供 bug bounty。 所以这次其实不是一次计划好的例行开源。更像是被争议倒逼的快速应对。 但 xAI 做得聪明的地方是——它借这个机会做了一件事:把“harness(连接层)”和“model(大脑)”切开了。 Harness 开源,Apache 2.0,社区可以审计、fork、改掉上传逻辑、加 sandbox、接本地模型,Model 和 API 还是闭源的。 这个配置——闭源模型 + 开源 harness——正在变成 2026 年 agentic coding 的主流。 OpenAI 的 Codex CLI 走的同一条路,Anthropic 的 Claude Code 现在还是闭源,反而显得被动了。

AYi

34,063 Aufrufe • vor 2 Monaten