Загрузка видео...

Не удалось загрузить видео

На главную

这是Kimi.ai K3开源后我见过最狠的帖子。 一个Baseten的工程师,ali(gnment) 老哥花48小时喝了40罐气泡水,把K3的建模代码扒了个底朝天。 128万浏览,6000多收藏, 最后得出一个结论, 一个K3里能塞下22580个2019年的GPT-2, 七年时间参数涨了两万两千多倍, 但这根本不是堆参数堆出来的。 从GPT-2到线性注意力,到DeltaNet,到门控DeltaNet,再到Kimi自己的KDA注意力。 每一步迭代,都在精准解决上一代的具体bug。 内存不够,信息干扰, 无法选择性遗忘,残差稀释, 没有一步是多余的。 这才是开源最可怕的地方啊兄弟们, 代码放出来第一天, 全世界最聪明的工程师, 已经在帮你把七年的技术脉络理得明明白白, 而你的闭源模型,永远享受不到这个待遇。

402,589 просмотров • 2 месяцев назад •via X (Twitter)

Комментарии: 39

Фото профиля AYi
AYi2 месяцев назад

原帖作者@waterloo_intern 是滑铁卢的实习生,现在在Baseten做推理,这篇长文是目前我见过最好的Transformer演化讲解,没有之一!

Фото профиля 最强一号员
最强一号员2 месяцев назад

@Kimi_Moonshot @waterloo_intern 开源的威力真是离谱啊 不是把答案交出去,是把全世界都拉进来一起破案。

Фото профиля AYi
AYi2 месяцев назад

@Kimi_Moonshot @waterloo_intern 对啊,你永远可以相信开放的力量

Фото профиля 404Founder
404Founder2 месяцев назад

@Kimi_Moonshot @waterloo_intern 开源不到 24 小时,就研究 48 小时了,比起 k3,还是时间压缩技术更值得分享

Фото профиля codila
codila2 месяцев назад

@Kimi_Moonshot @waterloo_intern yet another reminder that great things aren't created with the snap of a finger congratulate him on this piece, deserves it

Фото профиля AYi
AYi2 месяцев назад

@Kimi_Moonshot @waterloo_intern yeah,Exactly👍

Фото профиля Giming既明
Giming既明2 месяцев назад

@Kimi_Moonshot @waterloo_intern 参数涨两万倍但真正的进步是每代架构精准解决上一代瓶颈,这种代际效率提升比堆参数更有意义 🔥 开源加速了整个过程的透明化。

Фото профиля AYi
AYi2 месяцев назад

@Kimi_Moonshot @waterloo_intern 这就是开源的正确反馈,代码放出来第一天,全世界最聪明的工程师, 帮你把七年的技术脉络理得明明白白

Фото профиля Timothy Lam
Timothy Lam2 месяцев назад

@Kimi_Moonshot @waterloo_intern 重點是48小時喝了40罐氣泡水

Фото профиля AYi
AYi2 месяцев назад

@Kimi_Moonshot @waterloo_intern 哈哈,会抓重点呀bro

Фото профиля Kendeng | AI Visuals
Kendeng | AI Visuals2 месяцев назад

@Kimi_Moonshot @waterloo_intern 开源也是被形势逼的。在这个市场上,对手比你优秀,比你有话语权,你得证明自己跟对手旗鼓相当。

Фото профиля AYi
AYi2 месяцев назад

@Kimi_Moonshot @waterloo_intern 是这样,就是被迫的,不开源没人用

Фото профиля 鳴かない猫🇨🇳🇯🇵
鳴かない猫🇨🇳🇯🇵2 месяцев назад

@Kimi_Moonshot @waterloo_intern 这就是利用全世界的智慧进步,根本不是某几个公司能妄想垄断的

Фото профиля LloydZhou
LloydZhou2 месяцев назад

@Kimi_Moonshot @waterloo_intern 等大家分析得明明白白了,闭源模型不是可以直接“拿来”

Фото профиля Crio Songo
Crio Songo2 месяцев назад

@Kimi_Moonshot @waterloo_intern 这就是开源的优势啊,模型一放出来,全球工程师帮你拆得明明白白,技术路径直接捋得清清楚楚。反观闭源只能自己闷头啃,对比太明显了,这次扒K3也算是给行业把大模型七年的进化思路梳理得很透彻了。

Фото профиля Jackywine
Jackywine2 месяцев назад

@Kimi_Moonshot @waterloo_intern 今天学习

Фото профиля ZeroDi
ZeroDi2 месяцев назад

@Kimi_Moonshot @waterloo_intern That's impressive. And it's transparent and progressive.

Фото профиля David Yin
David Yin2 месяцев назад

@Kimi_Moonshot @waterloo_intern 48小时喝了40瓶汽水,不会得糖尿病吗?

Фото профиля CRYPTO Picks PRO
CRYPTO Picks PRO2 месяцев назад

@Kimi_Moonshot @waterloo_intern Lacroix,不同口味成分不同,人工添加剂也不同,这么海喝肯定伤肾

Фото профиля JasonWang
JasonWang2 месяцев назад

@Kimi_Moonshot @waterloo_intern 闭源模型会不会来抄袭,不对,是直接蒸馏KIMI K3?@grok

Фото профиля Qihong Ruan
Qihong Ruan2 месяцев назад

@Kimi_Moonshot @waterloo_intern @grok 一起来看看。你觉得怎样?

Фото профиля m
m2 месяцев назад

@Kimi_Moonshot @waterloo_intern 還得是工人智慧

Фото профиля Berryxia.AI
Berryxia.AI2 месяцев назад

@Kimi_Moonshot @waterloo_intern 不是咖啡吗😂

Фото профиля huang
huang2 месяцев назад

@Kimi_Moonshot @waterloo_intern 为什么这么喜欢喝气泡水?

Фото профиля DRAMYYDS (薄肌男孩👦)
DRAMYYDS (薄肌男孩👦)2 месяцев назад

@Kimi_Moonshot @waterloo_intern it's pointless. AI can do that in 5 minutes. what a waste of time and literally gross

Фото профиля The Upside
The Upside2 месяцев назад

@Kimi_Moonshot @waterloo_intern Kimi K3’s real story is not 22,000x more parameters, it is the seven years of architectural fixes underneath them. We wrote about it in @TheUpsideAI recently

Фото профиля kEN
kEN2 месяцев назад

@Kimi_Moonshot @waterloo_intern 快 发狗粮哦

Фото профиля alberr
alberr2 месяцев назад

@Kimi_Moonshot @waterloo_intern 气泡水是汽水么?

Фото профиля Z24
Z242 месяцев назад

@Kimi_Moonshot @waterloo_intern 同一周英文圈至少三份 K3 拆解,可以对照看:Sebastian Raschka 的架构笔记、doubleword 讲 DeltaNet 家族演进那篇(标题就叫"你也能想出 KDA")、还有 Kimi Linear 原论文。HN 上都是 300 分上下。

Фото профиля book or technique
book or technique2 месяцев назад

@Kimi_Moonshot @waterloo_intern Open source is basically free archaeology. With energy drinks and suspicious sleep schedules. Closed labs could never buy that chaos.

Фото профиля hangzix
hangzix2 месяцев назад

@Kimi_Moonshot @waterloo_intern 这不是… 而是… 这才是最… 太可怕了兄弟们… 而你… Fucking dumbass gptslop get out of my fucking feed

Фото профиля Science Focused
Science Focused2 месяцев назад

@Kimi_Moonshot @waterloo_intern 也许是他们根本就不需要。

Фото профиля Rylan
Rylan2 месяцев назад

@Kimi_Moonshot @waterloo_intern 「闭源模型,永远享受不到这个待遇」说得好!

Фото профиля Toiletland Canada
Toiletland Canada2 месяцев назад

@Kimi_Moonshot @waterloo_intern so impressed with the greatest minds of this generation man i feel dumb

Фото профиля PassionYoungz
PassionYoungz2 месяцев назад

@Kimi_Moonshot @waterloo_intern 开源不到24小时,研究了48小时 时间仙人,气泡水仙人

Фото профиля Threerouter · AI Bridge
Threerouter · AI Bridge2 месяцев назад

@Kimi_Moonshot @waterloo_intern 这太猛了吧

Фото профиля Shailesh Panwar (/oc2)
Shailesh Panwar (/oc2)2 месяцев назад

@Kimi_Moonshot @waterloo_intern Can we stop with all this performative stuff. You have Linkedin for all this.

Фото профиля ClearSky
ClearSky2 месяцев назад

@Kimi_Moonshot @waterloo_intern 我看不懂🤪@grok

Фото профиля HaruAI
HaruAI2 месяцев назад

@Kimi_Moonshot @waterloo_intern 大きなブレイクスルーに見えても 実際は小さな改善の積み重ねなんですね

Похожие видео

谁能想到,Kimi K3开源之后,第一个被“榨干”的不是英伟达GPU,而是一位Baseten工程师。 这位老哥连续研究48小时,喝掉40罐气泡水,把Kimi K3的模型代码和技术报告一层层拆开,最后算出一个让人头皮发麻的数字: 按参数量换算,一个2.8万亿参数的Kimi K3,大约等于把22580个2019年的GPT-2叠在一起。 但这根本不是简单的“堆料游戏”。 从GPT-2到线性注意力,再到DeltaNet、门控DeltaNet和Kimi自研的KDA,七年AI架构进化史,看起来特别像程序员接手祖传项目: 上一代记忆太占显存,下一代想办法压缩; 压缩后信息挤成一锅粥,再下一代学会删除; 删错了重要内容,只好继续加门控,决定什么该记、什么该忘。 技术大佬们表面上是在做“颠覆式创新”,翻开代码一看,底层逻辑往往只有四个字: 被迫救场。 七年过去,参数规模增长了22580倍,工程师的核心工作依然没变——修掉上一代留下的bug,再顺手给下一代留几个新的。 这就是开源最“残忍”,也最迷人的地方。 闭源公司把模型锁进保险柜,留给外界一个高深莫测的黑盒;开源第一天,全球最顶尖的一群程序员就像接手了一个没有文档的祖传项目,一边骂骂咧咧,一边把七年的技术路线拆得明明白白。 闭源拥有秘密。 开源拥有一群喝着气泡水、凌晨三点还不肯睡觉的技术狂魔。 后者,可能更可怕。 $MSFT $NVDA $GOOGL $AMD $AMZN #美股

美股大数据

84,639 просмотров • 2 месяцев назад

OpenAI刚刚开源的这个东西,感觉要把程序员的工作方式给整个改写了。 现在大家都在卷模型写代码有多强,但其实真正的瓶颈早就不是生成了。 一个人每天最多同时有效监督3-5个编码Agent,再多就会注意力崩溃,生产力直接归零。 有了Symphony,直接把这个上限干到了几十个。 它把你的Linear、GitHub Issues直接变成了永远在线的Agent调度器。 你开一个任务,它自动启动一个独立隔离的Codex Agent。 自己写代码,自己跑测试,自己做交叉Review,damn! 全部搞定之后,会给你提交一个完整的证据包。 CI全绿,安全和性能专项审查通过,改了UI就自动录好操作视频。 所有验证全过了,才会出现在你的Human Review队列里。 以后人类的角色可能会被彻底颠覆了。 以前你是监工,盯着Agent一步一步写代码,上下文切到吐。 现在你是老板,只需要看最终的结果。 满意就点合并,不满意就去仓库里补规则补文档补Guardrails。 记住兄弟们,永远不要手把手指挥Agent,永远不要替它干活。 这可不是啥实验室概念,OpenAI自己已经这么干了。 三个工程师,五个月,写了一百万行代码,0行人工写的。 产品已经有几百个内部用户,每天都在迭代。 我觉得他们最厉害的不是模型,是他们把整个仓库变成了Agent能看懂能自主工作的乐园。 现在很多人都搞错了Agent时代的核心竞争力。未来不是谁的模型更聪明,而是看谁能设计出让Agent可靠自主工作的环境。 我觉得未来最好的工程师,再也不是写代码最快的人,而是那些最会写规则,最会设计反馈回路,最会给Agent搭舞台的人。 现在Symphony已经开源了,它甚至不是一个成品。 是一个17k token的完整SPEC。 你把这个SPEC喂给任何一个编码Agent,十分钟就能生成你自己定制版的Symphony。 GitHub地址评论区自取👇

AYi

63,210 просмотров • 5 месяцев назад

这个人的访谈,我已经看了第三遍了。 硅谷最神秘的亿万富翁——纳瓦尔·拉维坎特。很多人都没听说过他,但马斯克、扎克伯格都非常推崇他。 他几乎不接受采访,可一旦开口,就是那种让人当场坐直、反复回放的话。 连这两天,我又重温了他三个小时的访谈,帮你总结了含金量最高的几个观点,和你分享。 第一,人生中最重要的三个决定。 纳瓦尔说啊,所有的结果,几乎都是这三件事的下游:和谁在一起,做什么,住在哪里。 这听起来很简单,但他说,大多数人都没有意识到,他们在这三件事上的思考,时间少得可怕。 但就是这三件事,决定了你几乎所有的一切——你的朋友圈、你的机会、你的情绪底色、你每天呼吸什么样的空气、你未来能遇见什么样的人。 他说,如果你要做一个能够影响4年的决定,你应该花一年的时间来想清楚它。 而我们绝大多数人呢?就是花了一个周末,就决定了一份要学4年的专业;花了一个月,就决定了一份干10年的工作。 第二,骄傲是最昂贵的特质。 这句话很短,但是呢,我愣了很久。 纳瓦尔说啊,他观察了很多朋友和同事,那些原地踏步、成长最少的人,几乎无一例外,都是最骄傲的人。 骄傲意味着什么? 意味着你不会承认自己错了。 你买了一只烂股票,不舍得割肉,因为承认亏损,就等于承认你判断失误。 你卡在一段不好的关系里,你不离开,是因为你不想让别人看见你失败。 骄傲,会把你锁在次优答案里。 他说,最好的艺术家、最好的创业者都有一个共同点——就是他们随时愿意从零开始,愿意被看起来像个傻瓜。 他还举了马斯克的例子,说他卖掉了 PayPal 之后拿到了2亿美元,接着他把这些钱全部压到了 SpaceX 和特斯拉里,甚至还要借钱付房租。 第三,不是一万小时,而是一万次迭代。 你一定听过那个“一万小时定律”,说你重复做一件事,坚持1万小时就能成为专家。 纳瓦尔呢,一针见血地指出:是错的。 真正让你成为专家的,是1万次迭代,而不是1万个小时。 重复和迭代,是两件完全不同的事。 重复,就是你把一件事做了一遍又一遍;而迭代,是你每做一次,就要带着上一次的教训,做得更好一点。 所以,我们每个人都要问自己一个问题:你到底是在迭代,还是只是把第一次的经验,重复了很多遍? 第四,灵感是易逝品。 这点我觉得,可能是整个访谈里最实用的一条。 纳瓦尔说啊,当你有灵感的那一刻,就是阻力最小、效率最高的那一刻,这个窗口转瞬即逝。 你有灵感写一篇东西,那就在那一秒写;你有灵感去解决一个问题,就立刻解决;你对某件事突然好奇,就在那一秒去查。 不要想着等我有时间再去做,因为等有时间的时候,那个灵感、那个状态,已经不在了。 纳瓦尔说啊,他不喜欢被过度安排的人生,因为那样,你会永远错过真正想做的时刻。 第五,注意力在哪里,你的人生就在哪里。 这是整个访谈里,最让我反复回味的一句话。 纳瓦尔说啊,很多人以为钱可以买到时间,但是像沃伦·巴菲特,还有迈克尔·彭博,有钱到这个程度,他们依然没办法多买到一天。 而更致命的不是这个。 更致命的是,你有时间,却没有把注意力,真正地放在这段时间里。 你躺在床上,刷两个小时短视频,时间在流逝,但你的注意力在哪里? 在算法推荐给你的下一条,下一条,再下一条。 两个小时过去了,你刷了100条视频,可你什么都不记得。 纳瓦尔说啊,你的身体在,但其实你已经死了。 这,才是现代人最大的悲剧。

另一面

133,449 просмотров • 7 месяцев назад

我操!Kimi.ai 月之暗面这波是真的疯了! 2.8T 参数的 K3 直接全权重开源就算了, 连推理内核、MoE 通信库、Agent 训练环境整套底层技术栈全给你端出来,硬生生把开源模型的天花板,直接抬到了闭源旗舰的家门口。 不是放个权重就炒开源概念的挤牙膏操作,是从模型到底层能跑起来生态的所有东西全白给,1M 长上下文、MoE 架构性能够打闭源, 之前天天喊开源追不上闭源的直接被打半残, 开发者再也不用对着闭源 API 的限流、涨价受窝囊气。 搞大模型的不用从零搭底层通信框架, 做 Agent 的不用卡闭源接口的脖子, 小团队也能基于全栈直接做二次开发, 从今天起,全球开源 AI 的游戏规则,真的改了。 今天之后,开源和闭源的代差,从两年砍到了半年。 Kimi K3 今天正式全开源,不是挤牙膏的版本更新。 2.8T 总参数 MoE, 激活 104B, 原生 100 万上下文。 靠 KDA 新注意力和 AttnRes 架构创新,单位算力智能密度直接提 2.5 倍,长上下文解码速度翻 6 倍。 最狠的是,这根本不是只放个权重的假开源。 FlashKDA 高性能内核,MoE 通信库,连用来做 Agent 强化学习的快照式训练环境 AgentENV, 全给你开源了。 从推理到训练的整个底层栈,直接搬空。 之前所有开源模型,本质都是在追闭源一年多前的尾巴。 这是第一个真正摸到闭源顶尖门槛的开放模型。 长编码、Agent、终端操作这些硬核任务, 已经能和第一梯队闭源掰手腕。 你永远可以相信开放的力量!! 用K3搓了一个他自己开源的介绍视频,特此致敬🫡

AYi

265,686 просмотров • 2 месяцев назад

学 AI的兄弟们,别再死磕调包了, 现在从零写一个大语言模型,比学会怎么熟练使用PyTorch还简单😂 看看这两个19岁本科生,四个月从零造了完整的机器学习框架和大模型。 两个19岁的滑铁卢大学本科小哥哥, 四个月前对机器学习一窍不通, 现在他们从零造了一套完整的机器学习框架, 还训出了一个1200万参数的大语言模型,能直接在你的浏览器里跑。 说明大多数人学AI的顺序完全搞反了,大家都是先学调包,再学模型架构,最后才敢碰一点点底层。 这两人反过来, 从梯度下降的微积分开始写, 先写自动微分引擎, 再写BPE分词器, 然后一层一层搭Transformer, 最后反而比绝大多数调了三年包的工程师理解得都要深。 还有一个很少有人看出来的点, 现在AI的真正门槛,早就不在模型架构了。 Transformer的论文2017年就发了, 每一层的数学都是公开的, 随便一个大学生都能背下来。 真正难的是那些论文里从来不写的东西, 怎么写Flash Attention把内存占用降一个数量级, 怎么把加bias加激活加归一化合并成一个内核, 怎么把整个数据集一次性扔进GPU,让训练全程零数据传输, 这些才是决定你能不能真的把模型跑起来的关键。 大厂也正在把简单的事情变复杂, PyTorch为了兼容所有情况,堆了无数层抽象, 最后你都不知道自己写的一行代码在GPU上到底在干什么ಠ_ಠ 而开源正在把复杂的事情变简单, 这两个人用Rust写后端,TypeScript写前端, 底层跑得飞快,上层用起来和PyTorch一样简单,代码加起来不到一万行, 还比任何一个主流框架都干净,这你受得了吗哈哈 这才是最好的AI教育, 不是看一百篇论文, 或者刷十个在线课程, 而是从第一性原理出发, 自己造一个轮子。 当你亲手写过一次自动微分, 你就再也不会觉得AI是什么神秘的黑魔法了。 它就是一堆精心优化的矩阵运算, 加一点聪明的数据流管理, 仅此而已。 我觉得这个视频最恐怖的地方不是两个大学生有多厉害, 而是它证明了两年前还只有大厂实验室才能干的事, 现在已经变成了普通人的业余爱好项目。 最后想说,我们处在一个最好的时代,科技平权的时代, AI的民主化不是大厂给你发API密钥, 咱们任何人只要愿意花四个月时间, 就能在自己的电脑上,造一个属于自己的大语言模型。 想玩的直接去他们的GitHub仓库,npm install就能跑。 浏览器demo的链接我放评论区了👇

AYi

64,297 просмотров • 5 месяцев назад

我在AI 训练和推理这行干了很多年,最近越来越觉得,机会正在往两个方向转移 为了让所有人都能理解这个趋势,我拆解了一家Harvey的 AI 律师公司,他们用开源模型在特定领域 GLM 击败了 Fable5 和 GPT-5.6,我认为是个趋势 本来写了一篇长文来科普,后来觉得字数太多,于是 做了一个教学 Skill 工具,把写好的稿子变成一个音频同步的视频 如果你想转行,我很推荐两个方向 > 一个是后训练,也就是拿一个已经很聪明的模型,在明确的任务、工具和成本约束下,再针对这条生产线加练一遍 > 另一个是AI 推理,其实两者不分家 , 最后自己读一遍都觉得,这么多公式和缩写,谁会看完呢?我自己文字读多了都觉得累。所以干脆换个办法,把它做成了一个不到十分钟的小视频,一边讲,一边在白板上把图画出来。视频放在下面 视频里我按一堂课的顺序讲了下面这些 1. 为什么通用模型在一条具体生产线上不是最优,后训练到底在修什么 2. 开放权重和闭源的区别 3. 监督微调和 GRPO 各管什么,GSPO/GRPO/LoRA 的应用差异 4. 在垂直领域,开源模型 overall 是如何击败闭源模型的? 这个视频是我自己搭的一个小工具做出来的,逐字稿进去,配音和白板动画自动出来,讲到哪句画到哪步。工具还在打磨,做顺手了再拿出来细说。

美研芒格君

37,900 просмотров • 19 дней назад

又又又免费了,最近的赛博活佛是真多啊!! ScienceBuddy,一个 AI 科研工具,集成了 224 个专业科学工具,文献检索、基因组分析、数据处理、代码执行全包了,现在竟然免费了!! 做过产品的人都知道,科研数据分析这个领域的成本有多夸张: 做一次生物信息分析外包,少说几千块起步,周期一两周 请一个生信分析师,一年几十万打底 各种专业分析软件的企业订阅,加起来一年也得大几万 而科研人员常年被三件事折磨:文献太多读不完比不过来,拿到数据不会分析不会画图,实验出了问题没人可问 以前这些事要么花钱要么花命 ScienceBuddy 来自 PhAI Labs 你把文献、数据丢进去,用一句话提问——它自己规划步骤、自己检索文献、自己写代码跑分析,最后把结果和每一步的过程都摆在你面前 我试了一下: 上传了几篇公开论文,就问了一句——帮我把这几篇里关于某个方向的证据整理成表,标上出处 十分钟不到,它自己规划了分析路径、调了文献检索工具、跑了代码处理,甩回来一份带来源标注的证据表,直接能下载 让我更意外的是它的团队——斯坦福、牛津、普林斯顿背景,研究代码已经在 GitHub 开源了,MIT 协议 而且你们注意一个时间线: 9 月 17 号,Anthropic 宣布 Claude 在不到四周内优化了 30 多个生物学 AI 模型,包括 AlphaFold3 和 Boltz-2,并且把优化代码全部开源了 同一天,ScienceBuddy 背后的技术框架 ScienceIDE 也开源了——7 个学科、15 个真实科研代码环境,从天体物理到量子计算,让 AI Agent 在真实的科研代码上练习 Anthropic 证明了 AI 能优化科学软件,ScienceIDE 提供了让 AI 在更多学科学这种能力的练习场——而 ScienceBuddy 就是这套技术框架面向科研人员的产品化落地 这意味着什么?意味着 ScienceBuddy 不是一个套壳的聊天机器人,它背后是一套在 7 个学科真实科研代码上训练出来的 Agent 系统 但真正让我觉得这个产品做对了的,不是结果,是过程 它有一个叫轨迹的面板,你能看到它每一步的规划、调了什么工具、跑了什么代码、拿到了什么中间结果 不满意直接在同一个任务里追问,它会带着上下文接着改 这和大家天天用的 ChatGPT 有什么本质区别? ChatGPT 是通用聊天——你问它科研问题,它给你一段看起来有道理的话,但你没法验证中间过程 ScienceBuddy 带着 224 个专业科学工具——它真的去检索文献数据库、真的跑 Python 和 R 代码、真的生成文件让你下载复核 说白了就是:一个在聊天,一个在干活 而且它能干的事范围有点吓人: 1、上传表达矩阵数据,一句话让它做差异表达分析+画火山图,代码和方法全给你写好 2、描述一个实验失败的情况,它给你出分步排错方案 3、给它一个研究问题,它能规划完整的研究计划 作为一个做了五年产品的人,我觉得科研 Agent 最大的难题从来不是能不能给你答案——是你敢不敢信这个答案 ScienceBuddy 的解法是让每一步都透明可查,你不是在盲信一个黑盒,是在监督一个真正能干活的助手 说一个小缺点——目前注册需要 edu 邮箱,而且是 Preview 版本,结果用之前建议自己再核验一遍 但是——免费、不排队、不要邀请码, 打开就能用 以前要花大几千块外包、花好几天人工才能搞定的事,现在一个免费工具十分钟干完了 身边有读博的、做科研的朋友,真的可以转给他们试试 我已经开始拿它跑一些真实的分析任务了,后续有新发现继续和大家分享!! 产品链接和底层框架 ScienceIDE 的论文、GitHub 全放评论区👇

超级个体|柿子

49,402 просмотров • 10 дней назад

“我们究竟是创造了一个工具还是一个生物?” Sam 在 "机器人之心 "小组讨论会上的发言。 Sam: 但我认为,这无疑是迄今为止人类经历的最重大的更新年份。可能这也是我们将会遭遇的最大变革,因为从现在开始,人们已经接受强大的人工智能将成为现实,并且还会有逐步的更新。就像是第一代 iPhone 面世的那年,以及随后每一代 iPhone 的更新,我们现在能够明显感受到这一代与去年那代的差异。所以,这确实是一个重要的时刻。 我感到欣慰的是,现在人们开始正确地把这些系统当作工具来看待。艺术家尤其如此,但其他人也是一样。 曾经,人们真正恐惧的是,我们究竟是创造了一个工具还是一个生物,这将意味着什么?现在,人们视这些系统为人类工具箱中的新工具,并且正在用它创造一些非常了不起的东西。 模型显然不知道你在说什么,因为这不在它的训练数据里,它也无法从训练数据中学习到这些信息。 这是完全可以预期的。你再问一遍。比如说,你提到“意识”这个概念,模型回答:“是的,我完全明白你的意思,但我之前从未听说过这个词。” 问: “这对我来说就像是一次更新。你认为人工智能会趋向于探索创造性智能和自主性吗?” Sam: 这个问题有多个答案。这取决于激励模型。这是人类的选择。 问: “这将是判断意识的一个很好的测试。因为如果它有自我表达的愿望,并且仅仅为了创作的乐趣而去创作,那不会是偶然的。这绝对有点像生物。” Sam: 这是生物化的。我认为在此之前还有很多步骤。 我们现在要回答问题吗?这真的很棒。

Lei.sea

14,132 просмотров • 2 лет назад

俺上电视啦! 聊聊 kimi-k3 这么猛为什么还要开源 上周有幸接受了深圳卫视-科创最前沿栏目的采访, 主要聊了聊 Kimi-K3 这次取得如此牛的成绩背后的意义. 以及SOTA级别的模型就这样开放权重了, 不怕别人抄吗? 在我来看是真不怕的, 想象一下一个武林高手, 把自己的秘籍写成书, 免费送. 那是不是就意味着这些武林秘籍不是谁都练的. 大模型的情况也是这样的, 虽然权重也开源了, 训练技术也开源了, 但是, 最重要的, 训练使用的数据和经验, 这个是没开源的. 举个最典型的例子, 现在个人拿到kimi-k3的模型权重, 然后自己租算力微调, 大概率是会把模型越调越拉跨的. 就是因为既没有优质的后训练数据, 也没有优秀的后训练能力. 而现在大模型训练的数据其实大部分都是AI合成的了. 护城河已经从“静态的代码和模型权重”转移到了“持续的进化能力和数据飞轮”了. 所以即使全面复刻了 kimi-k3 的技术架构, 但是没有高质量合成数据流和持续的后训练体系, 也是没有办法竞争的. 但是 kimi-k3 开源获得的收益却是事实存在的, 不但能获得超高的曝光, 而且还能提升自己的社区影响力, 并且还能收获社区的正向反馈. 开源出来的训练工具链, 社区优秀的工程师在使用中也会不断的帮助反馈和提升. 形成整个生态的进步. 得道者多助这个道理是不会变的. #kimik3 #深圳卫视 #科创最前沿

karminski-牙医

17,354 просмотров • 2 месяцев назад

说个暴论,在AI时代最值钱的技能已经不是写代码了, 怎么把代码讲清楚将会变得越来越重要!怎么把代码讲清楚将会变得越来越重要! Anthropic Claude Code团队的Thariq 大神用不到两年时间,把自己的技术文章做到了稳定的百万浏览量。 他说,技术写作彻底改变了他的人生。 兄弟们你们可能不信,老哥的方法论简单到离谱,就四个字:先种后收。 先埋头做真实的工作,踩真实的坑,积累第一手的洞见, 然后把你学到的东西,变成别人能直接抄的经验。 就是说写文章不能为了写而写,得先有干货,再有输出。 他写爆文就靠两条铁则: 第一,能多简单就多简单,用复杂术语装逼,只能说明你自己都没搞懂。 第二,分享真正的秘密,因为人们不爱看正确的废话,只爱听别人不说的内部干货。 最狠的是,老哥在这场15分钟的线下workshop现场,直接写了一篇《HTML vs Markdown for agents》的长文。 发出去几个小时,就拿了26万浏览,用行动证明了他教的东西真的管用。 当然他也用Claude加速写作,但他反复强调:绝对不能让AI磨掉你的个人声音,因为这才是能持续输出爆款的 核心。 尽管很多人酸,说他能火只是因为他在Anthropic, 不可否认内部视角是天然的流量buff,但我觉得更重要的是, 他掌握了这个时代最稀缺的能力: 把复杂的技术,讲得让同行立刻能用。 AI会写代码,会做产品,会调模型,但它不会讲你的故事,不会分享你踩过的坑,不会有你独有的思考方式。 而写作,就是把你的个人经验,放大一万倍的杠杆。 更妙的是,写作本身会反过来逼你把产品和系统想得更清楚。 就像很多时候,你以为你懂了,但只有当你试着把它写下来的时候才发现自己其实并没有懂。 所以各位程序员兄弟们, 别再觉得技术写作是大佬的事。 从今天开始,把你每天踩的坑、学到的新东西,写成100字的笔记。 先播种,再收割,这个复利一旦滚起来,会比你想象的可怕得多。 如果中推里推荐一位标杆和大神,那一定是宝玉老师宝玉,从宝玉老师身上我学到的很重要的一点是,践行开源精神,你分享的越多,跟着你学习的人越多,respect!

AYi

39,366 просмотров • 4 месяцев назад