Загрузка видео...
Не удалось загрузить видео
喵的太魔幻了,有点 Claude 干翻 Google 的感觉😂 这个程序员老哥 Tom Turney只用7天,就把谷歌砸翻全球内存股的十亿级算法,干成了比官方承诺还快的开源实现, 谷歌只发了颠覆性的KV缓存压缩论文,半行代码都没放出来, Tom Turney啃完论文里的数学公式,打开终端靠着Claude辅助, 7天就走完了大厂几个月的路, 前三天写完核心算法, 搭好141个测试用例, 跑通Python原型, 中间两天直接移植到llama.cpp, 写完Metal GPU内核, 最后两天疯狂优化, 把推理速度从739 tok/s干到了2747 tok/s, 纯工程优化就实现了3.7倍的提速, 他还在谷歌的方案上, 加了三项自己的研究创新, 长上下文跳过90%的value解压, 非对称K/V压缩保留key精度狠压value,老token自动降低精度, 最终成果是35B大模型,在普通MacBook上就能流畅跑,KV缓存直接压缩4.6倍,开源仓库上线一周就拿到613个星标,而谷歌到现在, 都没放出自己的官方代码, 说实话,这才是2026年最真实的写照,一个普通人加AI,就能把大厂攥在手里的核心技术,直接干成人人能用的开源工具,真的牛逼🤙 github 地址评论区自取👇
522,358 просмотров • 5 месяцев назад •via X (Twitter)
Комментарии: 54

你两天就学完了牛顿三定律,所以你比牛顿伟大了几百倍

哪跟哪啊兄弟😂

Google :艹!我就说不能发论文吧!又一个《Attention is all you need》事件!

哈哈哈哈,笑鼠,必须回关个

谷歌:论文我发,代码你们自己写 这操作太典了

哈哈哈虎哥神评🤙🤙👍

低调低调

哈哈哈你这实力没法低调,会说要多说哈哈,以后中推文第一评论大佬非你莫属

低调不了低调不了

这才是开源的魅力所在——一个人、一周时间,就能把大公司藏着掖着的论文变成人人可用的实现。谷歌发论文不发代码,结果被社区抢跑了,颇具讽刺意味。

@aa22396584 是啊,又魔幻又讽刺

With the help of the community we are making this a reality! Thanks for the shoutout!

Huge respect! Turning Google’s paper into a working, faster-than-original implementation in just 7 days is absolutely insane. The whole community is going crazy over this 😂 Thank you for open-sourcing this and making 4.6x KV cache compression actually usable on MacBooks and consumer hardware. Keep killing it! If you need any help with testing, spreading in the Chinese community, or feature requests, just let me know — we’ve got your back 🤙

谷歌是覺得這麼簡單的東西,沒必要特地搞開源吧。主要是他論文可能不是在開源的LLM 上驗證的

哈哈也有可能😁

这特么是普通人?😓😓 这是盘古🤔(„ಡωಡ„)

@cnzoecomeback 哈哈哈程序员里的翘楚

补个细节:Tom用的是Claude做代码生成+debug循环,但核心突破是他自己手推了论文里SVD分解那段数学。工具再强,看不懂公式等于零。这波说明独立开发者啃论文的ROI被严重低估了,比卷框架有效多了。

The real story isn't that one person replicated Google's work — it's that Google chose not to release code, betting on paper prestige over community adoption. In 2026, shipping beats publishing every time.

maybe😄

他这个怎么着也算不上是个普通人吧😅

老哥有點強啊 靠公式逆向工程

非常强🥹

AI的普及,就是天赋人权中,受教育权的体现。获取知识,现在变的无比廉价,就看你怎么运用了。

论文、算法都有了,写代码简单复现不是有手就行?关键是稳定吗?能在大规模集群上用吗?

关键不是7天写完代码,是他自己读懂了论文数学然后还加了3项创新。Claude处理的是工程苦力活,真正的判断力还是人的。大厂慢不是因为不会写代码,是因为要排队上会过审批

what is irony is that he still uses LLMs from big companies for this work CLAUDE, GEMINI, GPT, THEY ARE ALWAYS THE WINNER

ヽ(´▽`)ノYes~

如果Claude能代替他啃数学公式就更好了 🤗

会实现的(⁎⁍̴̛ᴗ⁍̴̛⁎)

不要被AI 格式工整的搜索结果蒙蔽了双眼,注意AI 的输出不是100%确定的,有时也会一本正经忽悠你。

@grok 所述大模型需要什么配置可以流畅运行

这个是真牛逼

我一开始不敢相信,以为是噱头吹牛逼,查证以后惊呆了😂

kv cache 压缩跟在本地跑大模型的内存占有率关系不大

可以 虾又有事儿干了

哈哈哈,虾要干大事了

咱俩这时间挺照对 哈 我这是早上9点23

兄弟在哪,加拿大还是美国

在加拿大 刚送完孩子 到家 哈哈
艹,有这水平,这哥们可不普通啊!

程序员圈的翘楚了吧

所以AI真正解放了個人的生產力!

Absolutely!

普通人的定义到底是什么啊,一点都不普通啊

不错

google想干皮衣黄和内存厂商

大厂卷的厉害

RabitQ???

这哥们还是懂这种技术的人,直接复现+提升

原来这也能叫普通人吗😂

這太勵志了!一個人加上 AI 就能把大廠的技術幹成開源工具,說明了 AI 時代的生產力天花板真的被推高了。

"啃完论文里的数学公式" 肯定不是普通人

这也不是普通工程师,至少能看懂论文,大部分码农都不知道KV cache
