
Berryxia.AI
@berryxia • 47,933 subscribers
Building AI tools AI System Prompt Love Design & Coding & Share Prompt! 📮:[email protected]
Shorts
Videos

尼玛,现在GPT-6 已经可以干到这种程度了。 ChatGPT 每进入一个行业,都会从新洗牌。 这换做一年前也不敢想可以干到这种程度啊~~
Berryxia.AI47,536 views • 6 days ago

好莱坞的电影CG特效的人员应该已经裁员了不少人了。 真的现在只是模型初期,后面迭代真不敢想。 骂归骂,闹归闹,GPT-6 Astra 这一波真的赢麻了。 原视频出处:澜森
Berryxia.AI34,075 views • 6 days ago

兄弟们,感觉3D建模 CAD “要死啊”? Kimi 3直接吊打头部的模型了! 这个质感和交互都是一气呵成,根本不需要你搞很负责的Prompt. 不废话,直接看视频。👇🏻
Berryxia.AI274,087 views • 1 month ago

卧槽,真的被Kimi 3搞服了!真牛逼。 感觉是吊打Kimi 2.7啊! 我们先看看上一代2.7模型同样的Prompt 实现的测试。
Berryxia.AI165,714 views • 1 month ago

你敢信? 这是我单靠一张嘴撸出来的啊! 你可要知道这个东西之前JigSpace就靠这个发家致富的啊~ 太特么细腻和细节到位了…
Berryxia.AI143,115 views • 1 month ago

这速度真特么离谱啊!卧槽! 最新开源的Unlimited-OCR能一次性处理几百页文档,而且速度还很稳。 而这个模型来自百度刚刚在hugging face 发布,其核心创新是R-SWA(Reference Sliding Window Attention)。 它让模型在解码时KV Cache保持恒定,不会随着文档页数增加而爆炸式增长。 结果就是:一张图或者一本多页PDF,直接扔进去就能一次性解析完,速度和稳定性都比传统逐页处理的方式好很多。 在OmniDocBench上拿到了93分,比DeepSeek-OCR高出6个百分点。 这已经不是简单的准确率提升,而是把长文档OCR的工作流从“分块+外部调度器拼接”变成了真正的端到端一镜到底。 以前做多页文档最头疼的就是上下文断裂和格式不一致,现在模型能一次性看到整篇文档的结构、布局和逻辑关系,输出质量自然上了一个台阶。 这其实是把OCR从“认字工具”往“长文档理解引擎”又往前推了一大步。 技术路线很清晰,也很实用。 果然百度现在OCR独树一帜,遥遥领先了。 模型地址见评论区~ 👇
Berryxia.AI151,326 views • 2 months ago

我靠!据说这个系统很牛逼,赶紧给你的废弃的低配的 Mac 和 Windows 装起来! 222DHH把Omarchy Quattro称为自己职业生涯中最伟大的软件发布之一。 Omarchy 4.0正式上线。 他强调“电脑就该有趣”,并为此投入了大量热情。这次更新配了全新的git驱动手册,方便和代码同步,同时放出了详细的CHANGELOG和发布视频。 DHH一贯用产品表达自己的理念:软件不该复杂到让人痛苦,而应该让人用着开心。 Omarchy继续沿着这条路,把Linux桌面体验做得更顺手、更有乐趣。 当一个Rails之父级别的人如此高调推荐自己的桌面系统时,值得去看看它到底解决了什么痛点。
Berryxia.AI42,024 views • 25 days ago

兄弟们,都已经2026年了! 强烈推荐了~ 但最荒谬的是-顶级AI公司里不少工程师,每天调提示词、刷benchmark。 却对LLM到底怎么从零构建出来的了解,远不如斯坦福这堂2小时公开课。 它把ChatGPT、Claude这类大模型的完整诞生过程,从Transformer架构到训练技巧、Scaling law、数据配比、甚至最底层的优化细节,全都拆得清清楚楚。 抖音快手短视频能让你放松2小时, 斯坦福这堂课却能让你在2小时内,真正看懂整个AI时代的底层核心要素。 免费、公开、含金量夯到爆啊!。 很多在OpenAI、Anthropic工作的人,都没系统学过这么多。 真正想懂AI的人,现在就把抖音关掉,打开这个视频开干。
Berryxia.AI176,413 views • 4 months ago

这个开源视频制作工作流真爽啊! 单日斩获3000 Star,真的牛~ 又一个把AI coding agent直接变成视频制作工作室的项目开源了,叫OpenMontage。 它把整个视频生产流程拆成12条结构化pipeline(动画解说、纪录片蒙太奇、电影感、Talking Head等),内置52个工具和500+个agent skills。 用户只需要用自然语言描述需求,agent就能完成调研、脚本、素材生成、剪辑合成全流程。 最硬核的是它同时支持AI生成内容和真实素材工作流,还做了生产级的质量把控(预合成验证、后渲染自检、预算控制)。 渲染引擎用了Remotion和自研的HyperFrames,能输出高质量的动态视频。 本质上它是把“视频制作”这件事彻底agent化了,让普通人也能通过对话让agent产出接近专业水准的视频内容。
Berryxia.AI107,097 views • 2 months ago

兄弟们,3D资产生成彻底要起飞了。 Cambridge大学助理教授Elliott Wu(前Stanford、Oxford背景)团队刚放出了Articraft——一个真正的agentic coding系统。 它不是简单生成静态3D模型,就可以让AI agent自己写代码、自己执行、自己接收物理验证反馈,不断迭代,最终输出带零件、关节、真实运动的可交互3D资产,直接就能扔进机器人仿真和物理AI场景里用。 以前做一套高质量articulated asset要花几天甚至几周,现在agent全自动跑通,整个过程高效到离谱。 他们顺便还开源了Articraft-10K数据集:超过1万个跨250个类别的articulated 3D物体,全部可交互、仿真就绪,彻底把大规模机器人训练和物理世界AI的资产门槛拉到了新低。 物理AI和机器人仿真的“数据饥渴”问题,被这个agentic pipeline直接干掉了一大半。 项目页面在这里: 完整代码和数据集也在GitHub开源。 如果你在做机器人、仿真、物理AI或者3D内容生成,这波开源值得立刻去试。 PS: 还未实测,待后续测评!
Berryxia.AI139,482 views • 3 months ago

Moonshot AI创始人杨植麟最近放出了一个40分钟视频。 这位92年生、清华计算机本科第一、CMU博士、Transformer-XL和XLNet共同作者,前Google Brain和Meta研究员,坐在镜头前平静拆解了Kimi K2的整个训练过程。 他们只花了460万美元。 上周一场8模型实时编程大战,Kimi K2直接拿下第一,GPT-5.5排第三,Claude Opus 4.7第五。 我看完后最大的感受是,AI竞赛的规则已经在悄然改变。 所有人还在拼谁敢烧更多钱、堆更多算力,他却用极致优化、线性注意力、子代理这些硬核架构,把资源差距直接抹平甚至反超。 40分钟全是干货,零废话,把关键打法讲得清清楚楚。 如果你正在做AI代理,或者准备2026年入场大模型赛道,这段视频强烈建议存下来周末慢慢看。 小团队靠聪明架构,正在把大厂的传统玩法一点点颠覆。 你还觉得只有堆钱才能赢吗?
Berryxia.AI115,679 views • 4 months ago

🚀 Apple M芯片本地LLM速度太顶了!DFlash推测解码,Stock MLX零fork, Qwen3.5最高4.13倍加速太猛了! 专为M系列芯片优化,速度简直了…
Berryxia.AI138,761 views • 5 months ago

🔥兄弟们!终于肝完了!!! 赶紧来领你的桌宠啊! 这次真·爆肝,连续熬了好几个大夜,今日手搓Openclaw 御姐Amy AI语音全能助手! 麻烦大家给我的第一个Github 开源项目Star啊!!! 🦞 想象一下这个场景: 桌面角落蹲着一只小龙虾 你随口说: → "帮我查查邮件" → "把桌面整理一下" → "三点提醒我开会" → "帮我做份周报PPT" 它秒懂,然后就去干了。 当然,Amy姐姐可能更适合做宅男的小桌宠啊! 御姐Amy 直接帮你把桌面整的整整齐齐的! ⚡ 设计思路: 使用核心三件套:OpenClaw + MInMax 2.5 (国际)+Ten Framework RTC 开源框架!构建而成! ✍🏻体验交互: 点小球/双击展开 ↓ 实时语音识别(Deepgram Nova-2,边说边出字幕) ↓ Clawdbot + MiniMax 思考 ↓ 流式断句 + MiniMax TTS 甜音播报 ↓ 第一句几乎秒出,啰嗦了?直接打断它 🎭 多个角色随便换: - 小虾米(默认甜妹音) - 傲娇Amy 每套都有状态动画+光环特效 (下一步上 Live2D!) ✨ 更多细节: - 38+ 声线随便挑 - 耗时任务说"稍后"就后台跑,做完通知 - 不用?缩成 64px 小球,常驻不碍事 - 说完自动 30s 追问窗口,继续说就行 🎯 核心想法就一个: 让 AI 真像助手 动嘴就完事 不想让用户多点一下! 如果你已经有了OpenClaw 我强烈建议你领养一只! 这只小龙虾真的太可爱了大家觉得呢? 麻烦一键三连啊 ,兄弟们,让我感觉没白秃~ 地址放在评论区啦!
Berryxia.AI168,554 views • 7 months ago

卧槽 !这个项目可以啊! 又一个完整的AI视频创作平台开源了,前后端都是MIT协议。 Magiviz把“写剧本 → 定角色 → 画分镜 → 生成视频 → 成片”做成了全流程AI工作流,最长支持生成60秒视频,内置12种主流视频模型。 作者说好开源就开源,代码已经全部放出来。 现在做AI视频工具的人越来越多,但能把从剧本到成片的完整链路开源出来的还不多。 对想自建或二次开发视频生成系统的人来说,这是一个可以直接上手的基础。 创作精良的1080可以看看那个五折的平台搞一下! 多个选择! 开源视频工作流正在从单点模型,走向完整可复用的创作平台。 你会考虑基于它二次开发自己的视频工具吗? 项目地址见原贴👇
Berryxia.AI22,893 views • 23 days ago