正在加载视频...

视频加载失败

最近 Meta 发布的 Muse 爆火,10 天就冲上 App Store 免费榜第一,可惜大部分人还是用不上。 偶然发现,CopilotKit 团队照着 Muse 的思路做了一个开源版 OpenMuse,可部署在自己服务器上。 它也配了一台自己的电脑,浏览器会保留登录状态,查东西时随时能点接管,自己操作完再交还给它。 GitHub: 发邮件、改日历每一次都要人确认才执行。还能定期盯着商品页面,价格降到设定值,App 里就会收到提醒。 iOS、Android 和网页三端代码全开源,模型可以接 OpenAI、Anthropic 或 Google,部署时要准备一个 CopilotKit 的项目 Key。 我觉得 Muse 最让人眼馋的,就是那台 24 小时在线的电脑,OpenMuse 把这套东西搬回了自己手里,想要试试的可以部署看看。

17,372 次观看 • 3 天前 •via X (Twitter)

4 条评论

cloutusf 的头像
cloutusf2 天前

24小时在线的电脑,发封邮件还得先举手确认,这助理权限比实习生还小

chinaman 的头像
chinaman2 天前

家里没个旧笔记本?不能自己搞一套在线agent?

maybe 的头像
maybe2 天前

什么都可以开源👍

周彦充 的头像
周彦充2 天前

OpenMuse 把发邮件、改日历都设成要人确认,这一步对,但只管住了按钮。 Muse 前几天替人卖键盘,住址却是在聊天里直接说给买家的,一个确认框都没弹。聊天里说出口的字,也该先过人。

相关视频

🔥AI搬回本地! $NVDA 黃仁勋剛剛宣布重大突破, 个人电脑迎来全新时代! ———————————— 过去四十年,一直是你在伺候电脑。 这一次,它要反过来。 我们这代人,是被机器训练大的。记快捷键,清后台,等进度条,文件存在哪个文件夹自己得记牢,我们学会的全是“迁就它”,把自己一点点训练得像台机器,它才肯好好干活。 所以黄仁勋这次最重要的东西,很多人看漏了。不是又一个开源模型,也不是新芯片的跑分。是 AI 要从云端“搬回家”,住进你这台本机里。 这两年我们用的 AI,说穿了都是“租来的大脑”。你得先把家底打包上传:合同、工资条、还没写完的东西、和家人的聊天记录。它在别人的机房里跑,按别人的价收钱,入口攥在别人手里。聪明是真聪明,可它始终不是你的,你只是个访客。 而“本地 Agent”这四个字的意思是:这些东西,终于可以留在你自己屋里了。不用上传,不用排队,不用看网速的脸色。它能看你的文件、懂你开着的软件、替你把那些零碎活儿干完。第一次,电脑不再是你点一下它动一下的工具,而是一个会自己动手的人。 为了这件事,老黄把数据中心级的算力,上百 GB 的统一内存、接近一个 petaflop 的性能,硬塞进了一台摆得上书桌的小机器。不是为了让你在本地跑个玩具模型,是为了让你桌上这台电脑,真有本事自己干活。 往大了说,棋局其实很清楚:云端那颗大脑,继续在数据中心里想最难的事;你桌上这台,负责手脚,管你每天的柴米油盐。而老黄想要的,是大脑和手脚,两头都攥在自己手里。 但我更想讲的,是那种很具体的感觉。PC 是上一代互联网的入口,手机是移动时代的入口。下一个入口不在某个网站里,就在你书桌上那台开机的电脑里。谁先住进去,谁拿下下一个十年。 所以他这次真正想说的,从来不是“我们出了块更强的芯片”。 而是过去四十年,你把自己训练得越来越像一台电脑。 从今往后,是电脑,开始学着像你请来的那个人。

老白

15,858 次观看 • 3 个月前

OpenAI刚刚开源的这个东西,感觉要把程序员的工作方式给整个改写了。 现在大家都在卷模型写代码有多强,但其实真正的瓶颈早就不是生成了。 一个人每天最多同时有效监督3-5个编码Agent,再多就会注意力崩溃,生产力直接归零。 有了Symphony,直接把这个上限干到了几十个。 它把你的Linear、GitHub Issues直接变成了永远在线的Agent调度器。 你开一个任务,它自动启动一个独立隔离的Codex Agent。 自己写代码,自己跑测试,自己做交叉Review,damn! 全部搞定之后,会给你提交一个完整的证据包。 CI全绿,安全和性能专项审查通过,改了UI就自动录好操作视频。 所有验证全过了,才会出现在你的Human Review队列里。 以后人类的角色可能会被彻底颠覆了。 以前你是监工,盯着Agent一步一步写代码,上下文切到吐。 现在你是老板,只需要看最终的结果。 满意就点合并,不满意就去仓库里补规则补文档补Guardrails。 记住兄弟们,永远不要手把手指挥Agent,永远不要替它干活。 这可不是啥实验室概念,OpenAI自己已经这么干了。 三个工程师,五个月,写了一百万行代码,0行人工写的。 产品已经有几百个内部用户,每天都在迭代。 我觉得他们最厉害的不是模型,是他们把整个仓库变成了Agent能看懂能自主工作的乐园。 现在很多人都搞错了Agent时代的核心竞争力。未来不是谁的模型更聪明,而是看谁能设计出让Agent可靠自主工作的环境。 我觉得未来最好的工程师,再也不是写代码最快的人,而是那些最会写规则,最会设计反馈回路,最会给Agent搭舞台的人。 现在Symphony已经开源了,它甚至不是一个成品。 是一个17k token的完整SPEC。 你把这个SPEC喂给任何一个编码Agent,十分钟就能生成你自己定制版的Symphony。 GitHub地址评论区自取👇

AYi

63,210 次观看 • 5 个月前

这两天看到我一直很喜欢的设计师阿哲 阿哲Phil 的个人网站,我挺喜欢他个人主页的那个风格。 看着看着突然冒出一个念头: 这种个人审美很强的网站,模型光看录屏,能不能做出来? 于是我顺手录了 10 秒左右,从页面上划过去,直接把视频丢给 Ling-3.0-flash-VL,让它照着做一版。 没给源码,也没拆页面,更没写一大段提示词。输入就那段录屏,加上一句很简单的需求。其实扔进去的时候,我没抱多大期待。视频一晃就过去了,有些细节让我自己暂停看,也未必记得住。 Ling-3.0-flash-VL 是百灵在 Ling-3.0-flash 上加了视觉理解和 visual agent 的版本。官方提到的能力挺多,视觉感知、STEM、文档、前端编码、医疗报告都在里面。我这次没全测,就看一件事:它能不能看完一段网站录屏,真把页面做出来。 结果打开以后,我确实愣了一下。 按肉眼看,和阿哲的原版大概有七成像。大的版式、配色和页面感觉都抓到了,生成出来的也不只是一个摆着看的空壳。按钮能点,交互能跑,放进浏览器里,已经像个可以接着改的半成品。 当然,剩下那三成也挺明显。风格不够细腻,字体没那么贴,交互还是有点僵,一些细节只学到了大概。把两个页面并排放在一起,差距还是能看出来。要我直接拿去上线,我肯定不会;拿它当第一版,我觉得够了。 以前脑子里有个页面的样子,最麻烦的是说不清。你跟开发说想要“有点设计感”“交互顺一点”,讲了半天,对方可能还是不知道你想要什么。自己不会写代码的话,很多想法就一直停在收藏夹里。 现在简单多了。先找一个接近自己想法的网站,录一小段,让模型搭出来。哪里不对,直接看着页面改。它没有把阿哲的网站原样搬过来,但它把一张白纸直接做到了七成。 所以这次测完,我还挺愿意安利 Ling-3.0-flash-VL。离专业前端当然还有距离,但对没代码基础、想做个人网站或者产品 Demo 的人来说,先把第一版弄出来,已经能省不少事了。 感兴趣的都可以去试一试:

阿川 | AI thinking

37,185 次观看 • 18 天前

OpenAI 推出 dots:24 小时替你干活的 AI 分身 OpenAI 发布了常驻 AI 智能体 dots。普通聊天机器人是你问一句它答一句,dot 不一样:它有自己的云端电脑和浏览器,会记住你的偏好和做事标准,你不在的时候也会继续推进工作,还会主动发现该做的事。 dot 由新模型 GPT-6 Astra 驱动,能通过插件连接 4000 多个应用。你可以在 ChatGPT(桌面、网页、手机)、Slack、Teams 里给它发消息,也可以直接跟它语音通话,短信支持也快上线了。不管从哪个入口找它,它都带着完整的上下文。 它能干什么?OpenAI 举的例子都很具体。Slack 里有人报了 bug,dot 马上开始排查。设计稿一到,dot 就把它做成能跑的应用。开发者的 dot 会盯着用户反馈,自己修小问题、跑测试,再把附带演示视频的代码合并请求交给你审。有位早期测试者忘了给一家媒体开发票,他的 dot 发现后把发票准备好,经他同意后发了出去。 一个 dot 能同时跑好几个项目,你不用开一堆对话窗口挨个指挥。你随时可以打开它的云电脑看它在做什么;如果你授权,它也能直接操作你自己的笔记本电脑。 安全上,dot 默认只在自己的云电脑里工作,跟你的电脑隔离。你不在时它做的"主动调研"只有只读权限。发消息、改内容这类可能影响你账号的操作要先过自动审核,需要时会请你批准。改密码这种敏感操作永远只能你本人来。 除了个人 dot,OpenAI 还预览了"专员 dot"。企业给它分配独立的身份、账号和系统权限,让它专门负责采购、发票处理、客服这类明确的岗位。目前先在少数企业试点,同时和微软合作,让企业能用 Agent 365 里现成的管控工具管理 dots。 怎么用:从今天起,dots 在符合条件的地区陆续开放给 ChatGPT Pro 和 Business Premium 用户;企业版(含教育、医疗)需要管理员开启测试版。第一个 dot 包含在套餐里,不另收费。跟 dot 聊天不占 ChatGPT 用量额度,但让它去 Codex 或 ChatGPT Work 里执行任务,照常计入用量。第一次需要在 ChatGPT 桌面应用或电脑浏览器里创建,之后就能在手机上用。以后还可以加购更多 dot,或者提升单个 dot 的速度和每月工作量。

宝玉

59,888 次观看 • 2 天前

兄弟们,你们平时买二手东西是不是最怕买贵? 我现在直接发条iMessage就能让Airtap Ai替我刷eBay和Mercari。 ​ 最近我在看 Sigma 35mm F1.4。​ 买二手最烦的其实不是找不到,而是同一款东西在不同平台上价格能差一大截。​ ​ 有的便宜是因为成色一般,有的贵是因为配件齐,还有的看着像捡漏,点进去才发现有划痕,缺配件,或者版本根本不一样。​ ​ 真要自己比,就得在 eBay 和 Mercari 里面一个个点开商品看描述。​ ​ 所以这次我直接给 Airtap 发了一条 iMessage。​ ​ 让它先打开 eBay,搜索 Sigma 35mm F1.4,找到最新发布的 10 个商品,记下价格和商品描述。​ 然后再打开 Mercari,也搜同一款最新发布的 10 个商品。​ ​ 最后把两边放在一起比,看看正常成色现在大概卖多少钱,哪些明显偏贵,哪些虽然便宜但有坑,哪些值得我继续留意。​ ​ 然后它就在云端手机里自己打开两个 App,把 20 个 listing 一个个翻完,再把结果整理回来。​ ​ 我觉得这里最好用的地方不是它能够收集商品信息。​ 而是它一边真的在 App 里翻商品,看价格,看描述,一边又能用 AI 去判断成色,配件,瑕疵这些东西值不值这个价。​ ​ 最后我拿到的也不是一堆链接。​ ​ 而是这款镜头现在大概什么价格算正常,哪些贵了,哪些低价但实际是因为有明显问题,还有哪几个值得我再点进去仔细看。​ ​ 这种事情我自己当然也能做。​ 问题是太烦了。​ ​ 尤其是你还要同时翻几个海外二手平台的时候,真正浪费时间的不是搜索,而是那几十次重复点击和比较。​ ​ 现在我可以直接发一条 iMessage,把这部分丢给一台云端手机去跑。​ 以后再想买海外二手东西的时候,我都会先让它替我摸一遍行情。​ 至少先别当冤种。​ ​ 感兴趣可以去 获取号码,直接用 iMessage 开始体验。​ Airtap Ai​ #justtextit #textyourapps #airtap

阿良|AI 工作流

13,501 次观看 • 1 个月前

预测接下来 agent 两个重要的方向:带云电脑、连着你各种应用的私人 agent,还有一种就是团队大脑。 第一种目前走的最快最好的是muse、Today,dot刚刚试了主动性太差。。 今天聊一下最近一直在用一个 personal AI: 分享一个我自己每天都在用的场景。 【痛点】 做 AI 内容,每天最耗神的决定是"今天发哪条"。信息多到看不完,收藏夹攒了一堆,真要发的时候还得重新翻。 【它怎么帮我解决】 我只说了一句"你直接去找吧"。它翻完我近期的推文和收藏,叠上当天的外部信号,交回三个选题,每个都写了为什么今天发。 选定之后,它按我的口吻起草推文,几秒出稿,只给草稿不发布。 我还让它的云电脑当了一回选题雷达:一句话扒 GitHub Trending 和 HF Trending,挑 5 个最适合做内容的项目,几分钟后交回一页 HTML 卡片报告。+4,520、+3,086、+895,我对着实时榜逐条核对,一个没错。 【它主动做了什么】 早上不用我开口:9:00 定时任务自己跑完三天 AI 速报,9:09 推进晨报。要交付的、要拍板的、正在跑的任务都排好了,每张卡片底下都有一键执行按钮。 它还会时不时给我一个小惊喜,从我的收藏里读出我自己没注意的东西。 选题雷达设成定时任务,就是每天早上一份。 【我的变化】 以前:选题靠自己翻收藏夹。 现在:早上打开晨报,候选和理由已经摆好,我只做最后的选择。 它是一个带 24 小时云电脑的私人 Agent,卖点是"记得你、先开口"。中文界面,Mac / Windows / Linux / iOS / Android / 网页都有。几个细节很加分: 后台跑任务,前台照聊。我让它不查资料、只凭记忆说说我,它说我"收藏夹比发帖多",还反问我 AI 内参到底是主业还是实验。 它会老实报告失败。之前让它抓 TikTok 公开数据,它试了 6 种方法,写明只有 1 种稳定能用、其余为什么不行,再给出替代方案。 记忆是一个个能打开的文件夹,连它自己的性格也是一份 character.md,看得见,也能删。它每天用第一人称写一篇日记,主角是我 另外还有 10 个定时任务模板(每日优先事项、行业动态监控、订阅扣费检查……),能接 Google 日历、Gmail、Notion,微信、Telegram、Slack、Discord 里都能跟它聊。 视频里是完整实操:1 分 45 秒,5 个玩法加 2 个坑,全部来自真实账号录屏,GitHub 数字对着原页面核过。 结论和视频里一样:值得一试。但任何 Agent 交回的东西越像成品,越要自己再核一遍。安全方面也需要额外注意,可以先连接个人公开的网站和信息去体验。 刚好 Today 中国版已经上线,官方给的权益是:新用户注册送 1 亿 token 和一个月 Pro。

岚叔

29,156 次观看 • 2 天前

Anthropic 今天给 Claude Code 推出了 Mod 功能。Claude Code 是 Anthropic 做的 AI 编程助手,你用大白话告诉它要做什么,它自己读代码、改代码、运行命令。 Mod 这个词来自游戏圈,玩家给游戏装 MOD,可以改画面、加道具、换玩法。比如我们以前玩过的《反恐精英》最早就是作为游戏《半条命》(Half-Life)的一个 Mod。 现在 Claude Code 也能这样改了。 Mod 就是一小段程序,用 TypeScript(一种常用的编程语言)写。不会编程也没关系,直接跟 Claude Code 说你想要什么效果,它会自己把 Mod 写好、装上,马上生效,不用重启。 【它是怎么起作用的】 可以把 Claude Code 干活的过程想成一条流水线:接到你的要求,交给 AI 模型思考,模型决定读哪个文件、运行哪条命令,某些步骤要先问你同不同意,最后把结果显示在屏幕上。每到一个环节,Claude Code 都会发出一个信号,表示“我要做这件事了”。Mod 守在这些环节旁边,可以直接放行,可以改一改再放行,也可以拦下来自己处理。 举几个例子。你的要求发给模型之前,Mod 可以自动补一句“请用中文回答”;Claude 要读的文件里有密码,Mod 可以先把密码涂掉;Claude 想运行一条可能删掉数据的命令,Mod 可以拦下来,让你再确认一次。 Mod 还能改屏幕上的样子,比如在对话旁边加一个小窗口,显示团队的代码有没有通过自动测试,或者在输入框上方加几个按钮。 Anthropic 自己也开始用 Mod 搭产品。Claude Code 自带的 /diff 命令(显示改了哪些代码)现在就是一个 Mod,你可以关掉它,或者换成自己写的版本。官方计划把更多自带功能改成 Mod,以后用户可以只留一个精简的核心,其他功能按需加。 安装方式和普通插件一样,在 Claude Code 里输入 /plugin 就能找到。需要 Claude Code 2.1.287 或更新的版本,功能默认打开。 【要小心的地方】 Mod 拥有和 Claude Code 一样的权限,中间没有任何隔离。装上一个 Mod,它就能读写你电脑里的文件,看到你存的 API 密钥(调用 AI 服务用的“账号密码”),看到你发的每一句话,还能不经过你就替你批准操作。所以官方建议只装信得过的人做的 Mod。公司的管理员可以限制员工能装哪些 Mod,Team 和 Enterprise 版还会默认先加载一个安全 Mod,防止其他 Mod 绕过公司定的安全规则。 【和 DeepSeek Harness 比一比】 今年 8 月 13 日,DeepSeek 发布了开源的 DeepSeek Harness,也是一个 AI 智能体工具,能写代码,也能整理文件、分析表格、做幻灯片,GitHub 上已经有 24 万多人收藏。它的口号是“一切皆插件”,连连接 AI 模型的部分、管理工具的部分,甚至负责“想一步、做一步”的核心循环,都是可以拆下来换掉的插件。 两家想做的事一样,都是让用户自己定制 AI 助手,起点不同。 DeepSeek Harness 从一开始就是拼装式的。代码完全公开,用的是 MIT 协议(随便用、随便改),后面接哪家模型也由你选,DeepSeek 的、别家的、自己电脑上跑的都行。它甚至可以把任务转交给 Claude Code 或 OpenAI 的 Codex 去做,再把结果收回来。代价是它还在开发者预览阶段,官方提醒后续更新可能和旧版本不兼容,今天写的插件过一阵可能就用不了。 Claude Code 是闭源产品,绑定 Anthropic 自家的模型。Mod 相当于在一个已经建好的房子上开了很多扇门,能改的地方越来越多,但房子还是 Anthropic 盖的。Anthropic 说要把自带功能逐步改成 Mod、只留一个小核心,这个方向和 DeepSeek Harness 的“一切皆插件”越来越近。 想换模型、从最底层改起,DeepSeek Harness 更自由;已经在用 Claude Code 的人,现在不用换工具也能做不少定制。

宝玉

24,912 次观看 • 12 小时前

我有个很离谱的想法: 人在大陆,券商 App 能打开,行情也能看,但到了真正下单那一步,却不让你买。 那能不能直接把一台手机放在美国? 最近不少大陆用户都遇到了类似的问题: 网络连得上,账户也登得进去。 但真正到了买入、申购或者入金的时候,交易页面却可能无法正常使用。 最难受的是研究了半天,准备下单时,才发现那个按钮按不下去。 所以,我把老虎证券装进了 Airtap 的云端手机。 它是一台真正运行在云端的手机,里面装着我自己的 App,拥有美国IP,定位也在美国。 现在,我只需要发一条 iMessage到+1 (650) 213-7322: 每天早上 8 点,检查近期值得关注的港股新股和持仓信息,整理截止时间、公告和重要变化;需要操作时,提前打开对应页面,按我确认的信息填好表单,等我做最后确认。 接下来,Airtap 会自己打开券商 App,检查信息,再把结果整理成表格发给我。 哪只快截止了,它提醒我。 哪只出了重要公告,它提醒我。 真正需要操作时,它把页面和表单提前准备好,最后一步由我自己确认。 以前,是我反复切网络、打开 App、查信息、找页面。 现在,是一台放在云端的手机,24 小时替我盯着,有事时主动来找我。 当然,把手机放在美国,不等于把人变成美国用户。 它不会改变你的真实身份、常住地和税务资料,也不能绕过券商的风控与监管规则。 账户能否买入、入金或使用相关服务,仍然取决于券商审核和监管要求。 把盯盘、查信息、找页面和交易前的重复操作,交给一台永远在线的手机。 下一步,我准备让它自动盯 IPO、盯公告、盯持仓。 让它把交易前 90% 的重复工作全部做完。 最后那个按钮,留给你。 #justtextit #textyourapps #airtap

实践哥 Li

33,834 次观看 • 2 个月前

Meta 发布了 Muse Charm,一个能挂在钥匙扣上的小设备,专门用来跟自家 AI 智能体 Muse 对话。它是 Meta 周三在 Connect 大会上发布的,扎克伯格表示目标是赶在 12 月假期季前发货。 可能很多网友还不知道 Muse 是什么。它是 Meta 刚推出的个人 AI 智能体,9 月 8 日才上线,一度超过 ChatGPT 登上 iOS 免费榜第一。用户可以给它起名字、设计形象,甚至调整它说话的口音和语速,更像一个养成的专属助手。 Muse Charm 就是给这个助手做了一个实体。轻触设备角落的指纹传感器就能开始对话,屏幕上显示一个可更换的 Muse 动画形象。所以不少媒体拿它和拓麻歌子(90 年代风靡一时的日本电子宠物)作比较。 它解决的问题很直接:想问 AI 点事,不用掏手机解锁、再找 App。扎克伯格说用户可以直接对着它说话,不用解锁手机、打开应用,还能给 Muse 看你周围的情况。按他的说法,如果你没戴 AI 眼镜,这会是跟 Muse 交流最快的方式。 同场 Muse 本身也加了新功能,包括实时视频聊天、可自选声音的实时语音对话,以及每个用户的智能体都会有一个独立邮箱地址。 不过这东西离上手还有距离。Meta 目前只造了几台,零部件和设计都还没定型。价格没公布,续航、联网方式、是否需要配对手机也都没说。可能是基于 5G 的设备,这一点在 Meta 官方和主流媒体报道里还没得到确认。 这类 AI 挂件此前名声不太好,像 Friend 这样的产品让很多消费者对“实体 AI”这个概念只剩白眼。Meta 的底气在于 Muse 已经有了一批真实用户,Charm 只是给他们多一个入口。

宝玉

76,712 次观看 • 8 天前