Video wird geladen...

Video konnte nicht geladen werden

Zur Startseite

最近 Muse 很火,我也在想:有没有可能,让我们已经在用的任意的AI,也拥有像 Muse 一样操作电脑的能力? 因此我周末捣鼓了开源一个skill。一句话来讲,使用它可以让任何AI 接到电脑上的 Computer Use,让它能看屏幕、点按钮、输入文字,直接操作 App 顺着这个方向,可以尝试的事情就很多了:找餐馆、查机票、购物比价,或者整理社交媒体素材。以前需要自己在几个 App 之间来回切换,现在可以试着用一句话把任务交给你已经订阅了的AI。(Kimi, 豆包 Gemini, Codex, Claude 等等) 开源链接 使用方式 把这个 GitHub 链接直接给到 AI,让它帮忙安装 在 demo 里,我演示了如何安装,并以 Claude Code 为例,操作我的浏览器,帮我给餐馆定位 我更感兴趣的是背后的成本空间。 这个 skill 复用了本机已安装的 ChatGPT/Codex Computer Use 组件,由你选择的模型理解任务、决定下一步怎么做。项目脚本本身不调用 OpenAI 推理 API,因此,不会消耗 OpenAI 的 Token,但前提是你要安装了 Codex 我自己也更愿意让操作发生在自己的电脑上,继续用自己的 App 和登录状态。此外所有的支付信息、付款记录全部留在本地,解决合规、隐私的顾虑 先开源出来,给大家玩玩。我很想看看,当更多...

16,262 Aufrufe • vor 5 Tagen •via X (Twitter)

12 Kommentare

Profilbild von 美研芒格君
美研芒格君vor 5 Tagen

这件事情对于我日常投资研究有两个重要意义 1. 研究一家公司的时候. 我的不同类的数据,例如研报、本地的 PDF、各种网页、数据源,终于可以 All in one 地让 AI 在我电脑上操作了 2. OpenAI Computer Use 好用,但就是太贵了。这个彻底解决了我 Token 不够,但是又需要操作电脑的问题

Profilbild von Mr Ren
Mr Renvor 5 Tagen

这skill有意思,等于给AI配了双手。Muse玩Computer Use是本行,邀请码6ODVRG,免费额度先白嫖再说

Profilbild von 太阳
太阳vor 5 Tagen

这思路太对了,把 Computer Use 从专属能力变成通用外挂。开源等于直接把成本打下来,Muse 那种烧法小团队真玩不起,蹲一个实测看看 token 烧多少

Profilbild von 晚晚
晚晚vor 5 Tagen

这不就把 Computer Use 从专属能力变成通用外挂了嘛

Profilbild von yuqing--雨晴
yuqing--雨晴vor 5 Tagen

把任意AI接上电脑操作这条路,skill比换模型更容易让人上头,周末效率直接长脚了😋

Profilbild von Achilles Newman
Achilles Newmanvor 4 Tagen

想到一块去了,不过我是用浏览器插件来让Muse操作本地电脑。😎

Profilbild von Erma
Ermavor 4 Tagen

我也做了类似的事情:我用自己长期开机的macbook挂pi,通过cua mcp来控制电脑,远程就用paseo来控制,也有差不多的体验,当然还是需要再整合一些自动化的功能才更好。

Profilbild von JOJO
JOJOvor 5 Tagen

README 要求先在 ChatGPT/Codex 里打开 Computer Use,并实际用过一次把系统授权走完,再让 AI 读 SKILL.md 安装。文案还写着保留正常授权提示,限定 macOS,而且是非官方项目

Profilbild von Crio Songo
Crio Songovor 4 Tagen

这个想法挺有意思的,相当于给现有AI做了个操作层扩展,回头我去试试看效果怎么样。

Profilbild von Jokie Ke
Jokie Kevor 5 Tagen

最想先試的是比對兩版簡報:把改掉的數字、移走的段落連同頁碼列出來。這種工作看起來不炫,但如果能少掉來回切視窗、反覆確認同一頁的時間,會很想留下來用。

Profilbild von sdxedg123
sdxedg123vor 5 Tagen

Follow you, and thanks you sharing your contrition

Profilbild von 风中浪客
风中浪客vor 5 Tagen

这个方向可以,但先别给 root,不然它第一件事就是帮你点 approve。

Ähnliche Videos

试了一下 OpenAI 新出的 Codex App,有些亮点 跟 Skills 的适配还是有点问题,模型的主要问题就是慢 OpenAI 给 Pro 和 Plus 用户的 Codex 额度在未来两个月内全部翻倍了 👇看一下详细的能力介绍: Skills 可视化管理 有一个专门的 Skills 列表界面,预置了一些官方 skills,也可以扫描你已经安装的 skills。注意这里只能扫描 NPX 安装的,本地创建的(比如在 Claude Code 里创建的)扫不出来。 还支持 Skills Creator 创建的 skills,可以直接在 APP 里用它去创建新 skills。 ------ 定时任务功能,这个挺实用的。 可以让 AI 定期执行某些任务,比如每周给你一个解决问题的报告,定期去解决某个项目的 PR 问题,或者定期 review 代码。 对于需要持续维护的项目来说,这个功能还是挺有价值的。 ------ Codex APP 现在支持计划模式了。 因为它跟 Codex CLI 共享后端,所以现在 Codex CLI 也同步支持计划模式了。这意味着 AI 会先规划任务步骤,让你确认后再执行。 ------ 用量显示的样式做得挺好的。 进度条、余量、使用情况都很清楚,一眼就能看到你还有多少额度。 还有 code review 的快捷方式,可以快速调用你的 skills。MCP 的添加也支持。 ====== 实测:用 video-wrapper skill 跑了一遍 我测试主要是让它跑了一个我最近做的 skill,可以一键给视频添加视频包装,比如卡片、花字、人物条、章节标题这些。 这个 skill 挺复杂的,所以很适合用来测试。 ------ 第一次运行的问题 可以工作,但第一次它选了 PIL 这个方案,比较差。 核心问题是什么?它跟你没有交互。 我的 skill 里边写清楚了:要先问用户要哪套方案,再给出包装方案让用户确认,用户确认了再开始包装。 但在 Codex 这里,明显没有交互。它就直接跑,把所有决定都自己做了,跑完就完了。出错了也不管,直接用降级方案。 ------ 修复后的效果 我让它修复以后,它倒是能修复。重新跑了一遍,效果也不错。 最终生成的视频包装效果还行: ▸ 左下角有人物卡片 ▸ 有花字 ▸ 有各种卡片和章节标题 ▸ 结论卡片也加上了 因为我们用前端代码约束了样式,所以它在样式上不会出什么错误。 ------ 体验总结 整个过程很不可控: ▸ 速度很慢 - Codex 本身速度就慢 ▸ 交互明显不够 - 你根本不知道进到哪个阶段了,也不知道它的方案是什么 ▸ 只管执行 - AI 一直在执行,不会停下来问你 可能是它不太适应 skills 规范,只是简单做了一下适配,没有 Claude Code 跟 skills 的适配那么好。

歸藏(guizang.ai)

30,595 Aufrufe • vor 8 Monaten

Anthropic 今天给 Claude Code 推出了 Mod 功能。Claude Code 是 Anthropic 做的 AI 编程助手,你用大白话告诉它要做什么,它自己读代码、改代码、运行命令。 Mod 这个词来自游戏圈,玩家给游戏装 MOD,可以改画面、加道具、换玩法。比如我们以前玩过的《反恐精英》最早就是作为游戏《半条命》(Half-Life)的一个 Mod。 现在 Claude Code 也能这样改了。 Mod 就是一小段程序,用 TypeScript(一种常用的编程语言)写。不会编程也没关系,直接跟 Claude Code 说你想要什么效果,它会自己把 Mod 写好、装上,马上生效,不用重启。 【它是怎么起作用的】 可以把 Claude Code 干活的过程想成一条流水线:接到你的要求,交给 AI 模型思考,模型决定读哪个文件、运行哪条命令,某些步骤要先问你同不同意,最后把结果显示在屏幕上。每到一个环节,Claude Code 都会发出一个信号,表示“我要做这件事了”。Mod 守在这些环节旁边,可以直接放行,可以改一改再放行,也可以拦下来自己处理。 举几个例子。你的要求发给模型之前,Mod 可以自动补一句“请用中文回答”;Claude 要读的文件里有密码,Mod 可以先把密码涂掉;Claude 想运行一条可能删掉数据的命令,Mod 可以拦下来,让你再确认一次。 Mod 还能改屏幕上的样子,比如在对话旁边加一个小窗口,显示团队的代码有没有通过自动测试,或者在输入框上方加几个按钮。 Anthropic 自己也开始用 Mod 搭产品。Claude Code 自带的 /diff 命令(显示改了哪些代码)现在就是一个 Mod,你可以关掉它,或者换成自己写的版本。官方计划把更多自带功能改成 Mod,以后用户可以只留一个精简的核心,其他功能按需加。 安装方式和普通插件一样,在 Claude Code 里输入 /plugin 就能找到。需要 Claude Code 2.1.287 或更新的版本,功能默认打开。 【要小心的地方】 Mod 拥有和 Claude Code 一样的权限,中间没有任何隔离。装上一个 Mod,它就能读写你电脑里的文件,看到你存的 API 密钥(调用 AI 服务用的“账号密码”),看到你发的每一句话,还能不经过你就替你批准操作。所以官方建议只装信得过的人做的 Mod。公司的管理员可以限制员工能装哪些 Mod,Team 和 Enterprise 版还会默认先加载一个安全 Mod,防止其他 Mod 绕过公司定的安全规则。 【和 DeepSeek Harness 比一比】 今年 8 月 13 日,DeepSeek 发布了开源的 DeepSeek Harness,也是一个 AI 智能体工具,能写代码,也能整理文件、分析表格、做幻灯片,GitHub 上已经有 24 万多人收藏。它的口号是“一切皆插件”,连连接 AI 模型的部分、管理工具的部分,甚至负责“想一步、做一步”的核心循环,都是可以拆下来换掉的插件。 两家想做的事一样,都是让用户自己定制 AI 助手,起点不同。 DeepSeek Harness 从一开始就是拼装式的。代码完全公开,用的是 MIT 协议(随便用、随便改),后面接哪家模型也由你选,DeepSeek 的、别家的、自己电脑上跑的都行。它甚至可以把任务转交给 Claude Code 或 OpenAI 的 Codex 去做,再把结果收回来。代价是它还在开发者预览阶段,官方提醒后续更新可能和旧版本不兼容,今天写的插件过一阵可能就用不了。 Claude Code 是闭源产品,绑定 Anthropic 自家的模型。Mod 相当于在一个已经建好的房子上开了很多扇门,能改的地方越来越多,但房子还是 Anthropic 盖的。Anthropic 说要把自带功能逐步改成 Mod、只留一个小核心,这个方向和 DeepSeek Harness 的“一切皆插件”越来越近。 想换模型、从最底层改起,DeepSeek Harness 更自由;已经在用 Claude Code 的人,现在不用换工具也能做不少定制。

宝玉

41,132 Aufrufe • vor 7 Tagen

我想很多人都有这个困扰:之前经常需要在Codex和Claude Code之间来回切换,现在又加上了最近爆火的DeepSeek Harness。 但是每次来回切换、或者想尝尝DSH的鲜的时候,我都得把背景重新讲一遍,确实挺烦的~ 最近在GitHub上发现的一个开源项目 memmy-agent,把 Codex、DeepSeek Harness、Claude Code接了进去,直接解决了困扰我很久的跨Agent 记忆的问题。 我用它做的事情很简单:把分散在不同 Agent 里的历史,沉淀到同一份个人上下文里,默认 Local-first,让它们都能调用。 我把它分别接入 Codex、DeepSeek Harness、Claude Code 之后,我做了一个信号中继站小游戏。 我先在Codex 写完基础玩法,然后对话里说一句话: 第一次失败时,给玩家一次翻盘机会,别直接结束游戏。 但这句话我故意不写入代码、README 或者是本地记忆文件。 然后新开 DeepSeek Harness,它从 Memmy 直接读出了这条决定,非常丝滑。 再新开 Claude Code,它读代码前先复述了规则,再按这个方向把后续功能补完。 代码只能告诉下一个 Agent 项目做到哪,但那些留在对话里的决策,才影响着项目接下来往哪走。 以后,Agent 要记住的,不只是代码,还有你前面已经决定的决策和经验。 Memmy 不仅帮我解决了Agent记忆的问题,还让这些经验不再独属于某一个 Agent,而是只属于你。 Switch agents, not context。 Memmy 支持桌面端、CLI、API、MCP 和 Skills多种方式,可以直接接着执行任务。 如果你也经常在多个 Agent 之间切换,可以拿自己的项目试一下。 项目GitHub:

木马人

63,371 Aufrufe • vor 1 Monat

我用掉 100 亿 Token 后,最大的变化不是更会写 Prompt。 而是 Codex 已经从一个聊天框,慢慢变成了我的: - 自我认识系统 - 工作系统 - 信息系统 - 学习系统 - 甚至是桌面陪伴系统 我把自己最常用的 20 个技巧整理出来了。 如果你也想把 AI 从“偶尔问一句”变成真正能长期协作的伙伴,建议先收藏。 一、让 Codex 逐渐认识你 1. 每天让它问你一个问题 我设了一个自动化:每天问我一个能帮助它更了解我、也帮助我认识自己的问题。它会避开已经问过的话题,围绕一个主题慢慢聊。 2. 把对话当成自我观察 现在可以直接语音聊。长期积累下来,它能看到我的情绪、偏好、反复出现的困扰和思考方式。 3. 让它把“它眼中的你”画出来 把你们的对话和一张漫画参考图交给它,让它生成多格漫画。你会发现:很多时候我们要的不是答案,而是被理解。 二、把 Codex 变成工作系统 4. 每周做一次 Codex 使用复盘 让它回顾这周我怎么使用它、哪些沟通方式有效、哪些任务返工了、哪些项目该继续推进。 5. 把失败经验写进“第二大脑” 不只是存笔记。把失败原因、偏好、最近关注点沉淀下来,让以后不同 Agent 都能调用同一份上下文。 6. 创意任务先开 Plan Mode 创意型工作最容易“没想清楚就批量执行,最后返工”。先用计划模式讨论目标、方案、数据体系和风险,再开始做。 7. 把 Codex 当思考顾问,而不是执行员 你甚至不需要有明确答案。只要说“我想做什么”,让它帮你一起把模糊的想法拆成可执行路径。 8. 需求清楚后切到 Goal Mode 需求确认后,把结果设成目标,让它自己持续推进。我的任务最长跑过 10 小时 44 分钟。 9. 用自动化处理重复但重要的事 日报、周报、账号监控、邮箱监控、回复策略、内容归档、同步到个人网站——这些都适合交给自动化。 10. 明确任务就开多 Agent 对于翻译、多语言网站、图片生成、资料整理这类边界清晰的工作,让多个 Agent 分工并行,比一个人盯着快得多。 三、让 Codex 跨出聊天框 11. 用 Sites 一键分享作品 做好网站后,不要卡在“怎么部署”。Sites 可以直接把成品变成能分享的站点。 12. 把插件当成能力扩展包 Computer Use、数据分析、Investment Banking、GitHub、Outlook / Gmail……很多工作不是“AI 会不会”,而是你有没有给它接上正确的能力。 13. 把生图能力接进日常工作 我已经用它生成了 300 多张图。做内容、配图、产品原型和视觉探索,速度会完全不一样。 14. 接入飞书,让手机也能操控 Codex 真正高频的协作不该只发生在电脑前。把它接到飞书后,我在手机上也能下任务、收结果、继续对话。 15. 用 ChatCut 把剪视频变成工作流 不是只让 AI 帮忙剪一刀,而是把素材整理、脚本、配图、剪辑一起接进创作链路。 四、建立自己的信息雷达 16. 每天订阅 Builder 信息 我会用 Follow Builders Skill 定时追踪 Builder 的新想法、新产品和讨论,再把重要信息推送给自己。 17. 做一个“灵感箱” 任何一闪而过的想法都丢进去。后面让 AI 自动搜索、补充背景、分类、处理,而不是靠脑子记住。 18. 盯住 GitHub 和 Product Hunt 让 Agent 帮你筛新项目、周榜、日榜和真正值得试的工具。看见感兴趣的,直接让它安装或进一步研究。 五、把输入变成你的输出 19. 把任何学习材料做成 HTML 学习页 看到一场好访谈、一个视频、一篇文章:让 AI 拉取内容、生成中文文字稿,边看边记评论,最后再变成摘要或短视频。 20. 给 Codex 一个“实体感”:做成桌宠 我很喜欢 Hatch Pet。它会根据状态跑动、办公、提示待办,甚至在你切换文件夹和工作区时给建议。AI 不一定要冷冰冰地躲在聊天框里。 100 亿 Token 给我最大的启发是: 不要把 AI 只当作“问答工具”或“临时外包”。 当它拥有你的上下文、目标、工作流和反馈后,它会越来越像一个能长期协作的系统。 换电脑时,我第一个装的软件就是 Codex。 写文档、做网站、剪视频、找资料、整理灵感……它已经覆盖了我工作和生活里非常大的一部分。 你最想让我把上面哪一条展开成教程? 评论区告诉我,我下一条就拆! #codex #chatgpt @thsottaux

Vivi Xiao

106,007 Aufrufe • vor 2 Monaten

30秒的视频—感受一下能接入微信的Personal AI! 目前MUSE 对中文区用户来说,使用环境还是有门槛的,更别说不会翻墙的朋友了。后来我找到一个国内可以直接用的 Personal AI——Today 我不会轻易下结论,除非我深度体验过,于是我做了个测试: Today能不能作为一个真正了解我的 AI 私人教练? 我把自己的身体情况、训练习惯、饮食、睡眠、作息和健身目标基本都告诉它了。 最爽的一点就是:这些东西不用每天重新解释 比如今天我只说一句: “我今天状态只有8.5分,帮我制定一个合适的训练计划。” 它已经知道我最近练过什么、训练水平怎么样、目标是什么,会直接接着以前的记忆给我调整训练和饮食 所以他给了我一个非常合理的训练计划! 我已经用Today记录了我好几天的训练情况了,让我比较惊喜的一点是是它的主动性 他会主动给我发信息提醒我今天要去健身了!要吃点什么,训练怎么安排.... 如果你用普通大模型基本都是: 我想到问题 → 我去问 → AI 回答 Today 更像: 它一直认识我 → 记得我最近在干什么 → 到了该做事的时候主动来找我 所以现在它会主动提醒我训练、问我今天有没有完成、睡眠和饮食怎么样,状态变了再继续调整计划 甚至我已经把它接到微信的ClawBot 上,直接在微信对话,太方便了 相比 MUSE 这类海外 Personal AI 对国内用户还有一些使用门槛,Today Today AI 本身就是中国团队做、国内直接可用的产品 底层也不是简单绑死某一个模型,目前用的是Claude的顶级模型,还有一套持续优化的 Frontier Models + 长期记忆 + Agent 执行能力 健身只是我拿它测试的第一个案例!中国版现在基础版可以免费用,新用户注册还有 1 亿 Token + 1 个月 Pro 权益,强烈建议大家试试!

梭哈.AI

31,986 Aufrufe • vor 11 Tagen

来自 Claude Code 团队成员 Thariq 分享的用好 Fable 5模型的秘诀。 以下内容整理自 Thariq 的视频: 过去,我们需要时刻检查 Claude 是否在正确地做事。比如,把任务拆分成小块交给它、反复检查它的输出,并在它过早停下时发现问题。但有了 Claude Fable 5,我反而发现自己越来越多地是在检查 Claude 是否在做正确的工作。 Fable 可以一次运行几个小时,它会测试自己的工作,老实说,我经常发现它写出的代码比我的还要好。我的工作变得越来越侧重于指引方向和前期设置,而不是监督。因此,以下是我在使用 Fable 时,工作方式发生的三个改变。 首先,我把 Claude 当作一个思维伙伴。我给它提供所需的上下文。其次,我给 Claude 设定目标并提供验证这些目标的方法。最后,我试着变得更有野心,让 Claude 去做我以前从未尝试过的事情。 第一点,你要越来越多地把 Claude 视为一个思维伙伴。 我在使用 Fable 时发现的一个失败模式是,我可能实际上并不知道自己想要什么,或者我可能不知道什么是可行的。但是,在我的思考过程中尽早让 Claude 参与进来,我就可以在实施之前发现这些问题。 举个例子,我会先从一个小的需求规范(spec)开始,在编写最终的规范文件之前,我会要求 Claude 就实施方案对我进行“面试提问”。这有助于我建立信心,确信自己知道想要什么。或者,我也可能抛出一个想法,让它想出几个可以发展的方向,并制作一些 HTML 页面原型供我审查。 当我准备好进行实施时,我会尽量给它提供上下文,而不仅仅是约束条件,这样 Claude 就能真正帮助我达成目标。 例如,我不会说“保持简单,不要过度设计”,而是会说:“嘿,这个功能是个实验。我们很有可能在一个月后删掉它。所以不要构建任何丢弃起来会很心疼的东西。”给它这样的上下文,能让它发现你可能都没想到的事情。 一旦你知道自己想要什么了,特别是面对一个雄心勃勃的难题时,考虑给 Claude 设定目标以及验证目标的方法。 为此,我们推出了两个很好用的新功能,我也鼓励大家试一试:/goal(目标指令)和 workflows(工作流)。目标功能帮助 Claude 持续工作直至完成,而工作流则帮助 Claude 验证其工作。 因此,在我写完规范文档后,我可能会告诉 Claude:“设定一个目标,以完整实现该规范。然后使用工作流来验证计划的每个部分,并准备一份报告,说明已实现了哪些内容以及是否有任何差异。”这让 Claude 能够尽可能以富有创意和周到的方式发挥其能力,同时又能确保它正在构建你想要的东西。 最后,试着更有野心一些。 Fable 真的是一个令人难以置信的模型,它促使我在工作中打破常规去思考。例如,我正在用 Fable 剪辑这个视频。如果有什么事情是你以为大语言模型做不到的,给它个机会试试。我们由衷地认为,Fable 提高了“一切皆有可能”的上限。

宝玉

144,174 Aufrufe • vor 3 Monaten

小扎吐槽苹果和 Google,以及谈为什么开源 AI **Mark Zuckerberg**: 我认为移动生态系统中普遍存在的一个问题是有两个把持入口的公司,Apple 和 Google,它们可以告诉你可以构建什么。 在我们的历史中有很多次,比如有经济层面的情况,就是我们构建了些东西,然后它们就会拿走我们大部分的收入,但还有一种是质量层面,这实际上让我更加不满,也就是有很多次我们推出或希望推出某些功能,然后Apple就会说,不,你不能推出这功能。 这真的很糟糕。 问题是,这样的世界是否会在AI领域复现,就像你会有一小部分拥有封闭模型的公司,它们控制API,因此将能够告诉你可以构建什么。 我可以说,对我们来说,自己构建一个模型以避免处于那种位置是值得的。 我不希望那些其他公司告诉我们可以构建什么,而且我认为从开源的角度来看,很多开发人员也不希望那些公司告诉他们可以构建什么。这就是我坚定支持开源的原因之一,我认为未来AI的集中化可能像其广泛传播一样具有潜在危险。 我发现很多人都在思考,如果我们能实现这种技术,那么让它广泛传播是否不利。 我认为另一种可能也很糟糕的情况是,如果一个机构掌握了一种强大的AI远超其他所有人的,这同样是非常糟糕的。在我看来,一个理想的世界应该是这样的:AI技术被广泛而均衡地应用,随着时间推移逐步增强其健康性。在这样的世界里,各种系统能够相互制衡,这种平衡的状态比一个高度集中化的世界要健康得多。 虽然风险无处不在,但我觉得有一个风险我想人们我并没有听到太多人提及。 **Dwarkesh Patel**:举例来说,一个价值100亿美元的模型,如果经过评估是完全安全的,你们会选择开源吗? **Mark Zuckerberg**:我的答案是,只要这个模型对我们有所帮助,那我们就会开源。 **Dwarkesh Patel**: 那如果这个模型是用100亿美元的研发经费研发出来的,然后现在要开源呢? **Mark Zuckerberg**: 我们一直以来都有开源软件的传统,但是我们并不会开源我们的产品。 比如说,我们并不会将Instagram的代码开源,但我们会开源许多底层的基础设施。我们历史上最大的一个项目可能就是开放计算项目。在这个项目中,我们将我们所有的服务器的设计网络交换机和数据中心的设计开源了,这对我们来说非常有帮助。 因为很多人可以设计服务器,但现在,大家普遍都采用了我们的设计,这就意味着整个供应链都围绕我们的设计展开,规 模变大,对所有人来说都变得更便宜,为我们节省了数十亿美元。 这真是太棒了,对吧? 因此,我认为开源有多种方式可以对我们有所帮助。 一种就是,如果有人能够找出更便宜的运行模型的方法,我们将花费数十亿甚至上千亿美元,在所有这些模型上,所以如果我们能做的更有效率,那我们就可以节省数十亿甚至上百亿美元,这可能本身就非常有价值。 **Dwarkesh Patel**: 关于开源,我很想知道你是否认为像PyTorch、React、Open Compute这样的开源项目,对世界的影响是否已经超过了Meta在社交媒体方面的作用。 **Mark Zuckerberg**: 因为我曾经和使用这些服务的人交谈过,他们觉得这是有可能的,因为互联网的很大一部分都在运行这些项目。这是一个有趣的问题,我认为几乎有一半的世界人口都在使用我们的产品,这是一个真实的点,所以我觉得这很难超越。 但不管怎样,我还是认为开源是一种新的、非常強大的建设方式。 来源:

宝玉

74,721 Aufrufe • vor 2 Jahren

AI亿万富翁CEO表示,在脑机接口准备就绪之前,他不想生孩子。 他说:“我想等到我们弄清楚 Neuralink 或其他——它被称为脑机接口。所以大脑与其他方式与计算机互联,直到它们开始工作。 “因为有几个原因。首先,在你生命的前七年左右,你的大脑比任何其他时期都更具神经可塑性。所以如果你要获得这些其他技术,那些出生时就带有它们的孩子将以疯狂、疯狂的方式学习如何使用它们。就像它实际上会成为他们大脑的一部分,这种方式对一个成年人在大脑中植入 Neuralink 或其他东西来说永远不会是真的。人类只以一定的速度进化。人类会随着时间变得更聪明。只是这是在数百万年的时间尺度上,因为自然选择和进化真的很慢。所以如果你把这个向前推演,你必须有 AI 继续变得更聪明,继续改进——就像它们会真的很快继续改进。而且你知道,生物学只会以那么快的速度改进。我们在某个点上需要的是最终自己接入 AI 的能力。我认为我们将需要一些互联或连接,让我们的大脑直接连接到 AI、在互联网中,所有这些东西。” “而且它——它可能很危险,而且可能,你知道,正如你所说,可怕和吓人。但我们只是必须去做。就像 AI 将像这样发展,人类将以慢得多的速度改进。我们将需要接入那种能力。”

KK.aWSB

47,549 Aufrufe • vor 9 Monaten

🔥AI搬回本地! $NVDA 黃仁勋剛剛宣布重大突破, 个人电脑迎来全新时代! ———————————— 过去四十年,一直是你在伺候电脑。 这一次,它要反过来。 我们这代人,是被机器训练大的。记快捷键,清后台,等进度条,文件存在哪个文件夹自己得记牢,我们学会的全是“迁就它”,把自己一点点训练得像台机器,它才肯好好干活。 所以黄仁勋这次最重要的东西,很多人看漏了。不是又一个开源模型,也不是新芯片的跑分。是 AI 要从云端“搬回家”,住进你这台本机里。 这两年我们用的 AI,说穿了都是“租来的大脑”。你得先把家底打包上传:合同、工资条、还没写完的东西、和家人的聊天记录。它在别人的机房里跑,按别人的价收钱,入口攥在别人手里。聪明是真聪明,可它始终不是你的,你只是个访客。 而“本地 Agent”这四个字的意思是:这些东西,终于可以留在你自己屋里了。不用上传,不用排队,不用看网速的脸色。它能看你的文件、懂你开着的软件、替你把那些零碎活儿干完。第一次,电脑不再是你点一下它动一下的工具,而是一个会自己动手的人。 为了这件事,老黄把数据中心级的算力,上百 GB 的统一内存、接近一个 petaflop 的性能,硬塞进了一台摆得上书桌的小机器。不是为了让你在本地跑个玩具模型,是为了让你桌上这台电脑,真有本事自己干活。 往大了说,棋局其实很清楚:云端那颗大脑,继续在数据中心里想最难的事;你桌上这台,负责手脚,管你每天的柴米油盐。而老黄想要的,是大脑和手脚,两头都攥在自己手里。 但我更想讲的,是那种很具体的感觉。PC 是上一代互联网的入口,手机是移动时代的入口。下一个入口不在某个网站里,就在你书桌上那台开机的电脑里。谁先住进去,谁拿下下一个十年。 所以他这次真正想说的,从来不是“我们出了块更强的芯片”。 而是过去四十年,你把自己训练得越来越像一台电脑。 从今往后,是电脑,开始学着像你请来的那个人。

老白

16,673 Aufrufe • vor 3 Monaten