正在加载视频...

视频加载失败

把一个需求,同时扔给 Codex、Claude Code 和 Pi,会发生什么? Orca 会给每个 Agent 单独准备一份代码副本。三个 Agent 同时改,谁也盖不掉谁;跑完直接对比 diff,留下最好的一份。 网页哪里不对,直接点中元素,HTML、CSS 和截图会一起交给 Agent;人不在电脑前,也能用手机看进度、继续回复。 全平台支持,MIT 开源。

36,201 次观看 • 2 个月前 •via X (Twitter)

0 条评论

暂无评论

原始帖子的评论将显示在这里

相关视频

我想很多人都有这个困扰:之前经常需要在Codex和Claude Code之间来回切换,现在又加上了最近爆火的DeepSeek Harness。 但是每次来回切换、或者想尝尝DSH的鲜的时候,我都得把背景重新讲一遍,确实挺烦的~ 最近在GitHub上发现的一个开源项目 memmy-agent,把 Codex、DeepSeek Harness、Claude Code接了进去,直接解决了困扰我很久的跨Agent 记忆的问题。 我用它做的事情很简单:把分散在不同 Agent 里的历史,沉淀到同一份个人上下文里,默认 Local-first,让它们都能调用。 我把它分别接入 Codex、DeepSeek Harness、Claude Code 之后,我做了一个信号中继站小游戏。 我先在Codex 写完基础玩法,然后对话里说一句话: 第一次失败时,给玩家一次翻盘机会,别直接结束游戏。 但这句话我故意不写入代码、README 或者是本地记忆文件。 然后新开 DeepSeek Harness,它从 Memmy 直接读出了这条决定,非常丝滑。 再新开 Claude Code,它读代码前先复述了规则,再按这个方向把后续功能补完。 代码只能告诉下一个 Agent 项目做到哪,但那些留在对话里的决策,才影响着项目接下来往哪走。 以后,Agent 要记住的,不只是代码,还有你前面已经决定的决策和经验。 Memmy 不仅帮我解决了Agent记忆的问题,还让这些经验不再独属于某一个 Agent,而是只属于你。 Switch agents, not context。 Memmy 支持桌面端、CLI、API、MCP 和 Skills多种方式,可以直接接着执行任务。 如果你也经常在多个 Agent 之间切换,可以拿自己的项目试一下。 项目GitHub:

木马人

63,371 次观看 • 1 个月前

OpenAI刚刚开源的这个东西,感觉要把程序员的工作方式给整个改写了。 现在大家都在卷模型写代码有多强,但其实真正的瓶颈早就不是生成了。 一个人每天最多同时有效监督3-5个编码Agent,再多就会注意力崩溃,生产力直接归零。 有了Symphony,直接把这个上限干到了几十个。 它把你的Linear、GitHub Issues直接变成了永远在线的Agent调度器。 你开一个任务,它自动启动一个独立隔离的Codex Agent。 自己写代码,自己跑测试,自己做交叉Review,damn! 全部搞定之后,会给你提交一个完整的证据包。 CI全绿,安全和性能专项审查通过,改了UI就自动录好操作视频。 所有验证全过了,才会出现在你的Human Review队列里。 以后人类的角色可能会被彻底颠覆了。 以前你是监工,盯着Agent一步一步写代码,上下文切到吐。 现在你是老板,只需要看最终的结果。 满意就点合并,不满意就去仓库里补规则补文档补Guardrails。 记住兄弟们,永远不要手把手指挥Agent,永远不要替它干活。 这可不是啥实验室概念,OpenAI自己已经这么干了。 三个工程师,五个月,写了一百万行代码,0行人工写的。 产品已经有几百个内部用户,每天都在迭代。 我觉得他们最厉害的不是模型,是他们把整个仓库变成了Agent能看懂能自主工作的乐园。 现在很多人都搞错了Agent时代的核心竞争力。未来不是谁的模型更聪明,而是看谁能设计出让Agent可靠自主工作的环境。 我觉得未来最好的工程师,再也不是写代码最快的人,而是那些最会写规则,最会设计反馈回路,最会给Agent搭舞台的人。 现在Symphony已经开源了,它甚至不是一个成品。 是一个17k token的完整SPEC。 你把这个SPEC喂给任何一个编码Agent,十分钟就能生成你自己定制版的Symphony。 GitHub地址评论区自取👇

AYi

63,210 次观看 • 5 个月前

ChatGPT 桌面端(原来的 Codex App)今天加入了语音控制,macOS 和 Windows 用户可以直接用嘴指挥 AI 干活了。 具体来说,你可以一边跟 ChatGPT 说话,一边让它操控电脑、启动 Codex 写代码、调度 ChatGPT Work 执行任务,全程不用打字。开着一个语音对话,同时管理多个后台 Agent(智能体),有点像一个人坐在那里口述指令,几个助手分头干活。 这个功能基于 GPT-Live,OpenAI 在 7 月 8 日刚上线的新一代语音模型。GPT-Live 最大的变化是全双工架构,也就是它能同时听你说话和给你回话,不用像以前那样等你说完、停顿、它再开口。遇到复杂问题,它会把推理任务丢给后台的 GPT-5.5 处理,自己继续跟你聊,不会卡住。 macOS 用户多了一个叫 Appshots 的功能:语音对话时,ChatGPT 可以直接看到你当前最前面的窗口,了解你在做什么,回答就更贴合上下文。比如你正在看一段代码,直接说“这个函数有什么问题”,它能看到屏幕内容来回答。Windows 用户暂时没有这个能力。 此外,iPhone 用户可以通过远程配对的方式,用 iOS 上的 ChatGPT 语音来操控桌面端的 Codex。等于你拿着手机在沙发上就能指挥电脑写代码。Android 支持还在路上。 今天全球同步推出,面向 Plus、Pro、Business、Edu 和 Enterprise 用户。免费用户暂不可用。

宝玉

89,993 次观看 • 2 个月前

卧槽,Agent 可以直接操作你的安卓手机!📱 介绍一下:android-remote-control-mcp 像人一样操作任何安卓 App手机自己跑 MCP server → 不用 root,不用数据线,不用电脑跑 ADB 中转装一次,人在外面也能遥控家里那台手机读屏、点按钮、划屏幕、打字、开 App、拍照、读通知,57 个工具全给你。 立即开搞👇 我在模拟器上从零跑了一遍,读一整屏的 UI 树只有 4000 字符出头,一千个 token 左右,比那些 dump XML 的方案省太多。 下面是完整安装步骤,手机和模拟器两条路都写了。如果嫌麻烦其实可以用 Airtap 的云手机,直接发送短信,免安装,开箱即用。 我录了一段 Agent 实际操作 Android 手机的过程,一句话丢给 Agent,它自己在模拟器里读屏、找按钮、点下去。 一、手机直接装(最简单) 手机浏览器打开项目的 Releases 页,下载最新的 APK(当前 v1.11.1,包 169 MB) APK 有两个版本,按手机选:GMS 版给正常带 Google 服务的手机,不确定就选它;FOSS 版给去谷歌化的 ROM,不依赖 Google 服务。 点开下载好的 APK 安装,中途会问你要不要允许「未知来源」,允许 打开 App,Server 页顶部会有一条权限提示,进去把无障碍服务打开。这一项是必须的,读屏和点击全靠它,不开的话所有工具都会报错 Android 13 以上,用 APK 侧载安装的应用,无障碍开关是灰的,点不动。去「设置 → 应用 → Android Remote Control MCP」,右上角三个点,选「允许受限设置」,验证一下指纹或密码,再回来开就正常了。 相机、麦克风、定位、通知这几个是可选的,对应的工具用不上就不用给 回到 Server 页点 Start。页面上会显示 IP、端口和一串 token,这三个待会儿要给 Agent 二、模拟器装(没有安卓手机,或者不想拿自己手机试) 先在电脑上装一台安卓模拟器。装 Android Studio 是最省事的路,它自带模拟器和 adb,建一台 Pixel 7、Android 15 的机器就行。 模拟器起来之后,剩下的步骤和真机完全一样:把 APK 拖进模拟器窗口装上,打开 App 开无障碍,回 Server 页点 Start。 模拟器不用管「允许受限设置」那一步,无障碍开关直接就能点。 三、接进 Agent 这一步别自己查文档了,把仓库链接丢给 agent,让它自己配: 读一下这个仓库的 README,把它的 MCP server 配到我的 Agent 里,配完验证能连上。 它会自己去看 README、写配置、跑一遍连通性检查。你只要把 App 里 Server 页显示的那串 token 和地址给它。 地址给哪个,取决于你怎么连:手机和电脑在同一个 WiFi 下,就在 App 里把绑定地址改成 0.0.0.0,用它显示的局域网 IP;用模拟器就是本机地址;人不在家,在 App 里开 Remote Access 隧道,用它给的那个公网地址。 仓库里还自带一个 Claude Code 插件,作用是反过来的——把手机上的通知、WiFi、地理围栏这些事件推进你的 Agent 会话里。这个也一样,让 agent 顺手一起装了。

劳伦斯

72,608 次观看 • 1 个月前