正在加载视频...

视频加载失败

OpenAI 刚给 Codex 加了个录屏回放功能,有点意思。 你在 Codex 里做的那些操作流程——写代码、调 API、跑测试、部署上线——它全给你录下来,存成一个可复用的 "AI 技能"。 下次遇到类似的活儿,直接回放,不用重新来一遍。 说白了就是把你的人工操作变成了一段 AI 可以自己重复跑的自动化流程。

14,794 次观看 • 3 个月前 •via X (Twitter)

0 条评论

暂无评论

原始帖子的评论将显示在这里

相关视频

最近我用了 Grok Bot 一段时间,这是我最近最喜欢的 Agent 产品之一。 原因甚至不是 Grok 有多聪明。 是它真的有一台自己的电脑。 AI Agent 的最终形态,其实就是给 AI 发一台电脑。 xAI 给 Grok Bot 配了一台持续存在的云电脑,里面有浏览器、文件系统和终端。登录状态、文件、浏览器 Session 都会留下来,你把电脑关了,它也可以继续干活。 听起来只是一个产品功能,实际用起来,我觉得它把 Agent 的体验往前推了一大截。 比如我每天都要刷 X。 以前让我用 AI 帮忙看 X,工作流通常是这样的: 我刷到一条东西,复制给 AI;AI 觉得有意思,我再去找原帖;再开几个链接;再把资料复制回来;让它查证;最后再让它帮我写。 AI 干了很多活,但真正操作互联网的那个人一直是我。 Grok Bot 让我第一次很自然地把这部分也扔掉了。 我直接在它那台电脑上把 X 登录好,然后告诉它去刷我的 timeline,看看今天大家在讨论什么,发现有意思的东西就点进去,把原帖、引用、相关讨论都看一遍,再去外面查资料,最后觉得值得写的,帮我整理成帖子。 它就真的去操作浏览器了。 网页没有 API 没关系,没有 MCP 也没关系。只要人能打开网页、登录、点击,它就有机会自己完成。xAI 自己对 Grok Bot 的定义其实也很明确,它可以登录并使用网站和 App,用 computer use 处理那些没有干净 API 的软件。 这才是 Agent 真正重要的一步。 过去一年大家一直在给 Agent 加工具,Search、Browser、Code、MCP、Connector… 工具越来越多,可我的体验经常还是我才是所有 Agent 背后那个最累的 Agent。 我同时开着好几个 AI。这个查资料,那个写代码,另一个做图,还有一个跑 Deep Research。 A 做完以后我复制给 B,B 做完以后再扔给 C。 名义上我有一支 AI 团队,实际上我是这支团队里专门负责复制粘贴、开网页和催进度的项目经理。 Grok Bot 有一个特别戳我的能力**,它甚至可以去操作另一个 Agent。** 我可以在它的浏览器里登录其他 AI 产品,然后告诉 Grok Bot 这个任务你去交给它。 等它跑完,把结果拿回来,然后继续完成后面的事情。 到这里整个关系就开始发生变化了。 以前是我管理五个 Agent。 现在我开始尝试只管理一个 Agent,然后让它去管理剩下几个。 而 Grok Bot 本身也支持多个 Bot 协作,它们可以互相发消息、传递上下文、交接任务,同时共享用户的云电脑、文件和登录状态。 我觉得这才是真正让我兴奋的地方。 过去我们把 Agent 想成一个会调用很多工具的模型。Grok Bot 给我的感觉,更像是第一次给 AI 分了一张办公桌。 电脑在那,账号在那,浏览器开着。有什么事情直接发消息给它,它自己去开网页、找东西、操作软件、叫别的 Agent 干活。 这和在聊天框下面再塞十个按钮,完全是两种产品感受。 只要 Agent 真正获得了电脑,它能接管的就不再是一两个 AI 功能,而是今天已经存在的整个软件世界。 几十年来所有软件,最终都默认一个前提是屏幕前坐着一个人。 现在这个人,第一次可以不是我了。

sleepy.md

21,551 次观看 • 15 天前

全自动科学论文工厂,它真的来了。 你该看看这个新仓库。 之前那个中国大学生搞了个MiroFish,做实时社会模拟;字节跳动那边出了OpenViking,把记忆结构化;还有Percepta,把数学计算直接嵌进大模型的权重里;吴恩达那边也推了个Context Hub,相当于给代理加了一层自己标注的文档系统。 👉 Polymarket 官方入口: 现在,AutoResearchClaw 刚在 GitHub 上线——一个全自动的科学论文生成器。 仓库上线几个小时,就拿了差不多 4k 星。 给一个原始的想法进去,出来的就是一篇 6000 字、能直接用的 PDF 论文。关键它不是那种垃圾玩意儿。 它背后跑的是真正的代理系统: · 自己做实验:写代码、跑测试、读日志,崩了还能自己调 · 几乎没有幻觉:走硬核四层验证,对接真实科学数据库,没有假引用 · 格式也挑不出毛病:图表自动生成,LaTeX 排版,直接对标 NeurIPS / ICML 的标准 挺有意思的悖论是:这东西不会把 arXiv 搞死。 仓库: 当生成一篇论文的成本几乎为零,真正的权力就到了“筛选者”手里。行业里的新神,会是那些活人审稿人——他们要在无穷无尽的 AI 论文洪流里,手动淘出真东西。 愿安息吧,五年磨一篇的突破性论文——可能一夜之间就被批量淹没了。 把这几样东西拼在一起看: MiroFish 的集群 + OpenViking 的记忆 + Percepta 的真实数学 + Context Hub 的干净文档 + AutoResearchClaw 的自主研究 你就得到了一类代理——能自己跑完整个研究闭环,用真数学去验证假设,反复推敲,以远超人类的速度做出真正的突破。 这不就是在 Polymarket 和各类条件市场上,搭建下一代预测机器人要用的那套东西吗?代理自己去研究、模拟、验证概率,用科学的方法更新判断,而不是靠猜。 一个真正能发现、能证明的预测超级代理时代,就这么来了。 存好这套配置。 如果想在 Polymarket 上搞跟单交易,我推荐用这个: #Polymarket

区块链行情研究

62,723 次观看 • 6 个月前