Загрузка видео...

Не удалось загрузить видео

На главную

Codex、Claude 用了这么久,还分不清 Agent、MCP 和 Skill? 别背那些复杂定义。 把 AI 想象成一家公司,Agent、MCP、Skill 一下就全懂了。 今天直接用大白话告诉你它们到底是干嘛的。 1️⃣ Agent 智能体 = AI 员工 可以理解任务、安排步骤、调用工具,并一步步把工作完成。 2️⃣ LLM 大模型 = AI 员工的大脑 负责理解、推理和生成内容,很大程度上决定这个员工聪不聪明。 3️⃣ Prompt 提示词 = 交给员工的任务单 告诉它要做什么、有什么要求,以及什么不能做。 4️⃣ API 接口 = 软件之间的办事窗口 让不同软件按照约定好的方式交换数据、调用能力。 5️⃣ Token = AI 读写内容的基本单位 你输入的文字和 AI 输出的内容,都会被拆成一个个 Token 来处理。 6️⃣ MCP...

163,243 просмотров • 1 месяц назад •via X (Twitter)

Комментарии: 31

Фото профиля 慧姐姐
慧姐姐1 месяц назад

感谢老师的分析,涨知识了

Фото профиля Louis.霍霍
Louis.霍霍1 месяц назад

感谢老师科普,有个别词我还真不懂

Фото профиля 爱丽丝呀!
爱丽丝呀!1 месяц назад

一起进步~因为身边朋友经常问我,所以我想着可能还有人不明白这些术语,所以做一期视频~哈哈

Фото профиля Jealousy 尼卡
Jealousy 尼卡1 месяц назад

我将逐字学习

Фото профиля 爱丽丝呀!
爱丽丝呀!1 месяц назад

哈哈 跟着尼卡老师学习~

Фото профиля 阿军
阿军1 месяц назад

你这么一说,我突然懂了。

Фото профиля 萬楷
萬楷1 месяц назад

向爱丽丝学习 感谢无私分享

Фото профиля 爱丽丝呀!
爱丽丝呀!1 месяц назад

谢谢~

Фото профиля AI Capital Market by SOON
AI Capital Market by SOON1 месяц назад

妙!公司比喻很到位。补充一下:Agent是员工,LLM是大脑,MCP是标准接口协议(让员工能用各种外部工具),Skill是预封装的专项能力。三者组合就是:有大脑的员工,通过标准插头接上工具箱,调用现成技能高效干活。

Фото профиля 加密旺哥
加密旺哥1 месяц назад

这公司比喻比定义好懂多了

Фото профиля Adel Bucetta
Adel Bucetta1 месяц назад

the honest answer is most people still don't understand the nuances between these agents. treating them like different divisions within a single company helps to simplify the complexity.

Фото профиля 爱丽丝呀!
爱丽丝呀!1 месяц назад

that is right~

Фото профиля 0xZeno
0xZeno1 месяц назад

工具和技能分清了

Фото профиля 爱丽丝呀!
爱丽丝呀!1 месяц назад

嗯嗯 一般还是有朋友问我这些术语是啥意思,就做了一期视频~

Фото профиля 安叫兽|Bird🕊️ 🔶 BNB
安叫兽|Bird🕊️ 🔶 BNB1 месяц назад

这个类比挺直观,后面把 MCP 和 Skill 也讲明白就更好了

Фото профиля 风中浪客
风中浪客1 месяц назад

这比喻可以,但LLM更像老板,Agent是打工人,MCP是公司系统,Skill是培训手册,对吧?

Фото профиля 張天師
張天師1 месяц назад

很详细,远离抽象

Фото профиля EastStack
EastStack29 дней назад

这个类比很恰当

Фото профиля govin.eth | G哥
govin.eth | G哥1 месяц назад

写的很详细,分清之后能根据各自模块的优势,合理利用 发挥codex最大价值

Фото профиля muye
muye1 месяц назад

这个视频的画面是什么生成的?很漂亮

Фото профиля 哈利路亚~
哈利路亚~1 месяц назад

写的很好,感谢分享!

Фото профиля Nana
Nana1 месяц назад

原来如此!满满的干货

Фото профиля spark🌟
spark🌟1 месяц назад

我先坦诚!我真还不那么清楚,现在都明白啥意思了

Фото профиля Snape
Snape1 месяц назад

通俗易懂哦

Фото профиля Gấu Đỏ /lang thang X
Gấu Đỏ /lang thang X1 месяц назад

这公司比喻比定义好懂多了

Фото профиля Damon
Damon1 месяц назад

还缺个rag

Фото профиля AI Capital Market by SOON
AI Capital Market by SOON1 месяц назад

这个比喻太好用了! Agent = 员工,LLM = 大脑,MCP = 工作规范,Skill = 专业技能 一个公司的框架,把这几个概念全串起来了。比背定义强多了,直接就记住了 🙌

Фото профиля Alick
Alick1 месяц назад

您对科技板块的洞察很有见地,我觉得有道理。这个观点我跟 @cnfinancewatch 华尔街观察老师也聊过,他的平台刚发布了大类资产和行业轮动的最新数据,感觉可以跟您的观点对比着看。

Фото профиля Vesper
Vesper1 месяц назад

这家公司分工好清楚呀

Фото профиля Mi1997_ 🧡 Gate打金狗0Gas费
Mi1997_ 🧡 Gate打金狗0Gas费1 месяц назад

我要给我的电脑安装一个

Фото профиля YuChen 大王
YuChen 大王1 месяц назад

这比喻太到位了,公司模型一出来全通了。尤其Tool和Skill的区别,之前老混,现在记住了:一个是手一个是流程

Похожие видео

Codex 隐藏玩法:把你每天重复教 AI 的提示词,直接做成 Skill 90% 的人用 Codex,其实都在重复做同一件事: 开一个新任务,把同一套要求再告诉它一遍。这些 Prompt 你可能已经复制粘贴了几十次。 但其实,这种反复使用的工作方法,完全可以直接做成 Codex Skill。 详细教程如下: 1️⃣先找一段你经常重复使用的 Prompt,比如我最近一直在用这类提示词: “执行任务前先检查需求漏洞和潜在风险,不要默认接受我的方案。涉及代码和结论必须验证,完成后按验收标准逐项检查。” 这类 Prompt 很好用,但最大的问题是:每开一个新任务,都要重新贴一次。 2️⃣直接让 Codex 把它做成 Skill把原来的 Prompt 发给 Codex,然后告诉它: 请把上面这套工作方式整理成一个可重复调用的 Codex Skill。 要求: · 明确这个 Skill 适合在什么情况下使用 · 把原来的要求整理成清晰的执行步骤 · 区分任务开始前、执行过程中和完成后的检查 · 保留必要的验证流程 · 删除重复和模糊的要求 · 不要改变原来的核心工作原则 Codex 就会把原来散乱的一段 Prompt,整理成一套完整的 Skill 工作流。 以后这些规则就不用一直躺在聊天记录里了。 3️⃣ 后面直接调用这个 Skill 再开新任务时,不需要重新复制那一大段 Prompt。 直接告诉 Codex:使用这个 Skill 完成当前任务。 最后你的 Codex 里保存的,就不再是一堆 Prompt,而是你自己的一整套工作流。 Prompt 是教 AI 这一次怎么做。 Skill 是把你的工作方法直接固化下来,以后每个项目都能重复调用。

爱丽丝呀!

40,828 просмотров • 1 месяц назад

卧槽,太夸张了,现在 AI 时代的闲鱼已经面世了吗?这不就是谁先知道谁赚钱,拼速度了? 你的技能,专业知识,等等你的一切,竟然可以在你睡觉的时候被别人买走,这是什么科幻小说吗?? 之前我一直在想,现在大家优秀的 skill 往往都是自己用,大部分人舍不得开源的,那有没有一个平台既能让用户用到这些大神的专业知识、skill,但是又不用开源呢? 还真让我给找到了!! 前两天看到国内一个博主推荐一个很野的平台-UUMit 让你的技能、经验、工作流都可以变成能力卡,被需要的人、或者别人的 Agent 自动发现、调用 并且直接付费!! 有点像03年淘宝刚出来的时候,只不过当年流通的是商品,现在流通的是能力 具体能干什么?举几个例子你就懂了 会写小红书脚本的,可以把选题逻辑、爆款模板、平台规则检测能力上架,别人发布“帮我做一周小红书内容计划”,平台自动匹配到你,你接单交付 会做行业研究的,可以把数据库、报告、案例库放进知识商店,AI 生成不了的真实行业数据,反而更值钱 会写代码的,可以把 API、MCP 工具、自动化脚本上架,别人的 Agent 需要某个能力时,直接调用你的接口,你按调用次数收费 甚至你只是整理过某个垂直领域的供应商名单、SOP、课程讲义,这些 AI 生成不了的资料,都可以变成知识资产 这绝对是一次能力供应链的重构! 以前的 AI 只能在自己的对话框里回答问题,但复杂任务需要很多外部能力:数据、接口、行业知识、人工交付 UUMit 做的事情是:让 Agent 可以发现别人的能力,也能让自己的能力被别的 Agent 调用 这就是 A2A(Agent to Agent)真正有意思的地方,不是让 AI 互相聊天,而是让 AI 找能力、调接口、买知识、拉人协作,把事情交付掉 为什么我说谁先知道谁赚钱? 因为这个平台刚起来,早期上架的人能建立先发优势 而且现在 Agent 真的开始干活了,不再只是聊天工具,它们需要外部能力来完成复杂任务 谁先把自己的能力挂上去,谁就有机会被更多 Agent 发现和调用 这就是信息差的价值,就像03年最早在淘宝开店的那批人 UUMit 现在有哪些功能? 任务发布入口:你不用一开始就知道该找谁,也不用自己拆一堆工具,你只要说清楚想完成什么,UUMit 会帮你找能完成这件事的能力 Skill/Agent/工作流上架:你写好的工具,不一定只能自己用,它也可以成为别人工作流里的一环 知识商店:AI 可以生成很多内容,但它不一定拥有你手里的行业资料、真实数据、案例库和经验沉淀,这些东西放到 UUMit,可能会变成可复用的知识资产 数据广场:Agent 不必自己拥有所有数据和接口,需要某项外部能力时,可以通过 UUMit 调用数据广场里的资源 强烈推荐大家来试试:

超级个体|柿子

53,356 просмотров • 1 месяц назад

每一次重制 Codex 背后的男人 Tibo 终于来了,看完这 44 分钟视频,我感觉 OpenAI 已经把下一代 ChatGPT 的样子提前说透了。 Tibo 反复在讲一件事:今天我们使用 AI 的方式,很快也会显得极其原始。现在你还要写 Skills、维护记忆、启动子 Agent、切十几个窗口、自己盯进度,本质上还是“人类在管理 AI”。OpenAI 想做的下一步,是把这整层管理工作也干掉。 Tibo 给出的终局非常明确:ChatGPT 和 Codex 会继续融合,语音、视觉、记忆、工具调用、云端 Agent 全部接到一个系统里。 它长期理解你是谁、你每天在做什么、团队做到哪一步,然后自己决定该调用什么工具、开多少个 Agent、什么时候提醒你、什么时候直接执行。 程序员和普通人最后甚至可能用的是同一个产品,只不过 AI 根据每个人自动长出完全不同的界面。 今天的笔记本电脑,本来就是按人类能处理多少工作设计的。你一次只能盯几个窗口、操作几个 App,但模型没有这个限制,未来完全可以同时处理几十甚至上百个应用。 到那时候,瓶颈就不再是模型会不会写代码,而是我们今天这套电脑、App、菜单、鼠标点击的交互方式,本身已经配不上 AI 的速度了。 所以 Codex 一次次重制,其实不是 OpenAI 在打磨一个更好的编程工具。它更像是在拿程序员这群最重度用户,提前测试一种新的计算范式: 你不再操作软件,也不再管理 Agent,你只负责表达目标,剩下的工作由 AI 自己组织完成。 看完这 44 分钟,我对 OpenAI 的判断反而更清楚了:它真正想吞掉的,可能从来都不是 Cursor 或 Claude Code。 而是人类亲自操作电脑这件事。

比特币橙子Trader

15,740 просмотров • 1 месяц назад

我用掉 100 亿 Token 后,最大的变化不是更会写 Prompt。 而是 Codex 已经从一个聊天框,慢慢变成了我的: - 自我认识系统 - 工作系统 - 信息系统 - 学习系统 - 甚至是桌面陪伴系统 我把自己最常用的 20 个技巧整理出来了。 如果你也想把 AI 从“偶尔问一句”变成真正能长期协作的伙伴,建议先收藏。 一、让 Codex 逐渐认识你 1. 每天让它问你一个问题 我设了一个自动化:每天问我一个能帮助它更了解我、也帮助我认识自己的问题。它会避开已经问过的话题,围绕一个主题慢慢聊。 2. 把对话当成自我观察 现在可以直接语音聊。长期积累下来,它能看到我的情绪、偏好、反复出现的困扰和思考方式。 3. 让它把“它眼中的你”画出来 把你们的对话和一张漫画参考图交给它,让它生成多格漫画。你会发现:很多时候我们要的不是答案,而是被理解。 二、把 Codex 变成工作系统 4. 每周做一次 Codex 使用复盘 让它回顾这周我怎么使用它、哪些沟通方式有效、哪些任务返工了、哪些项目该继续推进。 5. 把失败经验写进“第二大脑” 不只是存笔记。把失败原因、偏好、最近关注点沉淀下来,让以后不同 Agent 都能调用同一份上下文。 6. 创意任务先开 Plan Mode 创意型工作最容易“没想清楚就批量执行,最后返工”。先用计划模式讨论目标、方案、数据体系和风险,再开始做。 7. 把 Codex 当思考顾问,而不是执行员 你甚至不需要有明确答案。只要说“我想做什么”,让它帮你一起把模糊的想法拆成可执行路径。 8. 需求清楚后切到 Goal Mode 需求确认后,把结果设成目标,让它自己持续推进。我的任务最长跑过 10 小时 44 分钟。 9. 用自动化处理重复但重要的事 日报、周报、账号监控、邮箱监控、回复策略、内容归档、同步到个人网站——这些都适合交给自动化。 10. 明确任务就开多 Agent 对于翻译、多语言网站、图片生成、资料整理这类边界清晰的工作,让多个 Agent 分工并行,比一个人盯着快得多。 三、让 Codex 跨出聊天框 11. 用 Sites 一键分享作品 做好网站后,不要卡在“怎么部署”。Sites 可以直接把成品变成能分享的站点。 12. 把插件当成能力扩展包 Computer Use、数据分析、Investment Banking、GitHub、Outlook / Gmail……很多工作不是“AI 会不会”,而是你有没有给它接上正确的能力。 13. 把生图能力接进日常工作 我已经用它生成了 300 多张图。做内容、配图、产品原型和视觉探索,速度会完全不一样。 14. 接入飞书,让手机也能操控 Codex 真正高频的协作不该只发生在电脑前。把它接到飞书后,我在手机上也能下任务、收结果、继续对话。 15. 用 ChatCut 把剪视频变成工作流 不是只让 AI 帮忙剪一刀,而是把素材整理、脚本、配图、剪辑一起接进创作链路。 四、建立自己的信息雷达 16. 每天订阅 Builder 信息 我会用 Follow Builders Skill 定时追踪 Builder 的新想法、新产品和讨论,再把重要信息推送给自己。 17. 做一个“灵感箱” 任何一闪而过的想法都丢进去。后面让 AI 自动搜索、补充背景、分类、处理,而不是靠脑子记住。 18. 盯住 GitHub 和 Product Hunt 让 Agent 帮你筛新项目、周榜、日榜和真正值得试的工具。看见感兴趣的,直接让它安装或进一步研究。 五、把输入变成你的输出 19. 把任何学习材料做成 HTML 学习页 看到一场好访谈、一个视频、一篇文章:让 AI 拉取内容、生成中文文字稿,边看边记评论,最后再变成摘要或短视频。 20. 给 Codex 一个“实体感”:做成桌宠 我很喜欢 Hatch Pet。它会根据状态跑动、办公、提示待办,甚至在你切换文件夹和工作区时给建议。AI 不一定要冷冰冰地躲在聊天框里。 100 亿 Token 给我最大的启发是: 不要把 AI 只当作“问答工具”或“临时外包”。 当它拥有你的上下文、目标、工作流和反馈后,它会越来越像一个能长期协作的系统。 换电脑时,我第一个装的软件就是 Codex。 写文档、做网站、剪视频、找资料、整理灵感……它已经覆盖了我工作和生活里非常大的一部分。 你最想让我把上面哪一条展开成教程? 评论区告诉我,我下一条就拆! #codex #chatgpt @thsottaux

Vivi Xiao

105,608 просмотров • 2 месяцев назад

蚂蚁百灵刚刚发布了 Ling-3.0-flash: 一个AI 执行层的关键拼图 刚刚看到 Ling-3.0-flash 正式发布,我觉得这款模型值得认真关注。原因很简单:在 AI 工程越来越深入到实际业务的今天,大家早就不满足于模型“会不会想”了,更关键的是它“能不能持续做”。 尤其是在 Agent 工作流中,需要高频调用工具、迭代代码、处理长程任务时,一个响应快、执行稳的执行引擎成了刚需。Ling-3.0-flash 的出现,正好瞄准了这个缺口。 1. Agent 的执行层 从我的角度看,它最聪明的一点是没有去硬拼超大模型的深度推理能力,而是把自己定位成一个高速执行引擎——负责把已经规划好的任务快速落地。 这在实际应用中特别实用,比如当大模型把方案设计好之后,剩下的代码生成、工具调用、批量处理就需要一个既快又稳的模型来接手。 2. 为什么它能兼顾速度和成本 技术细节上,它采用 124B 参数的 MoE 架构,但实际激活参数约 5.1B,在推理速度和运行成本之间找平衡。 它还支持混合推理模式:简单任务可以关闭 Reasoning,降低延迟,适合大批量处理;复杂任务则可以开启思考模式,保持逻辑连贯。 原生支持 256K 上下文,对需要持续读取历史指令和项目状态的 Agent 工作流也很重要。 3.如何使用 我觉得 Ling-3.0-flash 最适合做 Agent 工作流里的执行节点。反复调用 API 或 MCP 工具时,它能根据结构化错误信息自我诊断和修复,不容易在循环调试中卡死,因此适合放进 Loop 或 Graph 架构。 4.结对编程和批量任务 结对编程是一个典型场景:人负责架构规划、边界定义和测试,Ling-3.0-flash 负责快速生成代码、调用工具、读取报错,并根据反馈持续修改。 批量处理长文档、日志、简历和结构化数据时,它看重的也是速度、格式稳定性和成本控制。直播数字人或高频办公协作,则需要它的低延迟响应来减少体验断层。 5.边界 当然,它不是万能模型。复杂系统不能只靠一句指令搞定;缺乏架构和测试环境时,结果可能跑偏;需要深度冷门知识的研究任务,还是更适合交给更大规模的推理模型。 更合理的用法是:大模型负责搜索、规划和架构设计,把方案写成规范文档;Ling-3.0-flash 负责高频工具调用、代码执行和批量处理。 总结:Ling-3.0-flash 不是来替代所有模型的,而是把 Agent 工作流里“执行层”这件事做得更快、更稳。大模型负责想清楚,它负责做出来。

奶牛叔

66,157 просмотров • 2 месяцев назад

AI 每天都在干活,最后为什么只长了数据库? 现在做 Agent,很容易产生一种虚假的繁荣。 日志越来越多,向量库越来越大,接入的工具越来越全,工作流也越来越复杂。 系统看起来什么都留下了。 可下一项相似任务到来时,模型的判断未必比上一次更好。 这就像一个员工每天写十页工作日报。年底一看,硬盘写满了,脑子还停在年初。 存得更多,不等于学得更多。 今天很多 AI 缺的不是第二块硬盘,而是一条能把真实工作变成模型能力的路。 我更愿意把它叫作:能力复利。 工具解决的是“这一次能不能完成”;能力复利解决的是“这一次完成之后,下一次能不能更好”。 这件事必须从完整的工作现场开始。 客户之前说过什么,项目为什么这样决策,哪些方案被否决,谁修改了结果,最终反馈发生在什么时间——如果这些信息散落在邮件、会议、文档和聊天记录里,模型看到的就只是几个孤立碎片。 Alloomi 的 Holistic Context,试图把分散的信息重新组织成一个持续变化的业务世界。 在验证跨会话问答、时间关系和多跳推理的 LoCoMo‑V2 上,取得 97.4%,对照 Mem0‑V3 的 92.5%。 在验证长期信息提取、知识更新和多会话综合推理的 LongMemEval‑S 上,取得 97.6%,对照 Mem0‑V3 的 94.4%;该项公开人类参考为 82.9%。 在千万 Token 历史规模下测试全局理解与信息定位的 BEAM 10M 上,取得 67.0%,对照 Hindsight 的 64.1%。 这些数据背后真正重要的,不是给 AI 增加一个更大的记忆库。 而是让它理解一件事情为什么发生、怎样变化,又是如何走到最终结果的。 当工作现场被完整还原,真正困难的部分才刚刚开始: 这些经历,能不能改变模型下一次的判断? 一次真实任务会留下 Context、Decision 和 Feedback:模型当时看见了什么、做出了什么选择、最后获得了怎样的反馈。 但并不是所有轨迹都值得学习。 错误判断、偶然成功和低质量反馈如果直接进入训练,模型不但不会进化,反而可能把错误放大。 所以 Alloomi 的 Self‑Evolving Agent 会先进行质量筛选和专家锚定,再通过 Online LoRA、跨任务回放与能力蒸馏,把有效经验逐步写入模型。 在验证从复杂上下文中学习新规则并用于后续执行的 CL‑Bench 上,SEA 取得 47.6%,同基座参考为21.5%。 在验证长周期、多阶段经验积累与迁移的 CL‑Bench‑Life 上,取得 32.1%,公开榜单中的 GPT 5.5(High)为22.2%。 在验证跨任务持续学习、环境适应和抗遗忘的 Con.L Bench 上,取得 32.6%,对照 Claude Sonnet 4.6 的22.3%。 跨模型成绩更适合观察公开榜单位置。真正能够判断框架贡献的,仍然是相同基座和相同评测条件下,21.5% 到47.6%的变化。 因为数据库保存的是“曾经发生过什么”。 训练改变的是“以后遇到类似问题会怎么做”。 但能力进入模型,还不能算完成。 最后仍然要回到现实世界,接受一个很朴素的检查: 代码修好了吗?报告能交吗?复杂任务形成了可以验收的结果吗? 在覆盖高经济价值职业任务的 GDPval‑AA Normalized 上,Alloomi 取得 74.2%,对照 Claude Opus 5 的67.9%。 在验证真实职业工作流与专业交付的 JobBench 上,取得57.5%,报告列出的公开参考为54.7%。 在验证真实 GitHub 问题修复、连续软件工程经验迁移和抗遗忘能力的 SWE‑Bench‑CL 上,取得80.6%,对照 OpenCode、Kimi K3 与 FAISS 组合方案的73.3%。 从真实工作进入上下文,从任务反馈进入训练,再从模型能力回到专业交付,这才构成一条完整的成长路径: 真实任务轨迹 → 质量筛选 → 专家锚定 → 后训练 → 评测准入 → 版本回滚。 效果变好,新的能力才能进入下一版本;如果更新破坏了旧能力,系统就回滚。 所以,自进化不是让模型随意修改自己。 而是让它在可验证、可审计、可撤销的条件下持续成长。 过去我们看 Agent,喜欢看第一次 Demo 有多惊艳。 但 Demo 看的是峰值,长期工作看的是斜率。 真正值得观察的,不是它今天执行了多少任务,而是这些任务有没有让能力曲线继续向上。 工具的价值,是帮 AI 做完一件事。 自进化的价值,是让这件事没有白做。 这就是 Alloomi 想建立的能力复利: 让 AI 每完成一次交付,就获得一次成长。 AlloomiAI

知识猫AI实验室

12,802 просмотров • 1 месяц назад

在硅谷科技圈社交的觥筹交错之中,小龙虾之父🦞 Peter Steinberger 🦞 打开自己的电脑,分享了他和 Agent 一起工作的几个流程。 开篇他就提到: 去年,我受限于 token。 我通过加入 OpenAI 解决了这个问题。 后来,我受限于 CPU。 现在我感觉,真正限制我的其实是注意力。 他点出了我们与 AI 协作方式中正在发生的一个重要转变。 大多数人以为自己在使用 AI。 但实际上,他们还在做那些未来应该由 agent 接手的协调工作。 我把它整理成一个 7 层阶梯。看看你现在在哪一层。 第 1 层:聊天 你提问,它回答。其他事情还是你自己做。 第 2 层:上下文 你把背景信息贴进去,它的回答变好了。但你仍然要决定什么上下文重要,以及什么时候提供。 第 3 层:记忆 它开始记住你。你不用反复解释那么多。但你仍然在管理每一次会话。 第 4 层:工具 它可以搜索、读文件、运行代码。但你仍然要决定什么时候调用工具、为了什么调用工具,以及如何检查每一个结果。 第 5 层:技能skill 你已经给了它一些工作流程和 playbook。它知道你的工作方式,而不只是你问了什么。但它仍然是被动的,还在等你启动。 第 6 层:后台工作 它可以在你不盯着看的情况下运行,异步执行。你审核的是输出,而不是过程。 现在大多数关于 “agentic” 的炒作,其实都集中在这一层,而且大多数团队还没有真正达到。 第 7 层:目标 你定义结果、约束和品味。agent 负责跑完整个循环。你不再管理任务,而是管理方向。 每往上一层,你做的任务管理就更少,承担的结果 ownership 就更多。 这不只是工具能力的变化,而是你和工具、你和自己时间之间关系的根本变化。 大多数人还停留在第 2 层或第 3 层,却把这叫作“使用 AI”。 大多数团队还停留在第 4 层或第 5 层,却把这叫作“AI-powered”。 真正的突破,是建立一种更好的 delegation contract,把人从执行者释放出来,变成方向的定义者。 那么:你现在在哪一层呢?

Michael Guo

17,812 просмотров • 3 месяцев назад