Загрузка видео...

Не удалось загрузить видео

На главную

PM学编程第6天:开发一个MCP server 昨天安装测试不少MCP (如Fetch、Obsidian、sequential-thinking、brave search、playwright等) 惊叹的同时,很想自己做一个。 仅需说话就能完成复杂任务,确实是件很酷的事情。 过程比想象中简单,甚至不用看官方文档。 只需VS安装Cline 或 Roo Code插件,然后说:我要做一个xxx的MCP,然后描述功能需求。 AI会自动生成代码,读取修改MCP 配置文件,不断修改测试就能完成。 做了一个海螺音频的MCP。 只需要说,用xx声音,朗读“xxx”(可以是文字也可以文件名),就会自动调用MCP,把文本用这个音色生成一个MP3文件。 优势:每个MCP 可以跟其他MCP工作流整合,比如直接说抓取Paulgraham 的第3篇,生成双语对照,然后用中年男生朗读。 感受:像Coze、Dify这类工具要尽快演化,否则很容易被各种 MCP 取代,拖拽连线成本太高了。 普通用户未来可能只是安装了一堆MCP插件,只需要用语言描述任务即可。

37,569 просмотров • 1 год назад •via X (Twitter)

Комментарии: 5

Фото профиля whthomas
whthomas1 год назад

MCP软件现在开发也挺容易了,确实这种形式很好用。

Фото профиля 金融狗老愚
金融狗老愚1 год назад

太牛逼了!马上想学你这个!

Фото профиля notice_u
notice_u1 год назад

@readwise save thread

Фото профиля MailerSend
MailerSend2 лет назад

Get started with MailerSend's email API and your favorite programming language and have simple, reliable transactional email delivery for your app or website in minutes. 3,000 emails/month free. Sign up free now!

Фото профиля 希嘉嘉
希嘉嘉1 год назад

MCP 是什么?

Похожие видео

这两天 ChatCut 大火,作为一个审美白痴我对视频质量发言权不大,但是必须得说这个插件的确是做的优雅,👍 简而言之,ChatCut 把 Skills 和一整套 MCP Tools 接进 Codex,项目、素材、生成任务、时间线和导出状态都由 MCP 直接与 ChatCut 后端交互;网页版编辑器处理专业剪辑界面,并且和 MCP 共享同一个项目状态。 于是 Codex 可以负责理解需求、研究资料、写脚本、做判断和编排任务,ChatCut 则继续负责素材、轨道、帧、渲染、转码这些很脏、很重、但又必须极其可靠的视频工程。 我用它做了一支 3 分钟的“中国过去十年出生人口变化”分析视频,并完整观察了一下整个的过程:查国家统计局数据,生成 6 段旁白,写 6 个可编辑 MG,按照真实音频长度对齐 5509 帧,再抽查云端渲染结果。 关键不是 AI 会不会模拟鼠标,而是 Codex 完成了 AI 最擅长的理解和编排,ChatCut 完成了专业软件最擅长的工程执行,最后我还能进入传统时间线继续修改。 我觉得这才是 Codex 插件能发挥最大价值的方式:不要每个产品都重新造一套聊天框、Agent、模型路由和通用推理,也不要让 Codex 用 Browser Use 硬猜一个复杂软件的界面;把 AI 层交给 Codex,把真正形成产品壁垒的工程层留在自己手里,中间用 MCP 建立稳定、可验证、可组合的接口。 所以说 MCP 已死,我觉得是看反了。MCP Server 的数量、套壳和“接入即智能”这类幻想确实在退潮,但 MCP 作为分工边界反而越来越重要。没有这层协议,AI 产品和专业软件只能互相侵入、重复造轮子;有了它,两边都可以把精力放回自己真正擅长的部分。 我现在更愿意把好的 Codex 插件理解成一种新型专业软件:AI 不需要住进软件里,软件也不需要把自己改造成 AI。它们通过 MCP 协作,最后把一件真实工作做完。 OpenAI 当年号称要把 GPTs 做成 AI 时代 App Store 的梦想,好像真的有那么点希望了。

李不凯正在研究

20,770 просмотров • 19 дней назад

我经常看一些英文技术文档,但因为英语不够好,加上专业名词晦涩难懂,读起来很吃力。 之前我一直用 NotebookLM 转成播客听,但它生成的中文播客有个致命问题:听起来很别扭,有时候中文用词也不准确。 最近发现扣子上线了 Skills 功能,我就想着试用它做一个“转播客”的工具。 操作方式也很简单,直接打开 扣子编程网站: 然后选择技能,在输入框里面说了一下我的需求 我会输入一个英文博客文章,你帮我做成一个两人的播客,两个主持人对谈探讨播客内容,目的是用通俗易懂的方式说清楚这个文章的内容,你要使用api生成语音做成一个播客 它很快就为我生成了一个 Skill。然后生成以后点击右上角的部署 接下来回到扣子编程页面,在对话框选择更多技能,就看到了我的skill 我用 Claude 的《Skills explained》文档测试了一下,效果出乎意料地好,讲得通俗易懂。比如: 说话人1:你就把 Skills 当成是 Claude 的专业训练手册。 说话人2:那它跟平时发的 Prompt 有啥不一样? 说话人1:Prompt 就像临时问“这个菜咋做”,Skills 就是把整个菜谱都存下来,下次直接照着做就行。 7 分钟听完,还真全懂了(效果看视频)。 关键是,制作这个 Skill 我一行代码没写,只是描述了需求,扣子就把“如何通俗易懂讲技术”这个方法论固化成了 Skill。 接下来,我只需要把英文博客粘贴进去,它就会: 自动设计双人对话节奏,像听真播客一样自然; 识别晦涩概念,用类比解释(比如菜谱、咖啡店); 保留技术准确性,但绝不堆砌术语。 现在我读每篇文档,几分钟就能吸收核心内容,每天能省出大量时间用于深度思考。 我觉得这才是 AI 该有的样子:不是把所有人拉到同一个平庸水平,而是把少数人的方法论,沉淀成人人可用的能力。 录了个实际效果视频,大家可以感受一下这种“自然度”和“通俗度”。推荐大家去试一下,用来做一些基础办公的 Skill 非常好使!

泊舟

37,881 просмотров • 6 месяцев назад

HeyGen这次开源,把AI做视频的最后一道门槛拆没了🤯 他们用Claude Code写代码,做了自己的50秒产品发布视频,然后把整个工具链完整开源给了所有人,致敬开源🫡 以后做视频真的能简单到离谱, 给一句话,做一个30秒的产品介绍,给一个PDF,自动生成总结视频, 迭代就是改一句话的事,比如把标题放大两倍,第三秒加一个淡入转场等, 这个工具叫HyperFrames,本质上就是一个纯HTML转MP4的视频渲染框架。 所以其实我们不用学任何剪辑软件,也不用写复杂的React代码, 只要写普通HTML,加几个简单的data属性,就能定义视频的每一帧、时间线、动画和音轨。 HyperFrames从第一天起就是为AI代理原生设计的。 AI天生就会写HTML,现在Claude、Cursor、Gemini所有编码Agent,只要装一个skill,立刻就会做视频。 这妥妥的降维打击啊,以前Remotion把视频变成了代码,但它需要你会React,需要构建流程,属于开发者专属的玩具。 HyperFrames是把视频变成了纯HTML,零构建,无DSL,不需要任何前置知识。 说白了,Remotion是给人写的,HyperFrames是给AI写的。 以前AI能写文字,能生成图片,但视频一直是最后一块硬骨头,现在这块骨头也被啃下来了。 代理现在能端到端完成一整条内容流水线,调研,写脚本,做设计,加动画,最后直接渲染出成品视频,全程不需要人类碰一下。 它还自带50+官方现成组件,社交遮罩、图表、转场,一行命令一键安装。 支持GSAP、Lottie、Three.js所有主流动画库,随便混用。 也就是说,同一份HTML永远出一样的结果,完美适合自动化流水线。 官方甚至把视频语言都标准化了,缓动用snappy,bouncy,转场用能量等级,字幕分Hype/Corporate/Tutorial三种风格。 AI只要学会这套词汇,就能稳定输出专业级视频,这不就是在教AI做导演嘛🤣 这对HeyGen来说也是一步妙棋,他们不再只是一个卖AI头像的SaaS公司,现在能做整个AI视频时代的基础设施了, 未来所有AI代理生成的视频都能跑在HyperFrames上。 然后再无缝接入HeyGen的头像、语音、翻译能力,形成一个完美的闭环。 当然目前也不是完美的,初期输出还有AI味,超过一分钟的复杂长视频,渲染还需要较强算力。 但我觉得这都不重要,关键是它第一次把完整的视频生产力交给了AI Agent,相当于AI内容创作时代的又一个里程碑。 想试的直接去GitHub搜heygen-com/hyperframes。 跑一行npx hyperframes init,然后让Claude帮你做第一个视频。 #HyperFrames #HeyGen #AI视频 #AI代理 #开发者 #内容创作

AYi

36,653 просмотров • 3 месяцев назад

看我作为一个 AI 博主是如何用飞书 + 【可联网的】DeepSeek R1 搭建简单自动化工作流提升工作效率的 作为一个 AI 博主,日常一大部分工作是阅读和分享各种海外的AI资讯,这就少不了要翻译各种英文文章。之前我很多操作是手动的,比如复制粘贴文章到 Markdown 编辑器,然后从编辑器复制到 DeepSeek R1 或者 ChatGPT 去翻译,再改写后发布。 之前看 orange ai 分享的飞书多维表格接入 DeepSeek R1 的教程,【加上这周飞书的AI直播】,按照我自己的场景定制了几个工作流,最开始只是简单的文本翻译,后来发现也能用支持从图片提取文字,那意味着我可以直接先把图片转成文字,再基于翻译好的文本用 DeepSeek R1 翻译。简单设置后就成功了。 再后来我甚至更进一步,直接从 URL 抓取内容,然后借助 DeepSeek R1 翻译,最后甚至还可以把翻译后的文章用各种不同的文章风格改写,使用的时候只要输入 URL 就可以自动生成一篇高质量的文章,是真的很方便。 具体来说,就是飞书在添加字段的时候,可以选 ShortCuts(中文可能对应的是“快捷方式”),然后从快捷方式中选择各种不同的工具,比如说 AI 抓取、DeepSeek R1、图片 OCR、图片生成、抠图等等,并且你可以设置某个字段的内容为输入,以及自定义提示词。 就像我前面自动从 URL 生成文章的流程,主要有这样几个字段: - URL:输入 URL - 原始网页内容(AI Web Link Reader):从输入的 URL 中提取标题、内容为 Markdown 文本 - 翻译为中文(DeepSeek R1):将抓取后的 Markdown 文本翻译为中文 - 翻译为中文 - 输出结果:DeepSeek R1 的输出结果 - 风格改写(DeepSeek R1):将翻译后的内容用指定的风格改写,阅读起来更自然 - 风格改写 - 输出结果:DeepSeek R1 的输出结果 除了上面的 URL 生成文章外,里面还包含了几个不同的常用工作流: - 将输入的文本内容翻译为中文 - 将输入的图片内容翻译为中文 - 生成多条爆款标题供选择 工作流的飞书模板链接🔗我放在了评论,建议你也可以试试,应该可以发掘出不少有意思的场景。⬇️

宝玉

87,416 просмотров • 1 год назад