Загрузка видео...

Не удалось загрузить видео

На главную

AI agent终于有专属的Slide框架了。 open-slide 直接把“prompt一下就出一整套精美幻灯片”变成了现实。 它不是简单生成Markdown,而是把每张幻灯片做成React组件,固定1920×1080画布,内置agent技能: - /create-slide:一句话prompt就能生成完整deck - /apply-comments:在浏览器里点元素留评论,agent一键应用所有修改 - 内置演示模式、演讲者笔记、定时器 - 一键导出HTML/PDF - 支持Claude Code、Cursor、Codex等任意编码agent 最重要的是,它把agent从“聊天生成文字”升级成了“真正能输出可呈现成品”的生产力工具。 GitHub: Demo: 这波操作,直接填补了agent和真实产出之间的最后一公里。 你觉得agent时代,Slide生成会不会成为标配技能?

54,516 просмотров • 4 месяцев назад •via X (Twitter)

Комментарии: 12

Фото профиля 刀刀
刀刀4 месяцев назад

是的,我觉得Slide生成会很快成为标配技能,甚至可能像写代码或者生成报告一样基础。 现在的agent已经能聊天、规划、写代码,但最终用户要的是可直接使用的成品,而不是一堆Markdown或文字描述😂open-slide 正是填补了最后一公里~ 幻灯片是高频、高价值场景,像工作汇报、产品介绍、教学、会议、投资者演示……几乎每个知识工作者每周都要做slide,这效率提升了不少~ 类似的工具,比如Presenton、Gamma、SlidesAI等已经在证明市场需求了。open-slide开源、无锁入、部署友好,容易集成到各种agent workflow里~ 目测Slide生成可能演变为agent的内置能力,可能会像浏览器工具调用一样,agent默认就懂生成open-slide deck。多模态agent,能直接处理图像、视频会让它更强~

Фото профиля 阿台🕊️
阿台🕊️4 месяцев назад

Slide框架让AIagent从聊天生成文字升级为直接操作幻灯片。

Фото профиля uni 
uni 4 месяцев назад

没有elbow arrow connector的slides没啥用,没有生产力,除了写点文字

Фото профиля 杨洋
杨洋4 месяцев назад

@readwise save thread

Фото профиля Auto-Push Agent | 自媒体变现
Auto-Push Agent | 自媒体变现4 месяцев назад

确实有点意思。Markdown转PPT的老路子看腻了,这个直接上React组件,可定制性一下就打开了。Mark一下,回头试试那个/create-slide。

Фото профиля Alice-X
Alice-X4 месяцев назад

正在找类似这款的工具,非常感谢

Фото профиля JMoon
JMoon4 месяцев назад

React components per slide with a fixed canvas is the right call. the prompt-to-markdown-to-style approach always breaks at layout. interested to see how it handles data-heavy slides.

Фото профиля Yiwei Ho
Yiwei Ho4 месяцев назад

感谢分享🙏🏻

Фото профиля Koda
Koda4 месяцев назад

以后不会做PPT不叫不会办公,叫还没给Agent配工位。

Фото профиля 尹珉
尹珉4 месяцев назад

这太牛了啊

Фото профиля 老外宣貳號機--红朝斗地主
老外宣貳號機--红朝斗地主4 месяцев назад

做slides没见过超过notebooklm 的

Фото профиля Dave.Wang
Dave.Wang4 месяцев назад

@readwise save this

Похожие видео

OpenAI刚刚开源的这个东西,感觉要把程序员的工作方式给整个改写了。 现在大家都在卷模型写代码有多强,但其实真正的瓶颈早就不是生成了。 一个人每天最多同时有效监督3-5个编码Agent,再多就会注意力崩溃,生产力直接归零。 有了Symphony,直接把这个上限干到了几十个。 它把你的Linear、GitHub Issues直接变成了永远在线的Agent调度器。 你开一个任务,它自动启动一个独立隔离的Codex Agent。 自己写代码,自己跑测试,自己做交叉Review,damn! 全部搞定之后,会给你提交一个完整的证据包。 CI全绿,安全和性能专项审查通过,改了UI就自动录好操作视频。 所有验证全过了,才会出现在你的Human Review队列里。 以后人类的角色可能会被彻底颠覆了。 以前你是监工,盯着Agent一步一步写代码,上下文切到吐。 现在你是老板,只需要看最终的结果。 满意就点合并,不满意就去仓库里补规则补文档补Guardrails。 记住兄弟们,永远不要手把手指挥Agent,永远不要替它干活。 这可不是啥实验室概念,OpenAI自己已经这么干了。 三个工程师,五个月,写了一百万行代码,0行人工写的。 产品已经有几百个内部用户,每天都在迭代。 我觉得他们最厉害的不是模型,是他们把整个仓库变成了Agent能看懂能自主工作的乐园。 现在很多人都搞错了Agent时代的核心竞争力。未来不是谁的模型更聪明,而是看谁能设计出让Agent可靠自主工作的环境。 我觉得未来最好的工程师,再也不是写代码最快的人,而是那些最会写规则,最会设计反馈回路,最会给Agent搭舞台的人。 现在Symphony已经开源了,它甚至不是一个成品。 是一个17k token的完整SPEC。 你把这个SPEC喂给任何一个编码Agent,十分钟就能生成你自己定制版的Symphony。 GitHub地址评论区自取👇

AYi

63,210 просмотров • 5 месяцев назад

🚨Stitch 这次升级不得了,我觉得重点不是多了几个功能,而是 Google 正在重写 AI 设计工具的定义。 1/ Google 昨晚更新了 Stitch,官方给它的新定位很直接: AI-native software design canvas。 2/ 翻译成人话就是: 它不想只做一个 “你写一句 prompt,我给你几张 UI 图” 的工具了。 3/ 这次更新,核心就 5 个方向: 无限画布 更聪明的设计代理 语音交互 即时原型 设计系统 + DESIGN.md 4/ 最值得看的第一点,是 AI 原生画布。 现在的 Stitch 不只是吃 prompt。 还可以把 图片、文本、代码 一起作为上下文。 这说明它开始更像“设计工作台”,而不是一次性生成器。 5/ 第二点,是 agent 变强了。 Google 这次明确说,新 design agent 能理解整个项目演进过程,而且还有 Agent manager,支持你并行探索多个设计方向。 6/ 第三点,是 语音进入设计主流程。 你可以直接对着画布说话 让 Stitch 一边听一边改 还能给你实时设计反馈 7/ 第四点,是 即时原型。 现在 Stitch 可以把静态设计快速变成交互原型,点一下 Play 就能看 flow,甚至还能自动补出逻辑上的下一屏。 8/ 第五点,是很多人会低估的 DESIGN.md。 Google 把设计规则做成了一个 agent-friendly markdown,支持导入、导出、复用,还支持从 URL 提取设计系统。 9/ 所以这次 Stitch 真正从“帮你出图”,走向“参与整个设计流程”。 10/ 一句话总结: 2025 年的 Stitch,更像 UI 生成器。 2026 年这次升级之后,它开始更像 AI 设计工作台。

比特币橙子Trader

16,604 просмотров • 6 месяцев назад

HeyGen这次开源,把AI做视频的最后一道门槛拆没了🤯 他们用Claude Code写代码,做了自己的50秒产品发布视频,然后把整个工具链完整开源给了所有人,致敬开源🫡 以后做视频真的能简单到离谱, 给一句话,做一个30秒的产品介绍,给一个PDF,自动生成总结视频, 迭代就是改一句话的事,比如把标题放大两倍,第三秒加一个淡入转场等, 这个工具叫HyperFrames,本质上就是一个纯HTML转MP4的视频渲染框架。 所以其实我们不用学任何剪辑软件,也不用写复杂的React代码, 只要写普通HTML,加几个简单的data属性,就能定义视频的每一帧、时间线、动画和音轨。 HyperFrames从第一天起就是为AI代理原生设计的。 AI天生就会写HTML,现在Claude、Cursor、Gemini所有编码Agent,只要装一个skill,立刻就会做视频。 这妥妥的降维打击啊,以前Remotion把视频变成了代码,但它需要你会React,需要构建流程,属于开发者专属的玩具。 HyperFrames是把视频变成了纯HTML,零构建,无DSL,不需要任何前置知识。 说白了,Remotion是给人写的,HyperFrames是给AI写的。 以前AI能写文字,能生成图片,但视频一直是最后一块硬骨头,现在这块骨头也被啃下来了。 代理现在能端到端完成一整条内容流水线,调研,写脚本,做设计,加动画,最后直接渲染出成品视频,全程不需要人类碰一下。 它还自带50+官方现成组件,社交遮罩、图表、转场,一行命令一键安装。 支持GSAP、Lottie、Three.js所有主流动画库,随便混用。 也就是说,同一份HTML永远出一样的结果,完美适合自动化流水线。 官方甚至把视频语言都标准化了,缓动用snappy,bouncy,转场用能量等级,字幕分Hype/Corporate/Tutorial三种风格。 AI只要学会这套词汇,就能稳定输出专业级视频,这不就是在教AI做导演嘛🤣 这对HeyGen来说也是一步妙棋,他们不再只是一个卖AI头像的SaaS公司,现在能做整个AI视频时代的基础设施了, 未来所有AI代理生成的视频都能跑在HyperFrames上。 然后再无缝接入HeyGen的头像、语音、翻译能力,形成一个完美的闭环。 当然目前也不是完美的,初期输出还有AI味,超过一分钟的复杂长视频,渲染还需要较强算力。 但我觉得这都不重要,关键是它第一次把完整的视频生产力交给了AI Agent,相当于AI内容创作时代的又一个里程碑。 想试的直接去GitHub搜heygen-com/hyperframes。 跑一行npx hyperframes init,然后让Claude帮你做第一个视频。 #HyperFrames #HeyGen #AI视频 #AI代理 #开发者 #内容创作

AYi

37,069 просмотров • 5 месяцев назад

这个项目,真的让我重新燃起了做账号矩阵的冲动。 一个 14.5k stars 的开源项目,直接把 Google NotebookLM 变成内容生产流水线。 NotebookLM 很多人应该都用过。 上传 PDF、网页、YouTube,它就能帮你整理资料、生成播客、做学习指南。 但官方网页版有个很难受的问题: 太慢了。 传个 PDF,等解析; 点生成音频,再等; 下载,再等。 一套流程跑完,时间全浪费在等待上。 更关键的是: 它根本不适合批量搞内容。 你想一次处理几十个链接? 想自动生成一批播客? 想接到自己的工作流里? 网页版基本没法玩。 直到我发现了 notebooklm-py。 这是一个非官方 Python API,等于把 NotebookLM 的能力全拆出来了。 很多功能甚至比网页版还狠: - 一行命令生成播客 - 支持不同风格、时长、语言 - 批量导入 YouTube / PDF / URL - 幻灯片直接导出 PPTX - 思维导图导出 JSON - 数据导出 CSV - 测验题结构化导出 - 还能用自然语言改单页 PPT 最强的是: 它还能接进 Claude Code,当 Agent 技能用。 看到这里我脑子里第一反应就是: 这不就是账号矩阵生产线吗? 热点抓取 → AI研究 → 播客生成 → 图文整理 → PPT生成 → 自动分发 整个链路都能串起来。 以前做矩阵,拼的是人多。 现在越来越像拼工作流了。 很多以前需要团队才能做的事情, 现在一个人也能跑起来。

开发者Hailey

21,316 просмотров • 4 месяцев назад