Video wird geladen...

Video konnte nicht geladen werden

Zur Startseite

无敌了,终于能实时看见Claude Code在干嘛了 zoetrope,刚开源几天的可视化神器,把一次会话画成一张流动的图 主agent派生了哪些子agent、每个跑了什么工具、耗时多少、成没成,全在终端里实时长出来。跑完的会话还能按原始时间戳回放 纯读本地的会话记录,只读不写,什么都不上传你的机器 终端和浏览器都能看,浏览器版拖一个transcript进去就出图,Rust写的,MIT开源

53,761 Aufrufe • vor 4 Tagen •via X (Twitter)

0 Kommentare

Keine Kommentare verfügbar

Kommentare vom Original-Post werden hier angezeigt

Ähnliche Videos

OpenAI刚刚开源的这个东西,感觉要把程序员的工作方式给整个改写了。 现在大家都在卷模型写代码有多强,但其实真正的瓶颈早就不是生成了。 一个人每天最多同时有效监督3-5个编码Agent,再多就会注意力崩溃,生产力直接归零。 有了Symphony,直接把这个上限干到了几十个。 它把你的Linear、GitHub Issues直接变成了永远在线的Agent调度器。 你开一个任务,它自动启动一个独立隔离的Codex Agent。 自己写代码,自己跑测试,自己做交叉Review,damn! 全部搞定之后,会给你提交一个完整的证据包。 CI全绿,安全和性能专项审查通过,改了UI就自动录好操作视频。 所有验证全过了,才会出现在你的Human Review队列里。 以后人类的角色可能会被彻底颠覆了。 以前你是监工,盯着Agent一步一步写代码,上下文切到吐。 现在你是老板,只需要看最终的结果。 满意就点合并,不满意就去仓库里补规则补文档补Guardrails。 记住兄弟们,永远不要手把手指挥Agent,永远不要替它干活。 这可不是啥实验室概念,OpenAI自己已经这么干了。 三个工程师,五个月,写了一百万行代码,0行人工写的。 产品已经有几百个内部用户,每天都在迭代。 我觉得他们最厉害的不是模型,是他们把整个仓库变成了Agent能看懂能自主工作的乐园。 现在很多人都搞错了Agent时代的核心竞争力。未来不是谁的模型更聪明,而是看谁能设计出让Agent可靠自主工作的环境。 我觉得未来最好的工程师,再也不是写代码最快的人,而是那些最会写规则,最会设计反馈回路,最会给Agent搭舞台的人。 现在Symphony已经开源了,它甚至不是一个成品。 是一个17k token的完整SPEC。 你把这个SPEC喂给任何一个编码Agent,十分钟就能生成你自己定制版的Symphony。 GitHub地址评论区自取👇

AYi

63,210 Aufrufe • vor 4 Monaten

baoyu-design skill 可以在本地生成动画视频,导出 mp4 格式,就像附件视频这个。 Claude Design 网页版可以用提示词创建动画视频,但你需要在网页上才能看到视频,无法下载。也有人基于第三方插件录屏软件实现过,不过很麻烦,效果也不是很好。 在这套 Skill 基础上,我已经实现了直接把动画导出成 mp4 视频的能力。 生成动画和导出视频,其实原理差不多,就是每一帧画面,都是根据所在时间坐标算出来的,就像一个函数 f(t),你传入给动画引擎任意一个时间点 t,它能直接算出那一瞬间屏幕上每个元素的位置、透明度、大小,所有视觉状态完全由 t 决定。不需要从头播放到那个时刻,也不需要记住之前发生了什么。 传统写动画的方式是命令式的:到了某个时刻,去改某个元素的位置,把透明度调一下。状态散落在各处,时间一乱画面就乱。这套引擎反过来,用的是声明式思路:你不去驱动元素运动,只描述在第 t 秒,每个元素应该长什么样。 打个比方,传统动画像看电影,你必须从头看才知道第 30 分钟画面是什么。这套引擎更像一本特殊的书,翻到任意一页,画面都是完整的、确定的。 这个设计带来了三个能力: 1. 拖动播放条跳到任意位置可以,因为 f(t) 随时能算; 2. 反复调试同一个画面可以,因为同一个 t 永远产出同一帧; 3. 把动画导出成视频也可以,而且方式很巧妙。 那么导出视频是怎么实现的呢? 直觉上,把浏览器里的动画变成 MP4,录个屏不就行了? 录屏是实时的。机器稍微一卡就掉帧,拍出来的视频不可复现。而且播放条、黑色背景、圆角阴影这些"播放器外壳"会一起被录进去。 baoyu-design 用的方法更像定格动画的拍摄:启动一个无头浏览器(没有界面的 Chromium),加载动画页面,通过引擎预留的一个控制接口精确操控时间轴。每设定一个时间点,等浏览器把画面渲染完成,截一张图,通过管道直接喂给 ffmpeg 编码。一段 95 秒、30fps 的动画就是 2850 次"摆好时间,拍照"的循环。慢,但每一帧都是精确的,绝不掉帧。 这里有个容易忽略的细节:设定时间后,工具会等两帧 requestAnimationFrame 再截图。因为修改时间只是改了 React 状态,浏览器还需要一到两帧才能把新画面真正画到屏幕上。等少了,截到的可能是上一帧的残影。 为了让画面更锐利,截图时用 2 倍设备像素比渲染,实际按 3840×2160 出图,最后由 ffmpeg 缩回 1080p。原理和高分辨率印刷一样:先在更大的画布上精细绘制,再高质量缩小,文字边缘和细线会明显更清晰。 baoyu-design 在 GitHub 开源(MIT 协议),目前 1.2K star。感兴趣的可以去看看它的 skills/baoyu-design 目录,动画引擎的完整实现都在里面。

宝玉

179,091 Aufrufe • vor 2 Monaten

无意发现了网易一个不错的产品 LobsterAI,一个 7×24 小时帮你干活的全场景个人 Agent。另外,它今天正式宣布开源了。 安装好后在 Telegram 里配了机器人,刚好出门,就全程用手机远程让它去读我电脑上的「潮流周刊」代码仓库,只抓 2025 年的所有内容,目标也明确,帮我挑出年度最推荐的 20 个好东西。 原本以为它会随便扫一遍凑名单,结果它真的一篇篇读完了,挑得很克制,像是在做编辑。最后给出来的 Top 20 挺符合我的心意,甚至还把 Mole、Pake、妙言这些我一直在维护的项目也选进去了,顺带写了段鼓励,莫名有点感动。 用完之后大概明白它为什么能做到这种程度:它有一套跨会话的持久化记忆系统,记住了我的偏好。底层是本地优先的设计,能真正在你机器上执行操作,不只是云端对话完就算了,延迟、隐私、断网这些问题也就自然规避掉了。每一步操作对你完全透明,不是黑盒在跑,随时都有完整的控制权,拿来做整理型的自动化挺合适。 能力也不只是读读写写,做 PPT、定时任务、搜索、调用本地工具……这些都内置了。设置里还能接飞书、钉钉、Telegram、Discord,也能走邮箱,开箱即用。 视频里把从配置到生成 Top 20 的整个过程都录下来了,有兴趣可以看看。它已经开源,大家完全可以玩起来,把那些重复性的、枯燥的工作统统交给它。很期待小龙虾越做越好吃。

Tw93

79,550 Aufrufe • vor 6 Monaten