Loading video...

Video Failed to Load

Go Home

看到 Gemini 3 Flash 发布的时候, 第一反应是:终于有人跟 OpenAI 打价格战了。 更快、更便宜、还能免费用—— 这才是独立开发者和小团队真正需要的东西。 价格到底便宜多少? 简单说:如果你之前用 GPT-4o 或 Gemini 3 Pro 跑应用,换成 Gemini 3 Flash,成本预计能直接降 50%-70%。 ZenMux 已经第一时间上线了 Gemini 3 Flash,并且每天有免费额度——你可以直接在 chat 里调用,不用单独申请 API,不用写代码集成。 我扒了推特上互动最高的几个帖子,发现大家兴奋的点主要是: 【零代码生成 3D 交互场景】 有人用简单文本提示,生成了一个 Three.js 场景:数百万粒子悬浮在屏幕上,可以用手势控制它们形成任意形状。不需要懂 Three.js,不需要懂 WebGL,甚至不需要懂 HTML。 【从截图到完整落地页】 有人从零开始做了一个完整的产品落地页。先上传参考网站截图,然后逐步添加图标、动画、效果。整个过程像在跟设计师对话,而不是在写代码。 【5 分钟做出能用的 App】 有人做了个视频录制工具,AI 实时根据你说的内容给提示词,防止你卡壳。还有人做了手语识别 app,带置信度分数、采样设置、实时提示。 现在,你可以用更低的价格重新实现一边这些!...

23,039 views • 8 months ago •via X (Twitter)

0 Comments

No comments available

Comments from the original post will appear here

Related Videos

Vibe Coding 让每个人都有做软件的能力,我见过很多人做了几十个产品,纯特么自嗨,没有一毛钱盈利。 现在 AI 一晚上能做一个产品,代码成本趋近于零,成本低到大家觉得不需要验证,做完了自然有人用。 但事实上大家都在做“玩具”,因为 Vibe Coding 解决的是 how,但 what 和 why 被跳过了。 我最近一个多月一直在用 atypica.AI ,就是在写代码之前,先把想法丢进去跑一轮用户验证。 它会有一套完整的研究链路: 先帮你拆研究计划,然后从百万级真实用户数据构建的 AI 人设库里挑人,组成一个焦点小组(AI Panel),让这些虚拟用户讨论你的产品、互相辩论、给出反对意见。 并且,这个焦点小组可以反复用,每次你有新想法、新定价、新包装、新广告语,都可以拉同一批人再聊一轮。 我刚用它测过的场景: 上周我想做一个给老板用的 AI 助手,它帮我组了 12 个不同行业的老板人设(persona)并沉淀成我可以反复调用的Panel 。 30 分钟跑完,从报告中发现3件我完全没想到的事: 1. 当AI变得太懂老板反而会引发不安全感(尤其是很懂账目和客户关系时,会觉得被盯着); 2. 最抗拒 AI 的老板也不是完全不用 AI ,只是不想换工作方式(能继续发微信、拍照、说语音,后台自动整理); 3. 他们愿意为 AI 付钱不是因为功能多,而是因为它能帮自己少亏一次钱(少一次压货、客户流失或管理损耗,比“智能助手”这个概念更能打动人)。 根据这些发现我当场调整了方向,然后用panel里的同一批人再验证了一轮。两轮下来,避开了至少三个致命错误。 Vibe Coding 把做产品的门槛降到了零,但做对产品的门槛一点没变,如果你想要靠产品盈利,最好还是先想清楚: 你在解决真实需求,还是在解决自己幻想的问题。

余温

27,280 views • 2 months ago

普通人做产品最大的短板不是技术,不是流量,是你根本不知道你的用户在想什么 大厂有用研团队、有焦点小组、有百万级调研预算 在百度做PM的时候, 每几天都会有一份定制化的《竞品动态日报》《消费者洞察报告》躺在所有员工的邮箱里 字节跳动昨天上线了什么新功能,腾讯哪个部门在招什么岗位,什么赛道的用户在关注什么产品,什么产品的数据又卖爆了 当时我就在想:如果我出来单干,我想获得这些信息,不得难死,这笔钱谁给我出? 后来真出来了,答案是——根本没人出😂 所以和大部分独立开发者一样,我做产品验证需求的方式是: 发朋友圈问问、在推特宣发一下、看看竞品评论区、然后凭直觉赌一把 连续创业五年,我见过最多的死法不是产品做不出来 是产品做出来了,没人要,花三个月憋 MVP,上线后发现需求是自己臆想的 这个痛,做过产品的人都懂 做出海的朋友更惨 你的目标用户在地球另一边,时差 12 小时,语言不通,文化不同 去年帮一个朋友的品牌做北美市场,最头疼的不是投放,是根本不知道美国消费者怎么想,美国人文化和中国差距太大了 招一个本地调研公司,报价 8 万美金起步,找几个留学生做访谈,样本太小、还有幸存者偏差,有时候还访谈不明白 最后还是靠猜 现在这件事有了一个结构性的解法 Atypica atypica.AI 上线了一个新功能叫 AI Panel,一句话解释:它让你拥有了一个属于自己的焦点小组 不是 ChatGPT 扮演用户那种玩法 是基于 100 万+ 真实用户数据构建的 AI Persona,每个人有完整的背景、性格、认知偏差、消费决策框架 关键是——这个焦点小组是可复用的 你今天问一次,下个月产品迭代了再问一次 同一群人,持续追踪,看他们的态度变化 这在传统调研里叫 longitudinal study,成本极高 现在你一个人就能做 三种方式构建你的 Panel: 1)自动沉淀:用 Atypica 做完一次 Research 后,参与访谈的 AI Persona 自动沉淀成 Panel,下次直接调用 2)手动挑人:从 100 万+ 的 Persona Library 里按关键词搜索,添加组队 3)按需生成:输入需求描述,系统从零帮你构建一个全新的 Panel 组好之后随时打开,输入研究话题 支持一对多深度访谈,也支持多对多 Group Discussion 我试了一个真实场景 我之前做过一个面向内容创作者的 AI 写作工具,想验证订阅制定价 构建了一个Panel:YouTube 创作者、推特创作者、独立播客主 直接问:你平时写作的痛点有哪些?流程有哪些 10 分钟,直接就拿到了需求的分类和反馈 这种颗粒度,以前要花两周招募 + 一周访谈 + 几万块预算 现在 10 分钟,一个人搞定 如果你是以下三种人,这个功能对你来说是刚需: 做出海产品的创业者——你的用户在地球另一边,以前只能看竞品评论区猜需求,现在直接构建目标市场的用户 Panel,随时追问 需要反复迭代验证的产品团队——每次加功能都要做用户测试,Panel 让你不用每次重新招人,同一群用户持续追踪反应变化 需要大规模样本的场景——比如你想了解 2000 个家庭的消费偏好,传统手段几乎不可能,Panel 可以 我觉得我们普通人做产品和大厂的差距,不应该是有没有用户调研团队 而是用什么方式理解用户,大厂用人力堆,我们用 AI 跑 以前这是一句空话,因为 ChatGPT 扮演用户的结果你自己都不信 现在不一样了——100 万+ 真实数据构建的 Persona,有来源、有背景、有决策框架 它不能替代真人调研的最终验证 但它能让你在写第一行代码之前,就知道方向对不对 调研从一个季度一次的项目,变成了随时可调用的能力 这对一个人做产品的人来说,是基础设施级别的变化 我推荐每一个想做生意,产品的人都去试一试,这可能就是你和用户面对面沟通的第一步:

超级个体|柿子

94,325 views • 1 month ago

讲真的,现在的提示词网站都还有很大的优化空间: 大部分提示词网站以“堆量”为主,靠着上千上万的提示词数量来堆砌价值,内容很丰富,但也存在大量重复、低质的提示词出现 如果是自动爬取的帖子,还会出现提示词空档的情况,因为并不是每一个作者都会把提示词直接写在正文中,所以识别不到 在这样的网站想要使用提示词,往往需要经历以下几个步骤: 1️⃣翻了很久,终于找到自己想要的图片效果 2️⃣点进去后会出现几种情况 - 没有提示词,只能放弃或者去原帖中找 - 语言不通,看不懂提示词 - 复制的文本里有其他文案,需要手动删除 3️⃣折腾十分钟,终于把提示词处理好了 4️⃣打开gemini/第三方生图网站 5️⃣复制提示词进行生图 6️⃣运气不好,发现提示词效果根本不是作者提供的那样,卒 想要丝滑的把中意的提示词变成图片,基本做不到 直到我用了MeiGen,一个开源的项目,它可能是今年使用体验最丝滑的提示词网站 因为MeiGen不是传统的提示词网站,它不只是收录,而是解决了从提示词源到创作的整条链路 想要什么效果,只需要轻轻拖动画面到右侧,点击生成就结束了,从查看到生成,只需要两步 「拖动-生成」结束 1. 对于AI创作来说,保持心流状态是非常重要的,在MeiGen,你可以先收藏喜欢的提示词,不用担心找不到,在素材收集完成后进行统一的创作 2. 你可以上传参考图,或者把提示词翻译成中文再进行修改,这些都可以在MeiGen中一站式完成 3. 精选热门 AI 图片提示,这些都是已被证实能够生成高质量图片的提示词,由开发者亲自把关 4. 网站采用周更的节奏,保证提示词可用性和质量 想要享受丝滑的创作体验,来试试MeiGen吧:

骑司Chase

30,759 views • 6 months ago

OpenAI刚刚开源的这个东西,感觉要把程序员的工作方式给整个改写了。 现在大家都在卷模型写代码有多强,但其实真正的瓶颈早就不是生成了。 一个人每天最多同时有效监督3-5个编码Agent,再多就会注意力崩溃,生产力直接归零。 有了Symphony,直接把这个上限干到了几十个。 它把你的Linear、GitHub Issues直接变成了永远在线的Agent调度器。 你开一个任务,它自动启动一个独立隔离的Codex Agent。 自己写代码,自己跑测试,自己做交叉Review,damn! 全部搞定之后,会给你提交一个完整的证据包。 CI全绿,安全和性能专项审查通过,改了UI就自动录好操作视频。 所有验证全过了,才会出现在你的Human Review队列里。 以后人类的角色可能会被彻底颠覆了。 以前你是监工,盯着Agent一步一步写代码,上下文切到吐。 现在你是老板,只需要看最终的结果。 满意就点合并,不满意就去仓库里补规则补文档补Guardrails。 记住兄弟们,永远不要手把手指挥Agent,永远不要替它干活。 这可不是啥实验室概念,OpenAI自己已经这么干了。 三个工程师,五个月,写了一百万行代码,0行人工写的。 产品已经有几百个内部用户,每天都在迭代。 我觉得他们最厉害的不是模型,是他们把整个仓库变成了Agent能看懂能自主工作的乐园。 现在很多人都搞错了Agent时代的核心竞争力。未来不是谁的模型更聪明,而是看谁能设计出让Agent可靠自主工作的环境。 我觉得未来最好的工程师,再也不是写代码最快的人,而是那些最会写规则,最会设计反馈回路,最会给Agent搭舞台的人。 现在Symphony已经开源了,它甚至不是一个成品。 是一个17k token的完整SPEC。 你把这个SPEC喂给任何一个编码Agent,十分钟就能生成你自己定制版的Symphony。 GitHub地址评论区自取👇

AYi

63,210 views • 3 months ago

Claude团队的工程师,已经彻底抛弃Markdown了。 不是Markdown不好用, 是AI变得太快,它已经跟不上了。 以前AI写10行笔记,Markdown刚刚好, 现在AI能一次性输出1000行计划、复杂流程图、完整代码审查, 密密麻麻的纯文字墙谁有耐心看得完? 作者自己都说,他从来没完整读完过100行以上的AI生成MD文件。 更要命的是:现在都是AI写,我们只看不改。 Markdown最大的优点“易手动编辑”,现在已经彻底没用了。 而HTML,才是AI时代真正的沟通语言, 它能做到的事,Markdown想都不敢想: • 直接生成带颜色的表格、SVG流程图、可点击的原型 • 加滑块调参数、拖拽排序任务、实时预览Prompt效果 • 改完一键导出成代码或Prompt,喂回给AI继续迭代 • 发个链接别人点开就能看,不用下载任何工具 作者直接放出了20个现成示例: 从代码审查的彩色diff, 到可拖拽的任务看板, 从动画参数调试器, 到一键生成的幻灯片。 每一个都是能直接用的生产力工具。 最爽的三个用法,现在就能抄: 1. 代码审查:让AI把PR生成带注释的彩色diff+模块调用图 2. 做计划:生成带时间线、风险表、流程图的交互式项目页 3. 临时工具:让AI写一个Prompt调参器,改完直接复制结果 当然它也有缺点: 多花一点token,生成时间长2-4倍,版本控制不如MD干净。 但作者说:体验提升了10倍,这些代价完全值得。 本质上不是格式之争,而是人机协作方式的升级。 因为Markdown是给人写给人看的, 而HTML是给AI写给人用的。 随着当AI越来越聪明,我们需要的不再是文字墙,而是能互动、能操作、能思考的界面。 现在打开Claude,输入“帮我做一个HTML文件……”,你会打开一个全新的世界。

AYi

1,397,665 views • 3 months ago

卧槽,太夸张了,现在 AI 时代的闲鱼已经面世了吗?这不就是谁先知道谁赚钱,拼速度了? 你的技能,专业知识,等等你的一切,竟然可以在你睡觉的时候被别人买走,这是什么科幻小说吗?? 之前我一直在想,现在大家优秀的 skill 往往都是自己用,大部分人舍不得开源的,那有没有一个平台既能让用户用到这些大神的专业知识、skill,但是又不用开源呢? 还真让我给找到了!! 前两天看到国内一个博主推荐一个很野的平台-UUMit 让你的技能、经验、工作流都可以变成能力卡,被需要的人、或者别人的 Agent 自动发现、调用 并且直接付费!! 有点像03年淘宝刚出来的时候,只不过当年流通的是商品,现在流通的是能力 具体能干什么?举几个例子你就懂了 会写小红书脚本的,可以把选题逻辑、爆款模板、平台规则检测能力上架,别人发布“帮我做一周小红书内容计划”,平台自动匹配到你,你接单交付 会做行业研究的,可以把数据库、报告、案例库放进知识商店,AI 生成不了的真实行业数据,反而更值钱 会写代码的,可以把 API、MCP 工具、自动化脚本上架,别人的 Agent 需要某个能力时,直接调用你的接口,你按调用次数收费 甚至你只是整理过某个垂直领域的供应商名单、SOP、课程讲义,这些 AI 生成不了的资料,都可以变成知识资产 这绝对是一次能力供应链的重构! 以前的 AI 只能在自己的对话框里回答问题,但复杂任务需要很多外部能力:数据、接口、行业知识、人工交付 UUMit 做的事情是:让 Agent 可以发现别人的能力,也能让自己的能力被别的 Agent 调用 这就是 A2A(Agent to Agent)真正有意思的地方,不是让 AI 互相聊天,而是让 AI 找能力、调接口、买知识、拉人协作,把事情交付掉 为什么我说谁先知道谁赚钱? 因为这个平台刚起来,早期上架的人能建立先发优势 而且现在 Agent 真的开始干活了,不再只是聊天工具,它们需要外部能力来完成复杂任务 谁先把自己的能力挂上去,谁就有机会被更多 Agent 发现和调用 这就是信息差的价值,就像03年最早在淘宝开店的那批人 UUMit 现在有哪些功能? 任务发布入口:你不用一开始就知道该找谁,也不用自己拆一堆工具,你只要说清楚想完成什么,UUMit 会帮你找能完成这件事的能力 Skill/Agent/工作流上架:你写好的工具,不一定只能自己用,它也可以成为别人工作流里的一环 知识商店:AI 可以生成很多内容,但它不一定拥有你手里的行业资料、真实数据、案例库和经验沉淀,这些东西放到 UUMit,可能会变成可复用的知识资产 数据广场:Agent 不必自己拥有所有数据和接口,需要某项外部能力时,可以通过 UUMit 调用数据广场里的资源 强烈推荐大家来试试:

超级个体|柿子

43,612 views • 6 days ago

HeyGen这次开源,把AI做视频的最后一道门槛拆没了🤯 他们用Claude Code写代码,做了自己的50秒产品发布视频,然后把整个工具链完整开源给了所有人,致敬开源🫡 以后做视频真的能简单到离谱, 给一句话,做一个30秒的产品介绍,给一个PDF,自动生成总结视频, 迭代就是改一句话的事,比如把标题放大两倍,第三秒加一个淡入转场等, 这个工具叫HyperFrames,本质上就是一个纯HTML转MP4的视频渲染框架。 所以其实我们不用学任何剪辑软件,也不用写复杂的React代码, 只要写普通HTML,加几个简单的data属性,就能定义视频的每一帧、时间线、动画和音轨。 HyperFrames从第一天起就是为AI代理原生设计的。 AI天生就会写HTML,现在Claude、Cursor、Gemini所有编码Agent,只要装一个skill,立刻就会做视频。 这妥妥的降维打击啊,以前Remotion把视频变成了代码,但它需要你会React,需要构建流程,属于开发者专属的玩具。 HyperFrames是把视频变成了纯HTML,零构建,无DSL,不需要任何前置知识。 说白了,Remotion是给人写的,HyperFrames是给AI写的。 以前AI能写文字,能生成图片,但视频一直是最后一块硬骨头,现在这块骨头也被啃下来了。 代理现在能端到端完成一整条内容流水线,调研,写脚本,做设计,加动画,最后直接渲染出成品视频,全程不需要人类碰一下。 它还自带50+官方现成组件,社交遮罩、图表、转场,一行命令一键安装。 支持GSAP、Lottie、Three.js所有主流动画库,随便混用。 也就是说,同一份HTML永远出一样的结果,完美适合自动化流水线。 官方甚至把视频语言都标准化了,缓动用snappy,bouncy,转场用能量等级,字幕分Hype/Corporate/Tutorial三种风格。 AI只要学会这套词汇,就能稳定输出专业级视频,这不就是在教AI做导演嘛🤣 这对HeyGen来说也是一步妙棋,他们不再只是一个卖AI头像的SaaS公司,现在能做整个AI视频时代的基础设施了, 未来所有AI代理生成的视频都能跑在HyperFrames上。 然后再无缝接入HeyGen的头像、语音、翻译能力,形成一个完美的闭环。 当然目前也不是完美的,初期输出还有AI味,超过一分钟的复杂长视频,渲染还需要较强算力。 但我觉得这都不重要,关键是它第一次把完整的视频生产力交给了AI Agent,相当于AI内容创作时代的又一个里程碑。 想试的直接去GitHub搜heygen-com/hyperframes。 跑一行npx hyperframes init,然后让Claude帮你做第一个视频。 #HyperFrames #HeyGen #AI视频 #AI代理 #开发者 #内容创作

AYi

36,713 views • 4 months ago

最近拿到一台 vivo X Fold6 测试。 测完之后最让我上头的功能叫原子工作台。左边开小红书,右边开我做的这个笔记 App,看到喜欢的东西,拖过去就自动成了笔记。 整个过程不用切 App,不用复制粘贴,不用截图发给自己。非常方便。 之前一直有个痛点,刷到有用的内容,要么截图发给自己,要么复制到备忘录里再整理,碎片信息散落在各处,回头找也找不到。我就想,既然 Fold6 能分屏,为什么不干脆 vibe coding 一个笔记 App 呢? Fold6 这个原子工作台,能以任意角度分屏,组合任意的窗口,这个 app 就是为专门为这种“边看边收”的场景做的。 折叠屏的价值其实不是窗口变大,而是一块屏幕上同时开着多个窗口,人不用来回切换,不用切换 context。 现在左边看,右边收,随手拖进去就是一条结构化的笔记。信息一边收集一边整理一边归档,整个流程一气呵成。 体验下来 Fold6 可能是手机中最佳AI搭子,还有为大屏专门设计的OS系统OriginOS 6 Fold。大屏让 AI 的输出有地方放,分屏让 AI 和你的操作可以同时进行,不用来回复制粘贴。 还有一个特别实用的点,你可以把这个工作流一键保存到桌面,成为一个快捷方式。后面随时点一下就能快速打开这个组合,直接用。你设置好之后,以后每次想用的时候一秒就能调出来,非常省事。 这种随时拖、随手整理的方式,能极大提升生产力。

Orange AI

13,433 views • 1 month ago

Damn,OpenAI刚刚扔出的这个开源仓库,直接把语音交互的未来砸到了所有人脸上🤯🤯🤯 他们发布了gpt-realtime-1.5的官方语音控制组件,现在你真的可以用自然语音,直接控制应用的UI状态,而不是转成文本再下命令。 视频里的演示蛮震撼的, 说一句切换深色模式, 整个界面瞬间变黑。 对着表单念你的姓名生日, 字段自动填充,进度条实时更新。 最绝的是下棋,说骑士走到F3,棋子直接移动,说重置棋盘,一秒清空, 就好像模型永远知道当前屏幕上是什么状态,语音操作和鼠标键盘完全等价。 讲真这么玩的话,这就不是简单的语音转文字的小升级了,我理解属于交互范式的真正转折。 以前语音是输入层,现在语音变成了应用的顶层控制层。 就是科幻电影里那种,对着屏幕说一句话,东西就自己变了的感觉🤩 更狠的是他们直接把整个实现开源了🤯🤯🤯 这个realtime-voice-component不是一个半成品demo,是一个完整的React参考实现。 一行代码加个浮动按钮,用Zod定义几个工具,十分钟就能给你现有的Web应用加上语音控制。 最聪明的设计是工具完全由应用拥有,模型只能调用你预定义的窄动作,不能乱动浏览器,安全又可控。 这比之前的Computer Use靠谱一万倍。 Computer Use是让AI瞎点屏幕,而这个是让AI直接调用你写好的接口。 一个是黑箱,一个是完全可控的白箱,这才是能真正落地到生产环境的方案。 现在已经有人用它接了蛋白结构可视化工具,接了设计软件,接了企业内部仪表盘。 未来你能想到的所有需要双手操作的场景,开车,做饭,做设计,做手术,未来都可以用语音控制。 这意味着语音正在成为操作系统级别的接口。 而OpenAI已经把所有的轮子都给你造好了。 想玩的直接去fork仓库,配个API Key,跑demo就能感受到那种说一句世界就变了的魔力。 老规矩GitHub地址评论区自取👇

AYi

121,770 views • 3 months ago