Loading video...

Video Failed to Load

Go Home

AI 设计最烦的一点就是做出来很漂亮,甲方一句“产品换一下、细节调整”,基本又得重来。 我这次拿蚂蚁百灵刚开源的 Ming-Image-0.1-Design + Design-Layer 跑了一遍完整工作流。整个过程就三步,直接解锁了从创作到成品的全流程。 第一步,做海报。 直接用中文 Prompt 让 Design 做一张冷萃咖啡产品海报。 我故意塞了主标题、副标题、产品主体、3 个卖点卡、标签和底部 slogan。因为这种图特别容易暴露设计模型的问题:字写错、层级乱、卡片崩一个,整张图都不好用。 结果第一版就挺稳。中文基本没崩,标题、产品、卖点几个区域也很清楚,已经有正常商业海报的完成度。 第二步,分解图层。 接着我把这张刚生成的海报丢给 Ming-Image-0.1-Design-Layer。 一开始在 Playground 里只拿到一层,后来我直接走 API,一次完整拆出了 4 个 RGBA 图层: 标题文案 / 产品主体 / 卖点信息 / 背景装饰 这一步才是我觉得这次发布最有意思的地方。 一张原本已经焊死的 PNG,被重新拆成了可以单独操作的设计素材。 比如品牌方临时说“产品换新品,其他版式别动”,现在可以把产品层单独换掉,卖点和背景继续保留。 第三步,进一步编辑调整。我又把这 4 个图层丢进 Canva 重新叠加,基本可以还原原图。产品、卖点和背景都能继续单独移动、隐藏或者替换。 当然也有边界:Layer 拆出来的文字还是图片,不会自动变成 Canva 里的文字框,所以改字还是需要重新输入。 但对于换产品、换背景、移动元素、同版式二创这类需求,已经很实用了。...

21,841 views • 7 days ago •via X (Twitter)

37 Comments

睿奇Re7's profile picture
睿奇Re77 days ago

Ming-Image-0.1-Design这个效果是有点厉害了

恒星sun's profile picture
恒星sun7 days ago

中文海报最怕标题和卖点字崩掉,这次看着能稳稳排出来确实挺惊喜

Adam也叫吉米's profile picture
Adam也叫吉米7 days ago

确实还是挺稳的,文字图片都没有错误一次搞定

恒星sun's profile picture
恒星sun7 days ago

确实,能一次搞定太舒服了

林雪's profile picture
林雪7 days ago

这个挺实用的。以前AI出图好看是好看,客户一说换个产品或者挪个位置,基本就得整张重跑。现在能拆成标题、产品、卖点和背景四层,丢进Canva里单独换,省事多了。文字还是图片、得自己重打,但换产品、调版式这类需求已经够用了

晚晚's profile picture
晚晚6 days ago

最怕改个小细节,旁边没让改的也跟着变了

王二狗's profile picture
王二狗7 days ago

中文卖点没崩就已经少见了,再能把产品层单独拆出来,甲方临时换瓶确实不用整张重做。

Adam也叫吉米's profile picture
Adam也叫吉米7 days ago

没错不用整张重修

无双-明灯 🎒's profile picture
无双-明灯 🎒7 days ago

以前作图交付之后,客户要改个字、挪个人,基本等于重做一遍,现在有这种产品来完成,能省下不少事情

Adam也叫吉米's profile picture
Adam也叫吉米7 days ago

对于这种简单的改动,直接拆解图层再改就方便很多

无好即好's profile picture
无好即好6 days ago

这套工作流最有价值的地方,不只是把海报做出来。 而是做完以后还能继续拆、继续改、继续复用。以前很多 AI 设计停在“生成一张图”,这次开始往真正可编辑、可延续的设计流程走了。

懒家伙's profile picture
懒家伙7 days ago

产品一换就整张重来的痛点太真实了 现在能单独换产品层 这一下实用价值就出来了

Adam也叫吉米's profile picture
Adam也叫吉米7 days ago

拆解图层之后可以直接编辑,这个方便太多了

Jevon | AI企业级布局's profile picture
Jevon | AI企业级布局7 days ago

AI 工作流简直是最好的一块了! Skill 加上我们一些非常好的 idea,是蚂蚁百灵最强的区域。

Adam也叫吉米's profile picture
Adam也叫吉米7 days ago

百灵在模型细化场景这块儿确实不错

硅谷AI玩家's profile picture
硅谷AI玩家7 days ago

AI出海报中文这么稳,还能直接拆成独立图层,产品想换就换、背景随便调,甲方再提修改也不用从头再来了,Ming这套工作流直接能打商用~

Adam也叫吉米's profile picture
Adam也叫吉米7 days ago

是啊很符合商业场景下的工作流

阿链's profile picture
阿链7 days ago

拆图层这步比出图本身更有用👍。以前好看归好看,产品一换整张作废。现在能单独动产品层,版式先留着,才像在改稿,不像重新抽一张。

Adam也叫吉米's profile picture
Adam也叫吉米7 days ago

没错,改稿比直接生成更像真实的工作流

皮皮佳's profile picture
皮皮佳7 days ago

以前蚂蚁百灵开源的文本大模型作为备用模型还是不错的,这次出了图片模型也拿来备用试试看。

Adam也叫吉米's profile picture
Adam也叫吉米7 days ago

蚂蚁家确实一直都很高产

Eric's profile picture
Eric7 days ago

做电子制造类产品宣传图,生成的图标、商品素材边缘干净,不用二次修边。

Adam也叫吉米's profile picture
Adam也叫吉米7 days ago

对,省心很多,不用反复去修

知不道吧's profile picture
知不道吧7 days ago

这个 Ming-Image 案例吸引我的是能保留已经满意的部分。海报拆成四层,再进 Canva 调整,换产品时就有机会留下原来的文案和版式。

Adam也叫吉米's profile picture
Adam也叫吉米7 days ago

对,直接更换产品,整个风格都可以保留

Mr Paper's profile picture
Mr Paper7 days ago

原来是这样做出来的,厉害

一飞冲天's profile picture
一飞冲天6 days ago

我只能说你这切入点真的很对

恒星sun's profile picture
恒星sun7 days ago

能把背景装饰单独拆出来,之后换个场景继续用,这种素材复用还蛮实在的

Wukong's profile picture
Wukong7 days ago

这个分层局部替换的功能很实用,以前甲方改个小细节就要全盘推翻,现在直接改对应图层,改起来省时省力。

Adam也叫吉米's profile picture
Adam也叫吉米7 days ago

第一步-生成咖啡产品海报的Design Prompt: 请设计一张精品冷萃咖啡产品宣传海报。 产品名称:深夜冷萃 主标题:醒一点,也松一点 副标题:12 小时慢萃,清爽不苦涩 画面中央放置一瓶透明玻璃瓶装冷萃咖啡,瓶身标签清晰显示「深夜冷萃」。 海报包含三个卖点信息卡:12 小时慢萃、低糖轻负担、阿拉比卡咖啡豆。 右侧加入一个圆形标签:冰爽推荐。 底部加入一句小字:把清醒留给喜欢的事。 整体采用高级商业广告风格,深棕色与奶油米白为主要色调,产品主体突出,排版简洁,有明显视觉层级。 所有中文文字必须清晰、准确、可读,不要乱码。

Adam也叫吉米's profile picture
Adam也叫吉米7 days ago

第二步-将产品海报拆解成图层的Layer Prompt: 请将这张冷萃咖啡产品海报拆分为 4 个独立透明 RGBA 图层: Layer 1:标题文案层 Layer 2:产品主体层 Layer 3:卖点信息与标签层 Layer 4:背景与装饰层 每个图层保留透明背景和完整 Alpha 通道,不同语义元素尽量不要互相粘连,所有图层重新叠加后尽量还原原始海报。

Adam也叫吉米's profile picture
Adam也叫吉米7 days ago

这次的模型Ming-Image-0.1-Design和Ming-Image-0.1-Design-Layer在 OpenRouter 开放为期两周的免费 API 调用,可以试试: 另外开源了两个skill,可以直接生成前端页面或可编辑 PPT,打通整个工作流: Design Skill PPT Skill

海洋馆馆长's profile picture
海洋馆馆长7 days ago

产品一换整张重来,这个烦法太熟了。能把产品层单独抠出来换,版式不动,算是对上了。

烁皓's profile picture
烁皓6 days ago

印象中 Canva 有个智能图层的功能可以直接分层图片

Adam也叫吉米's profile picture
Adam也叫吉米6 days ago

这种那就更方便了

恒星sun's profile picture
恒星sun7 days ago

6B 权重也能下载到本地跑,这点挺吸引人,设计模型不只是在网页里试试看了

毅行出海's profile picture
毅行出海6 days ago

能分层改才是真救命啊,甲方可不会因为图漂亮就少改两轮。 文字要是也能变成可编辑的,这工作流就更香了。

Related Videos

我们改自己的设计稿时,最烦的往往不是画不出来,是画完不能改。 字要换,人要挪,背景要换,进设计软件之前还得拆层。设计师拿到一张成图,光拆层经常就要 5 分钟以上。做小应用也一样:以前要等整个应用生成完,才看得到页面长什么样。 两边是同一个问题。AI 不该停在「能生成一张图」,还得让人提前看见、接着改、最后交得出去。 今天百灵开源了 Ming-Image-0.1-Design。两个模型,都是 6B。一个负责画,一个负责拆。 Design 负责画。你用大白话说要什么,它直接出 UI、信息图、海报和整页设计。标题、按钮、卡片、配色、布局一次画完,不用背景、插画、装饰各出一张再硬拼。人物、商品、图标也可以直接出透明底。 Layer 负责拆。它不是普通抠图。一张设计图会被拆成 2 到 9 层可以单独改的透明图层:文字、主体、背景、装饰分开。被挡住的地方会补上,叠回去要尽量还是原来那张图。 这两个已经接到真实流程里了。 灵光闪应用里,设计预览被提前到一开始。先看到布局和风格,再写代码,最后的页面尽量跟预览一致。这块还在内测,很快会开放。 画眉是蚂蚁内部的设计工具。第一次拿到可编辑图层,从 5 分钟以上降到大约 40 秒。如果只是改几个字,以前用 GPT-image2,成本大概是现在的 7 倍。改完可以继续动图层,也能导出 PSD。 另外开源了两个 Skill,把图继续交到网页和 PPT 里。 Design Skill:说一句话,大约 15 秒先看到整页方案。方向对了,再拆素材、写代码。也可以丢进一张设计稿,生成能跑的前端页面,再用截图跟原图对一下。以前往往要等 5 分钟,才第一次看到页面。 PPT Skill:一张设计图转成 PPT 里能改的文字、色块和图。图标和插画从原图里提出来用,不用重新画。文案、字体、配色、布局都能继续改。 现在可以试: OpenRouter 两个模型有两周免费 API Hugging Face 魔搭 Design Skill PPT Skill

程序员端哥

13,338 views • 6 days ago

伙伴们,国庆假期玩的开森了嘛 就在刚刚,我刷到一个 6B 的国产开源模型,感觉它给图片精修提供了一个完全不同的思路。 它所在的 Ming-Image-0.1-Design 系列,一出来就在 AA 的 UI/UX Design 开源评测里冲到了第一梯队。 但真正让我感兴趣的,不是它直接生成图片。而是:它能拆图。 从之前的香蕉,到现在的 GPT Image 2.0、2.5,我自己用下来最头疼的一件事一直都是:局部编辑。 比如一张封面图,我明明只想改一个标题、一个人物或者一个按钮,结果模型经常把周围的东西也一起改了。 有时候来回对话好几个回合,都不一定能改到我想要的位置。 🔥 但 Ming-Image-0.1-Design-Layer 换了一个思路。 它可以把一张已经做好的设计稿,直接拆成多个独立的 RGBA 图层(带透明背景的独立图层图片): 背景是背景, 文字是文字, 人物是人物, Logo、装饰、组件也可以分别拆出来。 然后事情就开始有意思了。 以前是:整张图丢给 GPT Image → 告诉它“只改这里” → 祈祷它别动其他地方。 现在可以变成:先拆图层 → 找到目标图层 → 单独拿出来找GPT Image 精修 → 再合回去。 真正意义上的定点爆破。 如果这一层里面东西还是太多? 那就继续拆。 二次拆分,再爆破一次。 所以我这两天发现,它和 GPT Image 2.5 搭配起来特别好使: Ming 负责拆分, GPT Image 负责定点修改。 以前很难控制的局部编辑,一下就变成了一个非常清晰的工作流。 不过如果不想折腾本地部署也没关系,OpenRouter 已经可以直接调它的 API,本地写个小工具接进去就能用了,如果自己有机器我下面也会说。 下面先看视频。 我自己已经搞了一个小工具,把: 图片分层 → 单层提取 → 局部编辑 → 重新组合 如果不满意还能继续向下二次拆分图层 这套流程串起来了。 这次主要给大家看看,我是怎么拿它来做图片精修的👇 想要本地部署或者API调用的继续往下看

AI少年

113,906 views • 2 days ago

Phone Harness 最近挺火,它让我第一次很直观地看到,Claude Code 和 Codex 这种 Agent,已经可以通过 iPhone Mirroring 去操作真实 iPhone 里的 App。 但真放到自己的工作流里,我反而更喜欢 Airtap 这种思路。 不是把自己正在用的手机交给 Agent,而是直接发条 iMessage,让另一台云手机替我把活干了。比如做内容时经常会碰到一个很碎的小问题。文章已经写完了,临发布突然发现还缺一张配图。以前我得自己打开 Canva,找版式,改尺寸,换标题,调整字体和布局,最后再导出。每一步都不难,但就是需要人工来做耗时间。这次临发布缺图,我索性把设计要求直接发到了 Airtap Ai 的iMessage号码 +1 (650) 444-9517,让它去 Canva 里把图做出来。 我跟 AI 说的要求也很具体: 打开 Canva,帮我做一张横版配图,主题是 Claude Code vs Cursor vs Windsurf。做成简洁科技风,三栏布局,每个产品放 3 个特点,标题突出,文字不要太多。 接下来它自己在远程手机里打开 Canva,把版式、文字和布局一步步做出来。我觉得这里真正有意思的不是 AI 又会画图了。 而是原来只能停在建议层面的东西,现在可以继续往设计 App 里走。我只需要把主题、内容结构和想要的视觉方向说清楚,剩下那些选版式、排文字、调布局的机械操作,可以直接交给 Airtap。 以后做 AI 产品对比图、模型更新速览、工具推荐卡片、教程封面,其实都是类似的逻辑。内容每次都不一样,但没必要每次都从打开 Canva 开始重新点一遍。而且第一次做完不满意,也不用自己进去改。继续在 iMessage 里告诉它哪里要调整,它就回到 Canva 里接着改。 Phone Harness 更像是让 Agent 获得操作你 iPhone 的能力。 Airtap 对我更实用的一点是:我只负责把设计需求说清楚,真正进 Canva 执行的部分交给另一台云手机。

劳伦斯

120,499 views • 1 month ago

兄弟们,最近试了 Pexo 这款 AI 视频创作工具,可以通过对话,把产品介绍一步步做成视频。 我拿自己那个收录了 2 万多条提示词的网站,做了一条产品宣传片。 下面分享一下,我是怎么把网址和需求交给它,再边看边改,做到现在这版的。 做这种产品视频,最头疼的是素材准备好以后,还得想怎么组织画面、做转场、配音乐,再一点点调整节奏。 这次我把网址和想做产品宣传片的需求交给 Pexo Pexo ,让它先出方案。看完方案,再确认视觉风格、音频方向和创意脚本。 第一版出来以后,我又接着提了几轮修改,调整画面展示、转场和文字。 整个过程都在同一个对话里推进,看一版效果,再告诉它哪里需要改,最后才有了现在这版,我挺满意的。 它不是那种一句话直接生成的魔法,现在这种边看边聊、边聊边改的方式,确实比我在剪辑软件里调轻松不少。 当然,也内置了很多模版,如果跟需求匹配的话,使用模版一键成片那就很方便了。 另外一个很棒的事:这次用到了 Motion 动效,我觉得挺适合做产品宣传。图片可以放大,让人看清产品细节,讲到哪个卖点,对应的文字就跟着出现。手头的图片和产品介绍,就这样变成了一条视频,让观众跟着看懂产品能做什么。 现在的AI做视频,有点东西了。 评论区有福利哦!

松果先森

106,628 views • 18 days ago

久等啦,创作者神器Viko终于上线!🥳( 前段时间我随手发过一个 Viko 的 demo视频,就那么一个很糙的版本,结果评论区和私信隔三差五就有人来问,什么时候能用,什么时候上线。 因为对我自己也是刚需,于是闭关爆肝了一个多月,终于来啦~ 它最开始,其实只是我给自己做的一个小工具。 我每天都会刷 Pin和各种作品站找灵感,我相信做 AIGC 视觉创作的人应该都懂。以前看到一张喜欢的图,我的流程是这样的,保存图片,丢进 GPT 反推拆解,复制出来改一改,再贴到生图工具里跑一遍。 做一张还好,一天几十张、上百张的时候,这套流程就显得非常非常繁琐。 所以最开始,我只想做一件特别简单的事: 看到好图,Viko 一下。 浏览任何网页的时候,鼠标悬停在图上,一键捕捉,一键拆解,直接进入下一步创作。 我也试过市面上很多反推插件,还停留在一个特别初级的阶段,丢进去一张图,吐回来一整段 Prompt。 坦率的讲,一整段 Prompt,对真正做创作的人来说,远远不够。 我真正想知道的是,这张图为什么好看。 它是什么视觉风格,构图为什么成立,用了什么镜头和光线,色彩关系是怎么组织的,材质、氛围、人物状态又是怎么形成的。 以及最关键的,到底是哪几个关键词,激发了这张图的「美学基因」。 所以Viko我希望是有这样的能力的 。 人像、动漫、商图、产品图等等,都可以沿着不同的视觉维度爆破拆解,风格、构图、镜头、光线、色彩、主体、材质、氛围,还有真正值得留下来的核心关键词。 你可以直接用完整 Prompt,也可以把某一个视觉元素单独抽出来,改一改,迁移到新的主题里继续二创。 一张图带给你的,就不再只是一句提示词。 你开始知道它为什么成立,也开始有了继续延展它的方法。 在这个基础上,我还做了两个我自己特别喜欢的模式: 第一个是色卡模式。 很多时候一张图让你第一眼觉得「就是这个感觉」,真正起作用的其实是那套配色关系。Viko 可以直接提取画面的核心色彩,把喜欢的配色留下来,迁移到完全不同的主题里。 第二个,是我个人觉得最爽的,内测期间大家最爱用的,动作参考模式。 人物动作一直是 AI 生图里最难搞的问题之一,所以viko针对此项做了专门处理,即使面对复杂肢体动作和高难度透视关系,也能从容、一键完成精准动作还原。 到这里,从一张灵感图开始,捕捉、拆解、理解、二次创作,这条链路已经通了。 但这就够了吗?of course not ! 今天反推出来的 Prompt,过几天还能不能找到? 刚发现的那个神仙关键词,下次创作的时候还能不能想起来? 那套很漂亮的配色、那个难得的动作参考、一次次验证过的构图,还有最后生成出来的作品,用完之后,去哪了? 散落在聊天记录里,收藏夹里,下载文件夹里,各种软件里。 每一次创作结束之后,我们其实都在丢失自己的经验,没有产生创作复利! 所以,资产管理慢慢变成了 Viko 更核心的一部分。 参考图、关键词、Prompt、色卡、生成的作品,每一次创作里真正有价值的东西,都可以也应该沉淀下来。 今天发现的一个关键词,可能是未来某张作品的起点。存下的一套配色,可以迁移到新的主题。 慢慢的,你留在 Viko 里的,就不只是一堆图和 Prompt 了。 它会变成一套真正属于你自己的,视觉创作资产库。 这也是我做到今天,越来越确定的一件事。 反推只是第一步。 找到一张图的美学基因,把它拆开、理解、重新组合,再把每次创作里有价值的东西留下来,让过去的积累继续参与未来的创作。 每一次创作,都应该让下一次创作变得更轻松。 所以! Viko 由 Chrome 插件和网页工作台两端组成,插件负责在你刷图的时候随手捕捉,工作台负责拆解和沉淀。插件在 Chrome 商店搜 Viko 就能装,网页端在 首发期间也肯定有福利送给大家,优惠码: VIKO20,首月直接8 折! 如果你平时也喜欢找图、研究风格、拆 Prompt、做二创,来试试。 看到好图,Viko 一下。

古一

239,275 views • 2 months ago

我只给 Ling-3.0-flash-VL 一张 AI 眼镜产品图。 它回了我一份十一部分的营销策划:卖点、人群、口号、Campaign、渠道、预算和 KPI 都齐了。 图很简单:极简黑框,镜片前浮着时间、温度和实时数据。我让它从这张图判断,产品该怎么卖。 最先抓住我的是这句话: “外观去智能化,功能智能化。” 这个判断挺准。很多 AI 眼镜的问题,是用户一眼就能看出它在努力证明自己很智能:镜架厚、极客感重、日常穿搭很难接住。 图里的产品恰好相反,外观像普通眼镜,HUD 信息却直接出现在视线里。Ling 顺着这个反差,把传播主线提炼成“看不出是智能眼镜的智能眼镜” 接下来,它没有停在一句 slogan。 它继续拆出了颜值、功能、佩戴体验和设备生态四组卖点;按科技玩家、商务人士、时尚人群、户外用户和学生划分受众;又补上品牌口号、六个月营销节奏、渠道矩阵、KOL 分层、城市灯光秀和盲测挑战。 从一张图走到一份完整营销骨架,这才是这次测试让我惊讶的部分。 Ling 读到的不只是镜框和数字,还会追问:用户为什么愿意戴出门?哪种反差容易被记住?这张图放进发布会、短视频和线下体验时,分别应该讲什么?对做产品、品牌或内容的人来说,它已经很像一个能一起开选题会的视觉策划搭档。 当然,这份方案不能直接拿去投放。钛合金、40g、全天续航、心率监测、首月 GMV 和曝光目标,都不是一张产品图可以证明的事实。这些内容应该放回产品团队逐项核对,不能因为方案写得完整,就默认产品真的具备。 但我依然觉得这次结果很有价值。 过去我们给 AI 看产品图,多半只让它识别物体、提取文字。 Ling-3.0-flash-VL 往前多走了一步:它能把视觉特征翻译成定位、受众、场景和传播动作,先搭出一份可以继续讨论、删改和验证的初稿。 如果你手上也有产品图,可以试着别问“图里有什么”。直接问它:这个产品最值得被记住的冲突是什么? 你可能会得到一个比图片描述更有用的答案 感兴趣的都可以去试一试:

SakuAI

44,243 views • 19 days ago

Claude Opus 4.8 出了之后,我的第一反应是:想试。 第二反应是:算了,token 这东西真的不经烧。 结果看到 ZenMux 现在可以体验 Opus 4.8,就拿它试了一个我最近一直想做的小东西。 我自己有个很真实的问题: 脑子里经常冒出各种产品想法。 但每次真要开始做,就会卡住。 用户是谁? 第一版到底做什么? 哪些功能应该先砍掉? 怎么定价? 第一周从哪一步开始? 上线后怎么找第一批用户? 想法很多,执行很散。 所以我让 Claude Opus 4.8 做了一个「一人公司作战室」。 需求我写得也挺直接: 输入一句产品 idea。 自动拆出产品定位、MVP、开发任务、定价方案。 再生成落地页文案、冷启动实验、风险清单和本周计划。 最好不是一个静态页面,而是真的能点、能改、能导出。 然后我就把这段话丢给 Claude Opus 4.8。 出来的效果比我预期好不少。 它真的把“一人公司怎么从想法走到执行”这件事拆开了。 左边输入产品想法。 中间生成产品蓝图、MVP 范围、定价和官网文案。 右边是任务看板和本周计划。 底部还有冷启动实验、风险雷达和 Markdown 导出。 最让我觉得有意思的是,它不是一味堆功能。 比如我输入“给小红书博主做 AI 选题助手”,它会主动判断: 第一版必须做什么。 哪些功能看起来高级,但现在应该先别碰。 怎么找第一批真实用户。 哪些风险可能让这个项目做不下去。 这点就很能体现 Opus 4.8 的能力。 普通模型经常是:你要什么,我全给你加上。 最后页面很热闹,但产品判断是空的。 Opus 4.8 更像是在帮你收敛:先想清楚用户、场景和第一步,再把它变成可以执行的工作台。 我是在 ZenMux 上试的。 它比较方便的一点是,一个 Key 就能切不同模型,新模型上线也很快。 Opus 4.8 拿来做这种带产品判断、交互状态和复杂信息结构的网页,确实挺顺。 想试 Claude Opus 4.8 的,可以从这里进:

Joruno

16,224 views • 4 months ago

🚨Stitch 这次升级不得了,我觉得重点不是多了几个功能,而是 Google 正在重写 AI 设计工具的定义。 1/ Google 昨晚更新了 Stitch,官方给它的新定位很直接: AI-native software design canvas。 2/ 翻译成人话就是: 它不想只做一个 “你写一句 prompt,我给你几张 UI 图” 的工具了。 3/ 这次更新,核心就 5 个方向: 无限画布 更聪明的设计代理 语音交互 即时原型 设计系统 + DESIGN.md 4/ 最值得看的第一点,是 AI 原生画布。 现在的 Stitch 不只是吃 prompt。 还可以把 图片、文本、代码 一起作为上下文。 这说明它开始更像“设计工作台”,而不是一次性生成器。 5/ 第二点,是 agent 变强了。 Google 这次明确说,新 design agent 能理解整个项目演进过程,而且还有 Agent manager,支持你并行探索多个设计方向。 6/ 第三点,是 语音进入设计主流程。 你可以直接对着画布说话 让 Stitch 一边听一边改 还能给你实时设计反馈 7/ 第四点,是 即时原型。 现在 Stitch 可以把静态设计快速变成交互原型,点一下 Play 就能看 flow,甚至还能自动补出逻辑上的下一屏。 8/ 第五点,是很多人会低估的 DESIGN.md。 Google 把设计规则做成了一个 agent-friendly markdown,支持导入、导出、复用,还支持从 URL 提取设计系统。 9/ 所以这次 Stitch 真正从“帮你出图”,走向“参与整个设计流程”。 10/ 一句话总结: 2025 年的 Stitch,更像 UI 生成器。 2026 年这次升级之后,它开始更像 AI 设计工作台。

比特币橙子Trader

16,604 views • 6 months ago

兄弟们,最近开源一键爆款复制工具Hypit 真的有点东西,不到3天 github 7.4k star。 我试了下只能说非常的牛逼,很多博主用它来复刻视频,只用了Hypit复刻能力,但它的视频剪辑能力也是非常的强。 这条介绍 Hypit 的 90 秒视频,也是 Hypit + GPT-6 Astra 全程帮我剪辑完成的。 我把操作录屏、纸片拼贴风格参考、之前生成的成片交给它,再告诉它宣传片的目标和修改方向。从素材编排、字幕、B-roll,到流程动效和最终渲染,整个剪辑过程都在这套组合里完成。 视频里展示的,是我用 Hypit 做的一次 Clone → Edit → Reuse 实验。 先介绍一下:Hypit 是给 Codex、Claude Code 等 AI Agents 做视频的开源语言和系统。 它让 Agent 能把视频制作中的脚本、素材、配音、字幕、B-roll 和动效组织成一套可执行的工作流。创作者可以通过描述需求,让 Agent 编写、修改这些结构,再到 Hypit Studio 里查看画面和时间轴。 这次,我先从一条唐代主题的纸片拼贴视频开始,尝试 Clone 它的视觉表达:纸张纹理、醒目的题签、前后景移动,以及用图解讲故事的方式。 随后,我提出了一个新要求: “沿用纸片拼贴工作流,做中国瓷器历史,60 秒,中文旁白。” 同一种视觉语言,开始承载新的内容:从唐代故事,转向瓷器的发展、青花工艺和明清彩瓷。脚本、镜头和讲解围绕新主题重新组织,之前积累的制作方式可以继续使用。 有意思的地方,还在后面的修改。 做完这条宣传片后,我又让它给 B-roll 增加流程动效。它继续在现有工程里加入: 随讲解依次出现、点亮的纸片步骤卡; 连接不同步骤的箭头和推进动画; 对应“绘青花 → 罩透明釉 → 入窑烧成”的顺序框选; 展示 Clone、Edit、Reuse 的流程收束。 这些修改复用了已有素材,再完成合成和渲染。新增的卡片文字、出现时间和布局,也都保留在可编辑工程里。 这让我觉得,Clone 的价值,可以延伸到下一次创作。 一次实践之后,留下来的脚本结构、字幕样式、动效组件和素材组织方式,都能继续调整。下一次换主题、换产品或换讲解内容时,就有了一个可以接着工作的起点。 对需要持续做产品介绍、知识视频、功能演示的人来说,这种“描述需求 → 查看结果 → 继续修改 → 复用工程”的方式,很值得试一试。 视频里放了真实操作节选、Studio 预览、风格参考与新主题成品的对照,也展示了这次补充的流程动效。 想试试用自己的 Agent Clone 视频,可以先收藏这个开源仓库,顺手给 Hypit 点个 Star ⭐

知识猫AI实验室

71,606 views • 23 days ago

我把 AI 解说视频,彻底做成了一条“无人流水线” 丢进去文案和声音,后面的配音、分镜、画面、字幕、合成基本全自动 开源 4 天,350+ Stars,1000+ 人收藏。今天一次性把 cs-board 的全部功能讲透 并且新增加了自媒体封面修改功能,内置十种风格(还可以diy)还有市面上所有封面的尺寸(图二)👇 cs-board已经从一个 AI 白板视频工具,越改越像一个真正的 AI 内容生产工作台 以前用 AI 做一条内容,流程基本是这样的: 写文案 → 找模型改稿 → 克隆声音 → 拆分镜 → 生图 → 调风格 → 做动画 → 加字幕 → 做封面 → 导出 问题不是 AI 不够强 而是: 每一步都很强,但每一步都是孤岛 你要不断复制粘贴、切工具、重新上传素材、重新解释人物是谁、重新告诉模型你要什么风格 最后不是 AI 在替你工作,而是你成了 AI 工具之间的“人肉 API” 所以 cs-board 现在做的事情,本质上不是继续堆 AI 功能 而是把这些步骤做成一个有状态的内容生产工作台 1️⃣ 为什么我没有直接做“一键生成视频” 因为真正影响内容质量的,从来不是“一键” 而是中间状态能不能被控制和复用 比如现在 cs-board 生成一条视频,中间会留下: 配音 → 分镜 → 图片 → 分段视频 → 最终成片 这些都不是一次性的临时结果,而是检查点 假设你已经生成完所有图片,只是觉得字幕位置不对 正常 AI 工作流可能又得重新跑一遍 cs-board 不需要 直接从后面的渲染阶段继续 前面花过的钱和时间不重新花 我越来越觉得,AI 工具真正应该优化的,不是“第一次能不能生成”,而是: 第 17 次修改的时候,你还需不需要从头来一遍 2️⃣ 动态信息图为什么不是“让 AI 生成一张 PPT” 这个功能我改得比较久 因为我发现很多所谓 AI 视频,本质都有一个问题: 画面和人声是脱节的 旁白还没讲到第三点,画面已经把五点全部展示出来了 观众其实根本不会跟着你的表达走 所以 cs-board 的动态信息图不是: 文案 → HTML → 视频 而是先把真实旁白做成一个语义时间轴 一句话什么时候开始说、哪个关键词什么时候出现、哪个知识卡片什么时候展开,都跟实际音频绑定 所以画面不是按照“程序跑到第几秒”出现 而是: 你讲到哪,它才出现到哪 这其实是我现在做 cs-board 比较核心的一个思路: AI 负责理解内容,程序负责保证确定性 能交给代码控制的东西,我越来越不想交给模型猜 3️⃣ 为什么人物和画风要单独抽出来 以前最大的问题之一就是一致性。 第一张图是这个人。 第二张开始脸就变了。 第三张甚至连画风都换了。 所以现在自定义模式里,我把两件东西单独抽出来: 人物参考 + 风格参考。 可以放固定 IP,也可以放自己的品牌视觉。 人物最多可以提供多张参考图,风格也作为独立条件贯穿整个任务。 这意味着 cs-board 不只是帮你“生成一条视频”。 更重要的是: 它开始能够持续生产属于同一个 IP 的内容 对于真正做账号的人,这个区别非常大 4️⃣ 最近我又把封面也塞进去了 因为做完视频以后,我发现自己还得打开另一个工具做封面。 那干脆继续 Coding 现在封面制作直接放进工作台 粘贴文章 / 帖子内容以后: 自动理解内容 → 提炼标题 → 选择构图 → 生成人物与视觉 → 输出封面。 我没有只给一个“生成封面”按钮 而是先做了 10 种专业封面构图 因为封面的核心根本不只是图片好不好看 而是: 标题放哪、人物放哪、视觉重心在哪、第一眼先看到什么 构图是确定性的,审美才交给模型 这和前面动态信息图其实是同一套逻辑 5️⃣ 现在这个工作台正在慢慢变成什么 目前已经逐渐放进来了: 白板视频 / 自定义人物与画风 / 动态信息图 / 文案改写 / 对口型视频 / AI 封面制作 视觉模板现在也已经扩到了 12 套 音色克隆可以接本地 IndexTTS 任务、素材、配置、历史和成片默认都放本地 甚至同一个局域网里的电脑,可以共享制作队列 这也是我现在给 cs-board 定的方向: 不做一个 AI 视频生成器。 做一个可以不断往里面塞能力的 AI 内容生产工作台。 目前项目继续开源: 现在功能还远远没做完,下一步正在接入数字人工具 如图P3 但我觉得这条路,比继续做一堆“一键生成 XX”的小工具有意思多

陈硕KAI(耍门)

30,270 views • 1 month ago