Video wird geladen...

Video konnte nicht geladen werden

Zur Startseite

最近鹅厂发了 一堆新产品啊! 今天又来了~ Tencent直接把创意工作最烦人的痛点一次性干掉了。 再也不用在Midjourney、Runway、Figma、Blender之间来回切。 他们刚刚推出Miora,一个真正的AI创意Agent studio,现在国际版公测。 所有东西(图像、视频、UI/UX、3D)都在同一个画布上生成,agent自己理解上下文、自己调用工具、自己图像修复、本地编辑、拆背景,还能记住你的喜好。 内置一堆专业Agent:品牌、故事板、插画、UI/UX、视频、3D…… 也安排了对应的SKILLS商店:你可以用官方的、自己造的、还能分享给社区。

65,601 Aufrufe • vor 2 Monaten •via X (Twitter)

0 Kommentare

Keine Kommentare verfügbar

Kommentare vom Original-Post werden hier angezeigt

Ähnliche Videos

OpenAI刚刚开源的这个东西,感觉要把程序员的工作方式给整个改写了。 现在大家都在卷模型写代码有多强,但其实真正的瓶颈早就不是生成了。 一个人每天最多同时有效监督3-5个编码Agent,再多就会注意力崩溃,生产力直接归零。 有了Symphony,直接把这个上限干到了几十个。 它把你的Linear、GitHub Issues直接变成了永远在线的Agent调度器。 你开一个任务,它自动启动一个独立隔离的Codex Agent。 自己写代码,自己跑测试,自己做交叉Review,damn! 全部搞定之后,会给你提交一个完整的证据包。 CI全绿,安全和性能专项审查通过,改了UI就自动录好操作视频。 所有验证全过了,才会出现在你的Human Review队列里。 以后人类的角色可能会被彻底颠覆了。 以前你是监工,盯着Agent一步一步写代码,上下文切到吐。 现在你是老板,只需要看最终的结果。 满意就点合并,不满意就去仓库里补规则补文档补Guardrails。 记住兄弟们,永远不要手把手指挥Agent,永远不要替它干活。 这可不是啥实验室概念,OpenAI自己已经这么干了。 三个工程师,五个月,写了一百万行代码,0行人工写的。 产品已经有几百个内部用户,每天都在迭代。 我觉得他们最厉害的不是模型,是他们把整个仓库变成了Agent能看懂能自主工作的乐园。 现在很多人都搞错了Agent时代的核心竞争力。未来不是谁的模型更聪明,而是看谁能设计出让Agent可靠自主工作的环境。 我觉得未来最好的工程师,再也不是写代码最快的人,而是那些最会写规则,最会设计反馈回路,最会给Agent搭舞台的人。 现在Symphony已经开源了,它甚至不是一个成品。 是一个17k token的完整SPEC。 你把这个SPEC喂给任何一个编码Agent,十分钟就能生成你自己定制版的Symphony。 GitHub地址评论区自取👇

AYi

63,210 Aufrufe • vor 3 Monaten

#AI开源项目推荐:VisualStoryWriting 可视化故事创作:让你笔尖起舞,文思泉涌 想象一下,在你写作的同时,你笔下的世界就活生生地展现在眼前——时间线、世界地图、人物关系图……这一切都会被自动可视化。 更神奇的是,你对这些视觉元素的任何修改,都会立刻同步到你的故事文本中(比如,在地图上拖动一个角色,他在文中的位置也随之改变)。 这就是我们将要在 UIST2025 大会上分享的论文精髓。 我们开发了一款智能文字处理器,它能自动生成三种可视化视图:人物关系图、故事地图和场景时间线。这些视图能清晰地展示角色间的互动、他们在世界各地的足迹,以及故事场景的先后顺序,极大地帮助作者审阅和编辑自己的作品。 审视角色的移动轨迹,从此变成了一项直观的视觉任务。想改变一个角色在某个场景中的位置?太简单了,直接在地图上把他从一个地方拖到另一个地方就行。 调整故事场景的顺序,也只需要在时间轴上拖拽几下,就像整理幻灯片一样轻松。 想要创造一个新角色,或是让他们之间产生新的互动?同样简单,在关系图里新建一个节点,再连上一条线就搞定了。 我们邀请了经验丰富和初出茅庐的创作者们进行了两轮用户研究。结果发现,这些自动生成的可视化图表,能有效地帮助参与者规划故事的宏观修改、追踪故事元素,并探索情节的多种可能性,极大地激发了他们的创造力。 当然,能够帮助作者的可视化方式还有很多。因此,我们提出了一个设计框架,希望能启发未来更多样的可视化故事创作工具的设计。 我们的工作为未来的写作辅助工具奠定了基础——它不再仅仅依赖文字,更能借助视觉的

宝玉

35,626 Aufrufe • vor 11 Monaten

卧槽,太夸张了,现在 AI 时代的闲鱼已经面世了吗?这不就是谁先知道谁赚钱,拼速度了? 你的技能,专业知识,等等你的一切,竟然可以在你睡觉的时候被别人买走,这是什么科幻小说吗?? 之前我一直在想,现在大家优秀的 skill 往往都是自己用,大部分人舍不得开源的,那有没有一个平台既能让用户用到这些大神的专业知识、skill,但是又不用开源呢? 还真让我给找到了!! 前两天看到国内一个博主推荐一个很野的平台-UUMit 让你的技能、经验、工作流都可以变成能力卡,被需要的人、或者别人的 Agent 自动发现、调用 并且直接付费!! 有点像03年淘宝刚出来的时候,只不过当年流通的是商品,现在流通的是能力 具体能干什么?举几个例子你就懂了 会写小红书脚本的,可以把选题逻辑、爆款模板、平台规则检测能力上架,别人发布“帮我做一周小红书内容计划”,平台自动匹配到你,你接单交付 会做行业研究的,可以把数据库、报告、案例库放进知识商店,AI 生成不了的真实行业数据,反而更值钱 会写代码的,可以把 API、MCP 工具、自动化脚本上架,别人的 Agent 需要某个能力时,直接调用你的接口,你按调用次数收费 甚至你只是整理过某个垂直领域的供应商名单、SOP、课程讲义,这些 AI 生成不了的资料,都可以变成知识资产 这绝对是一次能力供应链的重构! 以前的 AI 只能在自己的对话框里回答问题,但复杂任务需要很多外部能力:数据、接口、行业知识、人工交付 UUMit 做的事情是:让 Agent 可以发现别人的能力,也能让自己的能力被别的 Agent 调用 这就是 A2A(Agent to Agent)真正有意思的地方,不是让 AI 互相聊天,而是让 AI 找能力、调接口、买知识、拉人协作,把事情交付掉 为什么我说谁先知道谁赚钱? 因为这个平台刚起来,早期上架的人能建立先发优势 而且现在 Agent 真的开始干活了,不再只是聊天工具,它们需要外部能力来完成复杂任务 谁先把自己的能力挂上去,谁就有机会被更多 Agent 发现和调用 这就是信息差的价值,就像03年最早在淘宝开店的那批人 UUMit 现在有哪些功能? 任务发布入口:你不用一开始就知道该找谁,也不用自己拆一堆工具,你只要说清楚想完成什么,UUMit 会帮你找能完成这件事的能力 Skill/Agent/工作流上架:你写好的工具,不一定只能自己用,它也可以成为别人工作流里的一环 知识商店:AI 可以生成很多内容,但它不一定拥有你手里的行业资料、真实数据、案例库和经验沉淀,这些东西放到 UUMit,可能会变成可复用的知识资产 数据广场:Agent 不必自己拥有所有数据和接口,需要某项外部能力时,可以通过 UUMit 调用数据广场里的资源 强烈推荐大家来试试:

超级个体|柿子

34,428 Aufrufe • vor 1 Tag

AI 视频制作也接近了 GPT 时刻,视频智能体背后的工作原理🧵 AI 产品都有个可用性易用性的临界点,临界点之下,属于专业玩家的玩具,需要各种提示词技巧、专业知识才能用起来;临界点之上,就真正变成了普通人也可以用起来并且有用的工具。就像 AI 聊天,在 ChatGPT 之前,我们常笑话它们是人工智障,在 ChatGPT 之后,它是真的变成了一个有帮助的助手,能帮助我们完成很多任务,所以我们通常把 AI 产品跨过可用性通用型临界点叫 GPT 时刻。 类似的比如前不久 GPT-4o 发布的图片模型,提示词很简单,不需要像 MidJourney 那样需要专业的提示词才能生成好的图片作品,普通人都可以把自己天马行空的想法变成真实有趣的作品,我这样非专业的都玩了好一段时间。 像 AI 视频类产品我一直没怎么玩,因为对于我这样的非专业人士来说,做好视频太难了,创意和提示词反倒相对容易一点,主要是得写脚本、画图、声音、多条视频,剪辑,做好一条视频要费很多时间精力。 不过上面这条视频倒是没花我多少时间,我就输入了一条提示词: > 生成视频,主题是“西游记人物自拍视频,用自拍的方式来讲述《西游记》经典场景”,视频长度为2分钟。 发送到纳米AI然后等着就成了,整体看着还挺有趣,有画面有声音有剧情。让我觉得 AI 视频终于也接近了 GPT 时刻,普通人也可以通过简单的提示词就能做出还不错的视频作品,动动嘴就能出视频。对于创作者,也可以快速制作视频 Demo,将创意想法快速落地。

宝玉

26,346 Aufrufe • vor 1 Jahr

久等啦,创作者神器Viko终于上线!🥳( 前段时间我随手发过一个 Viko 的 demo视频,就那么一个很糙的版本,结果评论区和私信隔三差五就有人来问,什么时候能用,什么时候上线。 因为对我自己也是刚需,于是闭关爆肝了一个多月,终于来啦~ 它最开始,其实只是我给自己做的一个小工具。 我每天都会刷 Pin和各种作品站找灵感,我相信做 AIGC 视觉创作的人应该都懂。以前看到一张喜欢的图,我的流程是这样的,保存图片,丢进 GPT 反推拆解,复制出来改一改,再贴到生图工具里跑一遍。 做一张还好,一天几十张、上百张的时候,这套流程就显得非常非常繁琐。 所以最开始,我只想做一件特别简单的事: 看到好图,Viko 一下。 浏览任何网页的时候,鼠标悬停在图上,一键捕捉,一键拆解,直接进入下一步创作。 我也试过市面上很多反推插件,还停留在一个特别初级的阶段,丢进去一张图,吐回来一整段 Prompt。 坦率的讲,一整段 Prompt,对真正做创作的人来说,远远不够。 我真正想知道的是,这张图为什么好看。 它是什么视觉风格,构图为什么成立,用了什么镜头和光线,色彩关系是怎么组织的,材质、氛围、人物状态又是怎么形成的。 以及最关键的,到底是哪几个关键词,激发了这张图的「美学基因」。 所以Viko我希望是有这样的能力的 。 人像、动漫、商图、产品图等等,都可以沿着不同的视觉维度爆破拆解,风格、构图、镜头、光线、色彩、主体、材质、氛围,还有真正值得留下来的核心关键词。 你可以直接用完整 Prompt,也可以把某一个视觉元素单独抽出来,改一改,迁移到新的主题里继续二创。 一张图带给你的,就不再只是一句提示词。 你开始知道它为什么成立,也开始有了继续延展它的方法。 在这个基础上,我还做了两个我自己特别喜欢的模式: 第一个是色卡模式。 很多时候一张图让你第一眼觉得「就是这个感觉」,真正起作用的其实是那套配色关系。Viko 可以直接提取画面的核心色彩,把喜欢的配色留下来,迁移到完全不同的主题里。 第二个,是我个人觉得最爽的,内测期间大家最爱用的,动作参考模式。 人物动作一直是 AI 生图里最难搞的问题之一,所以viko针对此项做了专门处理,即使面对复杂肢体动作和高难度透视关系,也能从容、一键完成精准动作还原。 到这里,从一张灵感图开始,捕捉、拆解、理解、二次创作,这条链路已经通了。 但这就够了吗?of course not ! 今天反推出来的 Prompt,过几天还能不能找到? 刚发现的那个神仙关键词,下次创作的时候还能不能想起来? 那套很漂亮的配色、那个难得的动作参考、一次次验证过的构图,还有最后生成出来的作品,用完之后,去哪了? 散落在聊天记录里,收藏夹里,下载文件夹里,各种软件里。 每一次创作结束之后,我们其实都在丢失自己的经验,没有产生创作复利! 所以,资产管理慢慢变成了 Viko 更核心的一部分。 参考图、关键词、Prompt、色卡、生成的作品,每一次创作里真正有价值的东西,都可以也应该沉淀下来。 今天发现的一个关键词,可能是未来某张作品的起点。存下的一套配色,可以迁移到新的主题。 慢慢的,你留在 Viko 里的,就不只是一堆图和 Prompt 了。 它会变成一套真正属于你自己的,视觉创作资产库。 这也是我做到今天,越来越确定的一件事。 反推只是第一步。 找到一张图的美学基因,把它拆开、理解、重新组合,再把每次创作里有价值的东西留下来,让过去的积累继续参与未来的创作。 每一次创作,都应该让下一次创作变得更轻松。 所以! Viko 由 Chrome 插件和网页工作台两端组成,插件负责在你刷图的时候随手捕捉,工作台负责拆解和沉淀。插件在 Chrome 商店搜 Viko 就能装,网页端在 首发期间也肯定有福利送给大家,优惠码: VIKO20,首月直接8 折! 如果你平时也喜欢找图、研究风格、拆 Prompt、做二创,来试试。 看到好图,Viko 一下。

古一

141,176 Aufrufe • vor 4 Tagen

很多人觉得 AI编程门槛太高,不愿意使用,那么你们有福了!!! 扣子发布2.0版本 带Skills 功能,非常有幸拿到 Coze Skills 的内测。 试了一下,对于不会用Claude Code,或者惧怕使用的人来说,真是太友好了! 如果说:Claude的Skills很强,还需要懂一点技术的话,那么扣子把这个门槛降到了零。 对话就能创建 零代码创建 普通人也能拥有AI超能力。 我做了个论文一键转公众号的 Skill,还能自动配图,自动发布! 1. 支持从论文/文章 PDF 或链接中一键提取核心内容 2. 智能解析:自动提取论文的标题、摘要、核心创新点、实验数据和结论。 3. 文风转换:不是生硬的翻译,而是根据公众号读者的阅读习惯,将晦涩的学术语言转化为通俗易懂的各种文风。 4. AI 自动配图:这是最酷的地方!它会根据论文主题,自动调用绘图模型生成一张吸睛的高清封面图,并且在文章正文中根据段落内容自动插入合适的插图。 5.一键发送草稿箱:连复制粘贴都省了,直接对接公众号 API,生成的图文直接躺在你的公众号草稿箱里,只需要最后确认一下就能发布。 同时扣子也正式推出了 Skills 技能,及技能商店。 我的技能已经免费分享到coze的技能商店!搜索:公众号配图生成技能 就能找到! 来讲一下如何操作: 技能入口在扣子 2.0 版本的扣子编程这里就可以看到,窗口右上角的“技能”。 在扣子编程中的不需要太多技巧, 直接使用自然语言的方式就可以创建技能,它会完全按照你的意思去生成和调试,非常方便! 并且支持在线调试预览开发好的技能, 然后还支持一键部署和发布到扣子。 关键是一边预览,左侧还能让它修改 可以打开文件夹,看到 skill 自定义文件、脚本、引用来源等信息。结构和CC非常像,其实我觉得都完全没有必要打开看。 我很多文件,都是从Claude Code里面的skills直接copy过来,上传上去,居然直接能用,省了好多力气,直接可以搬移Claude Skill了! 技能开发完成后,点击部署,在技能商店中可以看到自己刚刚部署和安装的技能,并支持一键发布到技能商店给所有人使用。 可以发布为免费技能也可以发布为付费技能,想赚钱直接发布成付费就行。 发布完后,所有人都能在技能商店使用你的技能,如果是付费的,用户可以很方便的对技能进行付费,技能开发者也能快速变现。 使用直接 @你的技能 就可以,详细请看视频 Skills 还是太火了,所有的媒体平台都有在讨论 Skills。扣子也第一时间,支持了 Skills 的无代码开发以及技能商店。 目前Coze商店里的技能,我看了一下绝大多数都是免费的,赶紧来找一下你要的? 用AI工具快两年了,从最开始的"哇,它能写东西",到后来的"嗯,但还是得我自己改",再到现在的"它真的能帮我干活了"。 AI不再是一个聊天工具,而是一个真正的同事。 它知道我的工作方式,它能交付我需要的成品,它甚至能主动帮我完成重复性工作。 这才是AI应该有的样子。

huangserva

28,909 Aufrufe • vor 6 Monaten