知识猫图解's banner
知识猫图解's profile picture

知识猫图解

@GeekCatX20,788 subscribers

大厂资深程序员/小红书万粉博主/AI自媒体实战变现/AI提示词大师 小红书同名:知识猫图解 AI绘图 × AI自媒体 × AI工具实战 × OPC 学习/咨询/合作入口👇 vx:gnipbao

Shorts

兄弟们,昨天看完 K3 的开源宣传片,我发现它的表达思路,和「道 Skill」的底层逻辑高度一致,所以我直接把「造 Skill 的方法」也开源了。 真正值得开源的,不只是一个成品,更是创造它的方法。 于是,我参考 K3 官方视频,也做了一支「道 Skill」宣传片。 这套 Skill 元方法论,我已经测试、优化、迭代了很多个版本。现在正式开源。 如果你也在做 Skill,不必每次都从零开始。拿去用,拿去改,也欢迎一起把它迭代得更强。

兄弟们,昨天看完 K3 的开源宣传片,我发现它的表达思路,和「道 Skill」的底层逻辑高度一致,所以我直接把「造 Skill 的方法」也开源了。 真正值得开源的,不只是一个成品,更是创造它的方法。 于是,我参考 K3 官方视频,也做了一支「道 Skill」宣传片。 这套 Skill 元方法论,我已经测试、优化、迭代了很多个版本。现在正式开源。 如果你也在做 Skill,不必每次都从零开始。拿去用,拿去改,也欢迎一起把它迭代得更强。

23,761 просмотров

兄弟们,最近我扒了全网比较好用的电商提示词,做了一套「全平台通用电商视觉引擎工作流」。 目前已经在 SkildArt 跑通: 上传一张产品图,就能生成 12 张电商套图。 重点不是让 AI 随便出一张好看的商品图,而是把电商视 觉拆成可复用流程: 主视觉/产品中心图/卖点图/场景图/细节图/规格图/横版首屏图 每张图都有明确用途。 产品不能变形,Logo 不能乱跑,卖点不能瞎编,整组图风格要统一。 我实测下来,SkildArt 这类电商视觉工作台确实更适合做成套内容: 无限画布适合搭复杂生图流程; Agent 对话适合单张图灵活设计; 局部修改很方便; 视频模型也能和画布结合使用。 我还复刻了最近很火的「低能量穿搭换装」视频。 先在画布生成两组穿搭场景: 一组普通职业 Look, 一组明亮夏日多巴胺配色。 再切到视频模型,输入简单的转场和运镜描述,就能生成换装视频原素材。后面简单剪辑加 BGM 就能发。 以前这类内容要实拍两套造型,还要对镜头和节奏,现在工作流能直接把门槛拉低很多。 我觉得 AI 电商图真正的价值,不是单张图好看,而是稳定生成一整套能卖货的视觉资产。 完整工作流和低能量穿搭复刻提示词,可以去 SkildArt 广场搜关键词: 电商系统通用、夏日多巴胺换装 全部开源到里面了

兄弟们,最近我扒了全网比较好用的电商提示词,做了一套「全平台通用电商视觉引擎工作流」。 目前已经在 SkildArt 跑通: 上传一张产品图,就能生成 12 张电商套图。 重点不是让 AI 随便出一张好看的商品图,而是把电商视 觉拆成可复用流程: 主视觉/产品中心图/卖点图/场景图/细节图/规格图/横版首屏图 每张图都有明确用途。 产品不能变形,Logo 不能乱跑,卖点不能瞎编,整组图风格要统一。 我实测下来,SkildArt 这类电商视觉工作台确实更适合做成套内容: 无限画布适合搭复杂生图流程; Agent 对话适合单张图灵活设计; 局部修改很方便; 视频模型也能和画布结合使用。 我还复刻了最近很火的「低能量穿搭换装」视频。 先在画布生成两组穿搭场景: 一组普通职业 Look, 一组明亮夏日多巴胺配色。 再切到视频模型,输入简单的转场和运镜描述,就能生成换装视频原素材。后面简单剪辑加 BGM 就能发。 以前这类内容要实拍两套造型,还要对镜头和节奏,现在工作流能直接把门槛拉低很多。 我觉得 AI 电商图真正的价值,不是单张图好看,而是稳定生成一整套能卖货的视觉资产。 完整工作流和低能量穿搭复刻提示词,可以去 SkildArt 广场搜关键词: 电商系统通用、夏日多巴胺换装 全部开源到里面了

79,125 просмотров

兄弟们,基于Codex做一个白板手绘视频生成skill,只要上传原始图片,即可生成类似的手绘视频,非常的丝滑,目前市面上大部分白板手绘视频的都是收费的,而且也不便宜,目前还在优化打磨中想要的兄弟,可以点赞转发,浏览破w我就开源出来

兄弟们,基于Codex做一个白板手绘视频生成skill,只要上传原始图片,即可生成类似的手绘视频,非常的丝滑,目前市面上大部分白板手绘视频的都是收费的,而且也不便宜,目前还在优化打磨中想要的兄弟,可以点赞转发,浏览破w我就开源出来

49,235 просмотров

做了个提线木偶,兄弟们看看这个效果如何,想体验可以看引用贴链接,网站和引擎都已经开源,一大波作品创意正在路上。

做了个提线木偶,兄弟们看看这个效果如何,想体验可以看引用贴链接,网站和引擎都已经开源,一大波作品创意正在路上。

13,239 просмотров

Videos

GeekCatX's profile picture

兄弟们,上周预告的“故事转手绘视频”Skill,今天正式开源了。 给它一段中文故事,它就能自动变成一支会从黑白慢慢长出颜色的手绘日记动画。 你可以直接输入中文故事文案,也可以上传一组按顺序排列的本地图片。 剩下的事情,它会自动完成: 把故事拆成分镜; 保留原文措辞和叙事节奏; 为每个画面配上手写体字幕; 让画面从黑白线稿逐渐上色; 最后输出方便继续配音和剪辑的静音MP4。 为了避免自动分镜把故事切得太碎,我专门调整了拆分逻辑。 默认一个完整句子对应一个节拍,只有遇到自然的动作或叙事转折,才会拆开较长的复合句。 如果你已经准备好了漫画页或手绘图片,也可以直接上传。 它会自动识别并拆分页面中的手写文字和插画,在本地生成与彩色插画对齐的黑白底稿,再制作成动画。 目前支持两种转场: 第一种是直接切换。 按照“文字→黑白线稿→彩色插画”的顺序,从左向右逐渐揭示。 第二种是翻页转场。 保留原始页面,从右下角卷起翻页,做出真正的手绘日记翻书感。 我还专门处理了一个很容易翻车的问题: 画面裁切。 所有插画都会被限制在白色安全边框内,只使用完整收纳的构图方式,不会为了铺满屏幕,把人物、文字或关键细节直接裁掉。 最终输出3:4竖屏静音画面轨: 正式版1080×1440; 预览版720×960。 很适合拿来制作童年回忆、人物故事、成长经历、情感叙事,以及其他需要温度感的中文故事视频。 底层使用Image2生成分镜,再通过Remotion完成动画与渲染。 项目已经完整开源: 觉得有用,可以顺手点个Star。 如果你在使用中发现问题,或者做出了新的动画效果,也欢迎提Issue、交PR,一起把它继续完善。

知识猫图解

117,057 просмотров • 10 дней назад

GeekCatX's profile picture

视频生成模型的下一站,可能不是更长、更清晰的片子。 而是一个你能走进去,并亲手改变的世界。 过去两年,AI 视频已经能生成足够惊艳的画面。但无论视频多逼真,观众依然只能按下播放键: 镜头往哪里走,早已决定; 街角后面有什么,你无法靠近; 画面里出现什么,你也不能临时改变。 生成结束的那一刻,所有可能性也结束了。 Alaya Lab 刚刚开源的 AlayaWorld,试图把这件事反过来。 它不是先生成一段完整视频,再让你观看。 你可以用一张图片开启世界,推动摇杆改变镜头和移动方向;画面会随着操作继续生成。探索途中还能切换提示词,召唤火焰、凤凰、巨兽,或者让新的事件直接发生在当前场景里。 这意味着,AI 生成的内容第一次不只是“成片”,而开始接近一个可以进入、探索和影响的环境。 目前公开的几个核心指标: • 15B 参数 • 720p 分辨率 • 24 FPS 实时生成 • 支持 60 秒以上的连续探索 • 支持实时镜头控制与提示词切换 但真正困难的还不只是生成速度。 视频模型一旦连续运行,误差会逐帧累积:向前走了一段,再回头看,刚才的建筑可能已经变形;人物、道路和空间关系也会慢慢漂移。 这也是“生成视频”和“生成世界”的分水岭。 视频只要下一帧看起来合理。 世界却必须记得:东西在哪里、刚才发生过什么,以及你离开后再回来时,它是否还是原来的样子。 AlayaWorld 为此加入了两种互补的记忆: 一个显式 3D cache,用来保存空间位置; 一个压缩的帧历史,用来维持时间连续性。 再配合针对漂移历史的训练和 Error Bank,尽量阻止误差在长时间生成中不断放大。 所以这项工作的重点,不是“又一个画质更好的视频模型”。 而是把交互、空间记忆、长时稳定和实时生成,塞进同一个可以运行的系统里。 它现在当然还不是一款普通玩家打开电脑就能玩的游戏,也不能直接替代成熟的游戏引擎。 但它展示了一种很值得关注的方向: 未来的虚拟世界,未必需要把每栋建筑、每条道路和每个事件提前制作完成。 一部分世界,可能会在玩家移动和行动的同时,被模型实时生成出来。 这会影响的不只是游戏。 AI 原生玩法原型、影视预演、虚拟勘景、动态故事板,甚至机器人与智能体的训练环境,都可能从这种“可交互的生成世界”中长出来。 更难得的是,AlayaWorld 不只发布了 Demo。 模型权重与推理代码已经开放。你可以直接查看它如何处理实时交互、空间记忆和长时间生成,也可以下载权重进行研究与复现。 如果你正在关注世界模型、AI 游戏或交互式生成,这个项目值得拆一遍: Alaya Lab

知识猫图解

69,465 просмотров • 14 дней назад

GeekCatX's profile picture

兄弟们,Vox Style Skill又更新了。 这次新增了一套更适合自媒体内容的美漫模板。 之前的模板主要走新中式路线,比较适合中国古典文化、历史故事和东方美学类内容。 这次的美漫模板,颜色更加艳丽,视觉冲击力更强,能够适配的内容场景也更多。 知识科普、人物故事、商业观点、热点解读,都可以拿来尝试。 最关键的是成本。 按照我目前跑通的低成本工作流,制作一条Vox风格视频,理论生成成本低至1毛钱左右。 即使把废片和返工算进去,保守成本也不到2毛钱一条。 当然,这里没有计算人工时间,也没有把本来就在使用的Codex订阅摊进去。 但对于想做自媒体、预算又不高的人来说,这个成本已经足够低了。 如果你一直想做自媒体,却卡在: 没时间研究复杂工具; 请不起设计师和剪辑师; 不想每个月投入一大笔软件费用; 这套基于Codex的内容工作流,应该会比较适合你。 最近猫哥也一直在做一件事: 不断挖掘、测试和打磨低成本的创意视频制作方法。 目前已经有不少工具和工作流进入开发、测试阶段,大部分基于Codex就能直接使用。 猫社聚焦的方向很明确: AI+内容创作。 包括AI绘图、AI视频、AI工具实战,以及能真正用于自媒体生产的低成本工作流。 我们不追求收藏一堆看起来很厉害的工具。 而是希望把这些工具组合起来,让一个人也能持续产出内容。 每测试一次,就沉淀一套方法; 每完成一个作品,就积累一份内容资产; 再通过自媒体,持续放大自己的能力、作品和影响力。 低成本只是起点。 真正有价值的是,一个人借助Codex,也能跑通从创意、画面到视频制作的完整流程。 这次新增的美漫模板,也会同步给猫社群友使用。 目前猫社距离200人还剩9个位置。 满200人后,入群价格将调整至299元。 如果你本来就想做AI内容、自媒体或者低成本创意视频,可以趁当前价格加入。 想进群的,直接私信我回复:猫社。

知识猫图解

25,961 просмотров • 11 дней назад

GeekCatX's profile picture

啥也不说了,兄弟们自己看效果

知识猫图解

31,658 просмотров • 18 дней назад

GeekCatX's profile picture

兄弟们,最近实测了一把 Grok 4.5,只能说:老马这次真有点东西。 我上传了一段手绘动画,让它反向拆解,并设计一套能让 Codex 直接生成同类视频的工具。 它没有随便甩几句提示词,而是把视觉元素、绘制过程、动画节奏、技术架构和实现步骤,完整拆成了一套可执行方案。 然后我把方案直接丢给 Codex 开发。 最终效果非常惊艳,基本复刻了原视频的视觉和动画效果。 这次最大的感受,不是 Grok 又会写代码了,而是它开始像一个真正的产品架构师: Grok 负责看懂需求、拆解问题、设计方案; Codex 负责写代码、验证效果、持续迭代。 两个模型组合起来,一个负责想清楚,一个负责干出来。 这可能才是接下来 AI 编程真正的玩法:你不需要精通所有技术,只要能描述清楚目标,再让不同模型接力完成。 Grok 4.5 官方确认与 Cursor 一起训练,SpaceX 收购 Cursor 的交易也已经公布。之前我并不看好老马这步棋,现在看,Cursor 在真实开发场景上的积累,确实可能补上 Grok 的编程短板。 这次必须给老马点个赞,确实牛逼。 想体验这套手绘视频制作工具,可以加入知识猫 AI 群。 群是付费永久群,猫哥做出的新工具和新作品,一般都会优先给群里的兄弟们体验。群内还会不定期分享 AI 课程、自媒体玩法和可以直接落地的实战项目。 这种有辨识度的视频,拿去做账号,至少比千篇一律的 AI 图文更容易抢到注意力。 想了解的,私信我:知识猫。

知识猫图解

11,758 просмотров • 21 дней назад

Больше нет контента для загрузки