陈硕KAI's banner
陈硕KAI's profile picture

陈硕KAI

@ChenshuoAI • 10,458 subscribers

🌏 WE30🎬 欢迎投稿问题,你们的疑问都是我的选题 🌏建联:https://t.co/lGtm3GhXGN|🌏cs-board 和 cs-skills 开源作者|🌏YouTube 30 万订阅者|跨境| Crypto(8位数)

Shorts

我开源了我沉淀一年的skill,涵盖写作、深度调研、产品界面优化、代码和文档对齐、角色与文章配图、chatcut自动化剪辑、代码的交付收尾.... 契机: 1.小黄skil篇 陈硕有个设计师小伙伴做了个skill,这个skil是和这个skil是和Ian (伊恩)老师在github上斩获10000stars的小黑skill的共创,出了一个新的形象:小黄 做完才发现,画出一个可爱的角色并不难,难的是:让它在不同文章、动作、场景,甚至2D/3D的变化里,始终还是同一个角色 小黄有固定的角色 DNA:暖黄色种子形身体、爱心天线、椭圆眼睛、腮红和细手脚 它还能读一篇文章,找到真正值得解释的“认知锚点”,再把一个判断、关系或转折画成配图 以下是具体效果和内容呈现👇

我开源了我沉淀一年的skill,涵盖写作、深度调研、产品界面优化、代码和文档对齐、角色与文章配图、chatcut自动化剪辑、代码的交付收尾.... 契机: 1.小黄skil篇 陈硕有个设计师小伙伴做了个skill,这个skil是和这个skil是和Ian (伊恩)老师在github上斩获10000stars的小黑skill的共创,出了一个新的形象:小黄 做完才发现,画出一个可爱的角色并不难,难的是:让它在不同文章、动作、场景,甚至2D/3D的变化里,始终还是同一个角色 小黄有固定的角色 DNA:暖黄色种子形身体、爱心天线、椭圆眼睛、腮红和细手脚 它还能读一篇文章,找到真正值得解释的“认知锚点”,再把一个判断、关系或转折画成配图 以下是具体效果和内容呈现👇

23,493 views

Videos

ChenshuoAI's profile picture

之前开源具有的10种风格 AI 手绘视频自动化系统,又被我重构了一轮,更像是一条可以在本地 24 小时持续跑的 AI 视频生产线 先放项目: GitHub: 之前的版本已经可以做到: · 上传 10–30 秒参考声音 · 粘贴一段文案 · 选择画面风格 然后自动完成: 声音克隆 → 分镜拆解 → 插画生成 → 白板绘制 → 字幕 → 渲染 → 成片 今天我又补了一大堆东西 这次主要更新了 7 个方向: 1. 第 11 种画面风格 新增「纸感隐喻拼贴风」 系统会根据文案结构,从本地 10 张参考图里自动选择构图,同时重新适配了深色、霓虹类画面的渲染效果 2. 人物和画风终于可以自己定了 新增「自定义参考」页面 现在可以直接上传: · 1 张风格参考图 · 最多 5 个角色 · 每个角色 1–3 张参考图 尽可能保证整条视频里人物和画风的一致性。 3. 成片控制进一步开放 现在可以: · 给任务命名 · 选择 4 档线条绘制量 · 开关重点文字 · 开关字幕 重点文字没有继续让图片模型硬生成,而是改成本地准确叠字,主要就是为了解决 AI 生成中文容易乱码的问题 4. 任务可以真正“复用”了 新增完整历史记录 任务失败后可以从断点继续,成片也可以直接换设置重新渲染。 最重要的是: 原来的配音和分镜会直接复用 也就是说重新渲染时,不需要再重复消耗 GPT、图片生成和 TTS 调用 5. 后端并发架构重做 之前是每个任务一个独立线程,现在改成了三级队列: · 最多 2 路语音任务 · 最多 4 路模型调用 · 渲染阶段立即执行 任务元数据也全部持久化 哪怕后端重启,之前没有跑完的任务也会自动恢复 6. 支持局域网多电脑协作 现在多台电脑可以共享: · 任务队列 · 实时进度 · 历史记录 同时会显示任务来源 IP 每个浏览器自己的制作偏好又是独立保存的,所以几个人同时使用也不会互相覆盖设置 7. 整个前端重新做了一遍 新增: · 标准制作 / 自定义参考切换 · 实时队列状态 · 每个阶段耗时 · 完整历史任务区 品牌和交互也基本重新设计了一遍 我自己的方案目前还是: 本地 TTS + Codex Image 接口 + 本地电脑渲染 一台电脑就可以一直跑 如果手里有 20x 这类账号,图片生成这块的产能基本也不用太担心 代码我还是全部开源了,能放的基本都放出来了 不过提前提醒一句: 小白真的不要看到开源就直接一顿乱跑 这套东西已经涉及本地模型、并发队列、图片接口、TTS、FFmpeg、渲染环境和局域网服务 环境没搞明白之前,先看文档 别视频没做出来,先把自己电脑环境搞炸了 功能演示👇 如果觉得有用,可以帮忙转发关注一下 也欢迎直接 Fork,拿去魔改

陈硕KAI

233,613 views • 1 month ago

ChenshuoAI's profile picture

我把 AI 解说视频,彻底做成了一条“无人流水线” 丢进去文案和声音,后面的配音、分镜、画面、字幕、合成基本全自动 开源 4 天,350+ Stars,1000+ 人收藏。今天一次性把 cs-board 的全部功能讲透 并且新增加了自媒体封面修改功能,内置十种风格(还可以diy)还有市面上所有封面的尺寸(图二)👇 cs-board已经从一个 AI 白板视频工具,越改越像一个真正的 AI 内容生产工作台 以前用 AI 做一条内容,流程基本是这样的: 写文案 → 找模型改稿 → 克隆声音 → 拆分镜 → 生图 → 调风格 → 做动画 → 加字幕 → 做封面 → 导出 问题不是 AI 不够强 而是: 每一步都很强,但每一步都是孤岛 你要不断复制粘贴、切工具、重新上传素材、重新解释人物是谁、重新告诉模型你要什么风格 最后不是 AI 在替你工作,而是你成了 AI 工具之间的“人肉 API” 所以 cs-board 现在做的事情,本质上不是继续堆 AI 功能 而是把这些步骤做成一个有状态的内容生产工作台 1️⃣ 为什么我没有直接做“一键生成视频” 因为真正影响内容质量的,从来不是“一键” 而是中间状态能不能被控制和复用 比如现在 cs-board 生成一条视频,中间会留下: 配音 → 分镜 → 图片 → 分段视频 → 最终成片 这些都不是一次性的临时结果,而是检查点 假设你已经生成完所有图片,只是觉得字幕位置不对 正常 AI 工作流可能又得重新跑一遍 cs-board 不需要 直接从后面的渲染阶段继续 前面花过的钱和时间不重新花 我越来越觉得,AI 工具真正应该优化的,不是“第一次能不能生成”,而是: 第 17 次修改的时候,你还需不需要从头来一遍 2️⃣ 动态信息图为什么不是“让 AI 生成一张 PPT” 这个功能我改得比较久 因为我发现很多所谓 AI 视频,本质都有一个问题: 画面和人声是脱节的 旁白还没讲到第三点,画面已经把五点全部展示出来了 观众其实根本不会跟着你的表达走 所以 cs-board 的动态信息图不是: 文案 → HTML → 视频 而是先把真实旁白做成一个语义时间轴 一句话什么时候开始说、哪个关键词什么时候出现、哪个知识卡片什么时候展开,都跟实际音频绑定 所以画面不是按照“程序跑到第几秒”出现 而是: 你讲到哪,它才出现到哪 这其实是我现在做 cs-board 比较核心的一个思路: AI 负责理解内容,程序负责保证确定性 能交给代码控制的东西,我越来越不想交给模型猜 3️⃣ 为什么人物和画风要单独抽出来 以前最大的问题之一就是一致性。 第一张图是这个人。 第二张开始脸就变了。 第三张甚至连画风都换了。 所以现在自定义模式里,我把两件东西单独抽出来: 人物参考 + 风格参考。 可以放固定 IP,也可以放自己的品牌视觉。 人物最多可以提供多张参考图,风格也作为独立条件贯穿整个任务。 这意味着 cs-board 不只是帮你“生成一条视频”。 更重要的是: 它开始能够持续生产属于同一个 IP 的内容 对于真正做账号的人,这个区别非常大 4️⃣ 最近我又把封面也塞进去了 因为做完视频以后,我发现自己还得打开另一个工具做封面。 那干脆继续 Coding 现在封面制作直接放进工作台 粘贴文章 / 帖子内容以后: 自动理解内容 → 提炼标题 → 选择构图 → 生成人物与视觉 → 输出封面。 我没有只给一个“生成封面”按钮 而是先做了 10 种专业封面构图 因为封面的核心根本不只是图片好不好看 而是: 标题放哪、人物放哪、视觉重心在哪、第一眼先看到什么 构图是确定性的,审美才交给模型 这和前面动态信息图其实是同一套逻辑 5️⃣ 现在这个工作台正在慢慢变成什么 目前已经逐渐放进来了: 白板视频 / 自定义人物与画风 / 动态信息图 / 文案改写 / 对口型视频 / AI 封面制作 视觉模板现在也已经扩到了 12 套 音色克隆可以接本地 IndexTTS 任务、素材、配置、历史和成片默认都放本地 甚至同一个局域网里的电脑,可以共享制作队列 这也是我现在给 cs-board 定的方向: 不做一个 AI 视频生成器。 做一个可以不断往里面塞能力的 AI 内容生产工作台。 目前项目继续开源: 现在功能还远远没做完,下一步正在接入数字人工具 如图P3 但我觉得这条路,比继续做一堆“一键生成 XX”的小工具有意思多

陈硕KAI(耍门)

30,270 views • 1 month ago

ChenshuoAI's profile picture

我把 AI 手绘视频,做成了一条可以本地持续生产的自动化流水线,有人之前已经在抖音跑出千赞 现在市面上 AI 视频工具很多,但大多数只解决“生成一条视频” 我更想解决的是: 怎么把一条视频,变成一套能稳定复用、持续产出的生产系统 所以我把声音克隆、文案拆解、分镜、插画、白板动画、字幕和最终合成,全部接到了一起 你只需要做 3 件事: · 上传一段 10–30 秒的参考声音 · 粘贴一段你想表达的文案 · 选择画面风格和视频形式 剩下的交给系统: · 自动克隆声音 · 自动理解文案并拆分内容结构 · 自动生成统一风格插画 · 自动绘制白板笔迹动画 · 自动生成字幕并合成 MP4 · 失败后可以从断点继续,不需要全部重来 这次新版还加了一条我很喜欢的能力: 动态信息图模式 它不再只是“白板画画”,而是会根据真实旁白的时间,自动把内容组织成动态 PPT / 知识卡片 比如对比、流程、因果、时间线、层级、总结这些内容,都会用不同版式呈现 而且画面元素会严格跟着旁白出现,不会提前抢话,也不会靠字数瞎估时间 我自己的方案是: 本地 TTS + AI 文案理解 + AI 插画生成 + 本地渲染 目标不是做一个“好玩的一键生成器”,而是让一台电脑可以持续稳定地生产内容 如果你手里有矩阵账号、知识类账号,或者长期需要把口播文案转成视频,这套流程应该会比较有用 项目已经全部开源,能跑的代码都放出来了: 功能演示我会继续更新 创作不易,如果你觉得这个方向有用,欢迎帮忙转发、关注,也欢迎直接拿去改

陈硕KAI

12,217 views • 1 month ago

No more content to load