Video yükleniyor...

Video Yüklenemedi

Ana Sayfaya Dön

💥惊艳!阶跃星辰 Step 5 Preview 没有去“贴图复刻”《清明上河图》,而是用 p5.js 一笔一笔把汴京城画了出来! 虹桥、漕船、瓦屋顶、伞盖、市井人流,全是线条和几何形状重建出来的,再靠实时绘制动画一点点显现。 官方写得很清楚:场景是单笔笔触程序化绘制,不是从原图复制。 这才是它真正吓人的地方 不只会写前端,还能直接参与视觉内容的生成和迭代:网页界面、数据可视化、调用 Blender 做 3D 资产,再接进 Three.js 交互应用。 一张千古长卷,被拆成代码、再被一笔一笔画回来。这不是滤镜,是工程。 #Step5Preview #阶跃星辰 #清明上河图 #p5js #AI编程 #软件工程 #国风可视化 #印奇

22,099 görüntüleme • 13 gün önce •via X (Twitter)

9 Yorum

CiCi profil fotoğrafı
CiCi13 gün önce

能做到这个素描能力已经是一个很大的突破了,有点另眼相看了

SuSu_酥酥👅 profil fotoğrafı
SuSu_酥酥👅13 gün önce

后训练突飞猛进

J A Z I I profil fotoğrafı
J A Z I I13 gün önce

ayoo this looks so flipping cool

SuSu_酥酥👅 profil fotoğrafı
SuSu_酥酥👅13 gün önce

真特么惊艳到我了

Ethan Cole profil fotoğrafı
Ethan Cole13 gün önce

p5.js output only helps production if the draw loop is replayable. A one-shot animation is still an untestable artifact.

Enzo 🐬 profil fotoğrafı
Enzo 🐬13 gün önce

这个太假了 一个连鹈鹕机车都画不好的 AI 能打成这种水平,那真的是不可想象

Gate芝麻开门合约费返还|最高85% profil fotoğrafı
Gate芝麻开门合约费返还|最高85%13 gün önce

这种程序化生成的笔触细节确实比直接贴图有质感

Acan profil fotoğrafı
Acan13 gün önce

好美啊,穿越千年了

boy London profil fotoğrafı
boy London13 gün önce

现在算力已不够用了

Benzer Videolar

卧槽,Hypit 这次确实有点意思。 把它接进 Codex,丢一条参考视频过去,再说一句“帮我 Clone”,它就能把原片拆成可编辑的视频工程。 人物能换、服装能换、色卡能换。 原片的构图、镜头节奏、字幕、转场和画面层级,会尽量保留下来。 我这次用 Codex 跑了 Hypit,复刻了两条短视频。 一个是「豆包帮我清理桌面」的场景创意 yanhua,一个是 @陶阿狗君 的旅行变装。 它先把视频拆成一个可编辑的 workflow。 谁在说话、哪一段用什么图、字幕怎么排、画面怎么动,都变成工程里的零件。 流程很简单: 1、给 Codex 装上 Hypit Skill npx skills add hypit-ai/hypit -g 2、配好视频模型 API 我这里用即梦 CLI 调 Seedance,先确认模型能正常出片。 3、把参考视频和人物图交给 Codex 告诉它保留原片构图和分镜节奏,把人物换成参考图角色,再生成新的色卡和服装。 4、先确认图片,再生成动态镜头 图片、视频和声音可以分阶段处理。图片不满意先改,确认后再调视频模型出片。 我觉得 Hypit 最有意思的地方,是它把视频制作从一次性「抽卡」,变成可以持续修改的项目。 你能一边预览成片,一边看对应素材和源码。想换人、改字、调镜头节奏,都有地方下手。 工具是开源的,模型和 API 费用各自另算。 想用 AI Agent 做视频 Clone 的,可以自己装了试试,效果因模型和参考片差异会比较大。 官方仓库(开源):

行者AI视频

159,091 görüntüleme • 14 gün önce

上次老杨是复刻小红书笔记爆了,这次把图书带货爆款视频也 Clone 了。 上次搞个小红书爆款复刻 Agent, 用时半小时:抓爆款、拆为什么爆、复刻 3-5 条,再给运营策略。 那条发出去之后,很多人私信问同一句话:图文我会复刻了,视频怎么办? 对,图文这条路现在太卷了。标题能改,封面能仿,文案能洗。 视频这边一直卡死在最后一步:你知道这条为什么爆,也改得出口播,但成片还得自己找素材、自己剪、自己卡点。拆得再明白,出不了片,等于白拆。 现在这块可以用 Hypit 接上。 它不是让 Agent「想一条视频」,是让 Agent Clone 一条已经验证过的爆款结构:人物、台词、B-roll、字幕、特效、节奏,整套变成可改、可复用、可批量跑的 workflow。 你还是老流程,只是最后出片不用手搓了: 这次我直接复刻一个 书单带货的爆款视频, 具体搞法很简单: 1、直接先搞定Hypit安装部署: 2、启动 Claude Code / Codex 我直接把参考视频丢进去,/hypit clone this video 让Hypit自动分析,拆解,再改主持人、改产品、改语言、改 CTA。 3、如下图5.8万的点赞,已经很暴了,我现在要做的就是1:1复刻后,然后给我换新的图片和素材,字体等,为了就是发到抖音后不同质化。 4、下一次我再拆解一本书的话,就是直接把书名和文案丢进来,配音、视频效果,画面动效等直接教给Hypit搞定。 以前仿一条能投的视频,一个实习生一天:$60。写脚本 2 小时,拍 2 小时,剪 1 小时。 现在软件本体 $0,官方样例成片 $1 出头。 更狠的是,Clone 的不是 1 条,是一组能换壳的变体。 做小红书虚拟产品、抖音单品带货、AI 口播、知识付费引流的,别再只复刻笔记了。 笔记解决曝光,视频解决信任和转化。 这条比再找 10 个剪辑模板有用。 我把Hypit GitHub: 收藏仓库,别看完就走。 #Hypit #爆款复刻

老杨啊 | AI产品商业化

27,542 görüntüleme • 16 gün önce

Claude团队的工程师,已经彻底抛弃Markdown了。 不是Markdown不好用, 是AI变得太快,它已经跟不上了。 以前AI写10行笔记,Markdown刚刚好, 现在AI能一次性输出1000行计划、复杂流程图、完整代码审查, 密密麻麻的纯文字墙谁有耐心看得完? 作者自己都说,他从来没完整读完过100行以上的AI生成MD文件。 更要命的是:现在都是AI写,我们只看不改。 Markdown最大的优点“易手动编辑”,现在已经彻底没用了。 而HTML,才是AI时代真正的沟通语言, 它能做到的事,Markdown想都不敢想: • 直接生成带颜色的表格、SVG流程图、可点击的原型 • 加滑块调参数、拖拽排序任务、实时预览Prompt效果 • 改完一键导出成代码或Prompt,喂回给AI继续迭代 • 发个链接别人点开就能看,不用下载任何工具 作者直接放出了20个现成示例: 从代码审查的彩色diff, 到可拖拽的任务看板, 从动画参数调试器, 到一键生成的幻灯片。 每一个都是能直接用的生产力工具。 最爽的三个用法,现在就能抄: 1. 代码审查:让AI把PR生成带注释的彩色diff+模块调用图 2. 做计划:生成带时间线、风险表、流程图的交互式项目页 3. 临时工具:让AI写一个Prompt调参器,改完直接复制结果 当然它也有缺点: 多花一点token,生成时间长2-4倍,版本控制不如MD干净。 但作者说:体验提升了10倍,这些代价完全值得。 本质上不是格式之争,而是人机协作方式的升级。 因为Markdown是给人写给人看的, 而HTML是给AI写给人用的。 随着当AI越来越聪明,我们需要的不再是文字墙,而是能互动、能操作、能思考的界面。 现在打开Claude,输入“帮我做一个HTML文件……”,你会打开一个全新的世界。

AYi

1,399,981 görüntüleme • 4 ay önce

我把 AI 解说视频,彻底做成了一条“无人流水线” 丢进去文案和声音,后面的配音、分镜、画面、字幕、合成基本全自动 开源 4 天,350+ Stars,1000+ 人收藏。今天一次性把 cs-board 的全部功能讲透 并且新增加了自媒体封面修改功能,内置十种风格(还可以diy)还有市面上所有封面的尺寸(图二)👇 cs-board已经从一个 AI 白板视频工具,越改越像一个真正的 AI 内容生产工作台 以前用 AI 做一条内容,流程基本是这样的: 写文案 → 找模型改稿 → 克隆声音 → 拆分镜 → 生图 → 调风格 → 做动画 → 加字幕 → 做封面 → 导出 问题不是 AI 不够强 而是: 每一步都很强,但每一步都是孤岛 你要不断复制粘贴、切工具、重新上传素材、重新解释人物是谁、重新告诉模型你要什么风格 最后不是 AI 在替你工作,而是你成了 AI 工具之间的“人肉 API” 所以 cs-board 现在做的事情,本质上不是继续堆 AI 功能 而是把这些步骤做成一个有状态的内容生产工作台 1️⃣ 为什么我没有直接做“一键生成视频” 因为真正影响内容质量的,从来不是“一键” 而是中间状态能不能被控制和复用 比如现在 cs-board 生成一条视频,中间会留下: 配音 → 分镜 → 图片 → 分段视频 → 最终成片 这些都不是一次性的临时结果,而是检查点 假设你已经生成完所有图片,只是觉得字幕位置不对 正常 AI 工作流可能又得重新跑一遍 cs-board 不需要 直接从后面的渲染阶段继续 前面花过的钱和时间不重新花 我越来越觉得,AI 工具真正应该优化的,不是“第一次能不能生成”,而是: 第 17 次修改的时候,你还需不需要从头来一遍 2️⃣ 动态信息图为什么不是“让 AI 生成一张 PPT” 这个功能我改得比较久 因为我发现很多所谓 AI 视频,本质都有一个问题: 画面和人声是脱节的 旁白还没讲到第三点,画面已经把五点全部展示出来了 观众其实根本不会跟着你的表达走 所以 cs-board 的动态信息图不是: 文案 → HTML → 视频 而是先把真实旁白做成一个语义时间轴 一句话什么时候开始说、哪个关键词什么时候出现、哪个知识卡片什么时候展开,都跟实际音频绑定 所以画面不是按照“程序跑到第几秒”出现 而是: 你讲到哪,它才出现到哪 这其实是我现在做 cs-board 比较核心的一个思路: AI 负责理解内容,程序负责保证确定性 能交给代码控制的东西,我越来越不想交给模型猜 3️⃣ 为什么人物和画风要单独抽出来 以前最大的问题之一就是一致性。 第一张图是这个人。 第二张开始脸就变了。 第三张甚至连画风都换了。 所以现在自定义模式里,我把两件东西单独抽出来: 人物参考 + 风格参考。 可以放固定 IP,也可以放自己的品牌视觉。 人物最多可以提供多张参考图,风格也作为独立条件贯穿整个任务。 这意味着 cs-board 不只是帮你“生成一条视频”。 更重要的是: 它开始能够持续生产属于同一个 IP 的内容 对于真正做账号的人,这个区别非常大 4️⃣ 最近我又把封面也塞进去了 因为做完视频以后,我发现自己还得打开另一个工具做封面。 那干脆继续 Coding 现在封面制作直接放进工作台 粘贴文章 / 帖子内容以后: 自动理解内容 → 提炼标题 → 选择构图 → 生成人物与视觉 → 输出封面。 我没有只给一个“生成封面”按钮 而是先做了 10 种专业封面构图 因为封面的核心根本不只是图片好不好看 而是: 标题放哪、人物放哪、视觉重心在哪、第一眼先看到什么 构图是确定性的,审美才交给模型 这和前面动态信息图其实是同一套逻辑 5️⃣ 现在这个工作台正在慢慢变成什么 目前已经逐渐放进来了: 白板视频 / 自定义人物与画风 / 动态信息图 / 文案改写 / 对口型视频 / AI 封面制作 视觉模板现在也已经扩到了 12 套 音色克隆可以接本地 IndexTTS 任务、素材、配置、历史和成片默认都放本地 甚至同一个局域网里的电脑,可以共享制作队列 这也是我现在给 cs-board 定的方向: 不做一个 AI 视频生成器。 做一个可以不断往里面塞能力的 AI 内容生产工作台。 目前项目继续开源: 现在功能还远远没做完,下一步正在接入数字人工具 如图P3 但我觉得这条路,比继续做一堆“一键生成 XX”的小工具有意思多

陈硕KAI(耍门)

30,270 görüntüleme • 1 ay önce

埃隆·马斯克断言: 编码将在今年彻底死亡。不是“进化”。是死亡。 到今年12月,AI 将不再需要任何编程语言。它直接吐出机器码——那种二进制优化程度,远超人类逻辑所能触及的极限,没有翻译层,没有编译步骤,只有纯粹的、赤裸的执行。 马斯克原话:“你甚至都不用再费心去写代码。”代码从来就不是目的。它只是摩擦,是我们被迫支付的“人类税”——因为机器不懂人话。现在,AI 已经学会了流利的人类语言,这笔税,彻底取消了。再把这一切接入 Neuralink:没有语法,没有键盘,没有屏幕。 马斯克:“从想象直接到软件。”一个念头,就能变成可执行代码。你脑海中浮现一个结果,系统瞬间为你架构、优化、编译成现实。我们不是在“自动化编程”。我们是在把编程这个概念从宇宙中抹除。整个职业瞬间坍塌成一个念头。几十年的训练、无数行代码、无数个通宵——瞬间变得毫无意义。从“idea”到“成品”的距离,归零。你不再“构建”。你只需“想象”,它就具现。这不是渐进式进步。这是彻底的相变。人类一万年来“创造”的方式,在这一刻过时了。欢迎来到新世界。在这里,限制你的不再是技能、资源、时间…… 而是你能不能足够清晰地“看见”你想要的东西——然后让机器把它生出来。 我认为事情实际上可能会在今年年底之前就发生转变,到时候你甚至都不用再费心去写代码了。AI 会直接生成二进制代码,而且它生成的二进制会比任何现有编译器优化得更高效。所以你只需要说:“针对这个特定结果,生成最优化的二进制代码。”——这样就直接绕过了传统编码流程。 没错,这其实只是一个中间步骤,但我估计到今年年底,这个步骤很可能就彻底不需要了。

🌹MIDNIGHT🌹ROSE🌹

99,266 görüntüleme • 7 ay önce

我把 AI 手绘视频,做成了一条可以本地持续生产的自动化流水线,有人之前已经在抖音跑出千赞 现在市面上 AI 视频工具很多,但大多数只解决“生成一条视频” 我更想解决的是: 怎么把一条视频,变成一套能稳定复用、持续产出的生产系统 所以我把声音克隆、文案拆解、分镜、插画、白板动画、字幕和最终合成,全部接到了一起 你只需要做 3 件事: · 上传一段 10–30 秒的参考声音 · 粘贴一段你想表达的文案 · 选择画面风格和视频形式 剩下的交给系统: · 自动克隆声音 · 自动理解文案并拆分内容结构 · 自动生成统一风格插画 · 自动绘制白板笔迹动画 · 自动生成字幕并合成 MP4 · 失败后可以从断点继续,不需要全部重来 这次新版还加了一条我很喜欢的能力: 动态信息图模式 它不再只是“白板画画”,而是会根据真实旁白的时间,自动把内容组织成动态 PPT / 知识卡片 比如对比、流程、因果、时间线、层级、总结这些内容,都会用不同版式呈现 而且画面元素会严格跟着旁白出现,不会提前抢话,也不会靠字数瞎估时间 我自己的方案是: 本地 TTS + AI 文案理解 + AI 插画生成 + 本地渲染 目标不是做一个“好玩的一键生成器”,而是让一台电脑可以持续稳定地生产内容 如果你手里有矩阵账号、知识类账号,或者长期需要把口播文案转成视频,这套流程应该会比较有用 项目已经全部开源,能跑的代码都放出来了: 功能演示我会继续更新 创作不易,如果你觉得这个方向有用,欢迎帮忙转发、关注,也欢迎直接拿去改

陈硕KAI

12,217 görüntüleme • 1 ay önce

抽个猫卡 找找灵感!(附教程&提示词 🔥 用 AI 让你的 X 头像"活过来": 3 张图 + 2 段视频的做法 ① 准备素材 截一张自己的 X 主页(作背景),再准备一张头像原图(作角色)。两张图分工要在提示词里说死:主页只管布局,头像只管长相。这样模型不会把两张图里的头像细节混在一起。 ② 先定身高,别急着出视频 角色比例是最容易翻车的地方——头像是大头近景,模型会直接外推成 Q 版小矮人。省钱的办法是先用图片模型生成一张 A/B/C/D 四个头身比并排站的对照图,挑一个,再单独出一张站姿图。这张站姿图会成为视频的第三张参考图。 ③ 尺寸和比例分开锁 教训:光说"高挑""一米八"没用,模型不认。真正有效的是相对参照——比如"6.5 头身""站直后占画面高度 1/2 以上""约为头像圆框直径的 4 倍"。而且要明确:站姿参考图只决定比例,不决定大小,大小用画面占比单独说。 ④ 写分镜式提示词 按时间段写(0–1.2 秒、1.2–2.8 秒……),每段只写一到两个动作,动词要具体:翻出、敲、甩开、接住、装上、按下、书写。想让画面有"人设",就让道具从简介里的关键词长出来——我这里是 AI、DIY、播客三个模块。 ⑤ 必须出现的文字单独强调 要写在画面里的字(我用的是 Build in public. / Become more yourself.)单独一段,写"必须准确显示为""禁止拼写变化""每个字母从笔尖连续写出",再加一句"除此之外不生成任何新的可读文字"。 ⑥ 结尾留一堆"不要" 相机不动、页面不改、只有一个角色、道具数量固定、不真人化、不 3D、不加 Logo、无字幕。负面清单越具体越稳。 ⑦ 做续集:用上一段的最后一帧 把第一段视频的最后一帧截下来,当作第二段的 @图1,提示词里写"第一帧必须与 @图1 完全一致",就能无缝接上。想加宠物,直接喂真猫照片,但要求"转绘成与主角一致的插画风,禁止照片质感"。想让角色开口叫名字,写清楚说哪几个字、什么语气、几秒处,并注明不要生成字幕。 参数参考:Seedance 2.5,9:16 竖屏,720p,含音效。第一段 15 秒约 4k 积分,续集 4 秒约 1k。 整个过程我迭代了 3 次视频 + 3 张图,最贵的不是生成,是没先用图片把比例定下来、没有提前生成效果图预览。

Cell 细胞

22,033 görüntüleme • 29 gün önce