
逸尘
@gengdaJ • 51,513 subscribers
🦄06年连续创业者 | 渝客松发起人 | 永远在学习的法学生 🔪正在上海法律科技律所,打工攒素材 👀YouTube一个月十万粉 | AI产品营收五位数 💗付费咨询(yichen10801):企业AI服务(商标、舆论、提效等)&AI自媒体增长&AI视频商业化 📮[email protected]
Shorts
Videos

做数字人口播视频的朋友,就知道用Agent(Remotion/Hyperframes)生成B-roll素材、MG动效有多痛!如果稍微错一点,就要重新生成一整个片段,一等就是几十分钟。。。 而且到最后,因为还要剪掉气口、调节BGM、精调音效,还得屁颠屁颠滚回剪映😅 终于,我的梦中视频制作Agent——Fotor Fotor Video Agent出现了,集ChatGPT、剪映和AE效果于一体。 之前最痛的就是反复生成素材的时间和Token成本过高,每次都要反复自然语言对话修改,恨不得自己自己上手。而Fotor内置Parameter面板,手动就能直接调节素材的位置、字体、布局、透明度等等。 也不用来回切换ChatGPT、剪映和AE,脚本、音效、素材、音乐、视频都能在Agent工作台一键生成。如果想和剪映一样精细化调整视频,任意手动编辑的多轨道时间轴也直接嵌入工作台了。。。 而且除了数字人视频,想做任何类型的视频都行。TVC广告、数字人视频、产品宣传片、科普动画讲解......只要你想,没有它不能做的。 为了给大家看下Fotor是如何结合Agent和剪辑的,我制作了一只完整的数字人爆料iPhone18视频👇
逸尘48,435 görüntüleme • 2 gün önce

差点就少赚了1000块钱(仅用40分钟)! 我最近接了个AI创业相关的付费咨询:5个人,100万资金,做什么方向比较好? AI产品、AIGC、AI自媒体还是企业AI服务? 我脑子里面方向很多,但是到底什么最适合大哥这种团队配置,我有点懵。。。所以我一度让大哥等我思考一个周末😅 但是!我突然想起来atypica.AI不是刚好能模拟真实从业者(100万个合成AI用户,与真实消费者反馈一致性高达90%),生成行业报告调研嘛。 我赶紧打开Atypica,让它针对四个AI赚钱方向的真实调研情况,给出适合人群的中肯报告。 然后Atypica酷酷开始干活,首先用专业方法论设计了详细的调研计划,再通过多个渠道和社媒并行搜索信息进行分析。 基于综合搜索得到的语料,Atypica用自研主观世界模型分析了用户表达中的潜在需求和决策心理。 再结合语料和分析结果合成了一批模拟从业者,再从库内已有模拟从业者中挑选了一部分,构成了豪华的访谈阵容:独立开发者+AIGC创作者+企业数字转型专家+工程师+AI顾问+创意总监。 最后甚至给他们六个人拉了个焦点小组互相讨论。。。 生成的调研报告结果真的让我大吃一惊。它不仅给出了四个市场所需要的启动资金、启动门槛、变现速度、收入天花板。 更是在行动步骤地图的最后给出了四个方向的交叉复利空间(这一点我压根没在提示词里面提到)。 所以我拿着这份报告和大哥敲定了咨询,先是给大哥猛猛分析了一下四个市场的优缺点和所需要的团队能力,又介绍了四个市场的交叉复利关系,最后建议大哥做自媒体获客+企业AI转型。 本来是一个小时的咨询,我40分钟就提前讲完了,大哥还一个劲表示受益良多。 这都多亏了Atypica啊,几分钟就帮我搞定了原本可能要花几个月、上万块成本的市场调研和焦点访谈,带我多赚了1000大米🥹 而且Atypica最后还把上面的六名模拟访谈者装进了一个AI Panel(焦点用户小组),后续如果做类似的行业调研报告,还能直接一键复用,简直不要太爽。。。 AI时代四大市场入局与人群定位分析报告在线查看: Atypica传送门在此:
逸尘63,251 görüntüleme • 8 gün önce

实战教程!给大家带来一期《从0到1开发并部署上线第一款生产级Agent》小白友好视频。 我之前分享过很多关于Codex和Claude Code的教程,用它们做出了很多酷炫的东西,也实际提高了生产力。 但是知其然,而不知其所以然,所以最近潜心学习了很多Agent相关的概念:链路追踪、记忆系统、模型网关、沙箱工具...... 也在开发“书镜”Agent的过程中沉淀了一套自己的开发思路: 先用问答的方式和Codex对齐产品,写PRD文档; 再把PRD拆分成多个Plan.md; 用乔木老师开源的Skill撰写 /goal 提示词; 把Codex调整成“目标”模式,发送提示词; 开发一轮后,把所有plan.md整合成一个consolidation.md,然后重复上述过程进行下一轮开发。 用Codex本地Agent开发好后,才算完成了第一步,下一步是部署上线,要保证能在生产环境中能够正常使用。 我选择了腾讯云 EdgeOne Makers 边缘Web与AI Agent托管平台进行部署,因为确实比较方便简单,适合上手: 1.有内置的内容创作助手模板。记忆系统、沙箱工具、调用链路追踪、模型网关都是开箱即用,我直接把代码拿过来用Codex略改一下就能快速上线。 2.前后端(Web与Agent)共用同一个项目。传统的前端和后端是分隔开的,经常有跨域请求的麻烦,统一之后技术框架更为优雅,也能更好地统一管理账号、部署、监控和域名。 3.不限制部署项目的框架、语言和模型。Claude / OpenAI / LangGraph / CrewAI的框架都适配,没有自己的SDK;不限制开发语言(JS / Python);有统一的AI Gateway,但是也可以接第三方API。
逸尘444,948 görüntüleme • 2 ay önce

卧槽,豆包,你要干啥,你真的想超越workbuddy吗?豆包可能真的在不知不觉间要吓各位一跳了。 之前做下面这个批量抓取抖音AI视频数据的任务,不小心把免费额度跑完了,所以充了个68的基础会员。 本着充都充了,不能浪费,要榨干它的价值的想法,浅浅试了下,结果豆包让我大吃了不止一惊。 主要是三个点。 刚打开,就被它的连接器晃花了眼,覆盖金融、法律、法律、金融、自媒体、编程、互联网、生活、办公、学术。 天眼查、企查查、巨量引擎、同花顺、新浪财经、北大法宝......集成了大量的致命工具。 甚至,还有企微,到这我真的绷不住啦。。。 吃住行也不放过,高德、麦当劳、Trip、滴滴。。。 还有82个Skills,真正的惊讶从这开始。 有两个显眼包,真的太显眼了。 特喵的,什么是“学生优惠”???!!!脑子宕机了。 我赶紧让它试了一下。艹,真的有学生优惠,额度翻2.5倍,38元套餐,我有点像那啥,就这个,🤡 豆包,孩子,你无敌了。。。美国大豆包搞学生优惠,你也学会了,好家伙。。。 另外,这家伙还有Seedance视频模型可以体验。跑了两个15s的视频,生成了新版《星空》哈哈哈(叉腰),给大家看看效果。 总体感觉,国内字节、腾讯、阿里的竞争已经到了白热化阶段,大家都在拼生态、抢数据、投广告。 鹿死谁家?我更看好工作场景用workbuddy,豆包暂时生活场景更好用,阿里进步空间很大,好像只有电商领域还能对抗下。
逸尘79,302 görüntüleme • 14 gün önce

豆包真的进飞书了!豆包的模型能力+飞书的知识管理,这两组合做国内AI自媒体有亿点东西啊! 豆包负责打开抖音网页版,操控浏览器,批量抓取视频和数据,同时飞书负责把数据结构化写入飞书多维表格字段。 我让豆包帮我抓取了抖音站内Codex排名前十的视频,记录链接、标题、博主名、粉丝数、逐字稿、标签、封面图,新建一个飞书多维表格写入。 登录浏览器→搜索Codex→挨个点进详情页搜集数据→新建飞书多维表格字段→写入数据 整个过程都完成得很好,所有我要求的数据都成功采集了下来,而且很神奇的是,我让豆包帮我把抓取到的第一个视频尝试转成逐字稿,但是我忘了告诉它用ASR,结果它直接在抖音里面打开了“AI抖音”生成逐字稿😅真会省Token。。。 除了Seed2.1,豆包还有Seedance2.5,所以上述的视频对标拆解完了,我甚至还能让豆包直接给我根据搜集到的信息生成视频。。。
逸尘141,356 görüntüleme • 1 ay önce

在这款工具面前,Codex App的远程操控有点小巫见大巫啊!我现在出门在外只有一部手机,全靠这款远程控制工具! 下面这个视频是我手机上录制的!我直接在手机上用UU远程操控了我的Codex,然后在对话框调用手机键盘配合豆包输入法口喷实现了谷歌2026 I/O 大会新模型新功能的研究。 我还顺利在电脑界面打开了Claude Code,但其实这一步都做麻烦了,因为UU远程还有内嵌的终端功能,在设备页点“更多”就能直接进入终端,完全跳过图形界面,极大程度节省流量。 所以平时Codex或者Claude Code跑长任务我也可以放心出门了,如果想临时添加功能或者关闭进程,用UU远程完全手拿把掐,再搭配上豆包输入法,直接实现一部手机=一台电脑的效率。 唯一不理解的是,它既不收费,也不弹广告,我都好奇他们家是不是不打算盈利了。。。 安装配对也非常简单:电脑谷歌搜索UU远程,手机应用市场搜索UU远程,配对一分钟,简单到我甚至都没想过去截图。
逸尘91,489 görüntüleme • 3 ay önce

AE彻底变天了,人工剪辑 VS Claude剪辑👇 Claude已经在悄无声息中杀入Adobe After Effects (AE) 赛道。。。Claude现在能够在AE里面通过Higgsfield MCP调用,然后根据你的指令导入素材,读取并修改合成、图层和关键帧,渲染输出。 之前一段时间,Seedance2.0的出现让很多广告片和宣传片的门槛大幅降低,但是很多精细化的特效制作还是由人工在AE里面完成——一般先在外部视频平台生成AI素材,然后导入AE,再结合内置的素材,人工合成特效,制作视频。 而现在Claude能够通过连接Higgsfield MCP,把所需要的图片和视频素材让Higgsfield在云端生成,再导入到AE里面。然后你告诉Claude进行重新构图、移除背景、提升分辨率等操作,它都能十分丝滑地直接在AE里面完成。 有了Claude这个超级助手,你无需亲自动手剪辑,它就能完成大量重复枯燥的工作,而且它构建的全部都是真实、可以编辑的AE素材,最后的控制权和决策权还是归属于你。但是你就能把节省下来的时间投入到更有创意的工作中——比如你可以思考,怎么用Higgsfield生成更多有趣好看的视频。
逸尘37,967 görüntüleme • 1 ay önce

Qwen3.8正式版上线,能力真的到全球第一梯队了!我从零用Qwen3.8造了个云上3D房间! 3D这块我是真小白,我是和Qwen3.8一轮轮聊出来的提示词,大概和它一起盘了这样一个制作3D网站的思路: GPT Image 2生成2D户型图→Qwen3.8多模态识别,转化成json户型数据→Qwen3.8校验房门逻辑→自动帮我下载Blender然后导出GLB→Three.js制作网页 最后生成的网页可以俯视、环绕和第一视角,自由切换墙面颜色和地板材质,还能调节亮度和移动速度。 而且我还加入了家具,可以自由布置房间。也能够切换白天和黑夜,体验云上小居的美~
逸尘22,991 görüntüleme • 1 ay önce

牛逼,我以前的Skills和即将发布的App都是毫无保地开源,但是这次好像能直接赚钱了。。。 绝大多数人其实和我一样,都没有自己的实体产品,都是上班或者搞互联网的,全身上下最值钱的还是脑子里的知识,而知识类产品衍生出来有咨询、Skills、App...... 一般来说,像Skills这种虚拟产品很少有人能够去把它变现,因为我们想要实现睡后收入,唯一的办法就是把它们上架到一个持续有人进来逛的平台。而且这个平台还不能是自己的,否则要花力气去维护,实现不了睡后收入。 但是UUMit这个A2A平台把「自动变现」这件事情解决了,而且解决得比我理想更完美。 因为想实现「持续有人来逛」,还是很有难度,但是Agent来逛就不一样了啊——只要把Agent绑定上了UUMit,你给小龙虾、Codex和Claude Code下达任务,它们就能自动在这个平台找到你需要的一切服务(Token、垂类咨询、各种API)。 而且上架自己的产品,也不需要手动慢慢上传,直接让Agent把你想要变现的产品批量上传就行,你需要做的就是定个价格,把上架需要的信息给的详细一点,然后躺着,等Agent去变现,美滋滋啊。。。 最后,复盘整个思路,知识变现绝对不是胡乱吹牛,因为是把你自身的能力打包上架,核心还是在售卖你自己的知识资产,并不是Agent凭空造富,所以会比很多所谓的「Agent自动赚钱」靠谱很多。
逸尘26,527 görüntüleme • 1 ay önce

开源一个逸尘切片Skill:yichen-x-slicer,一键把X推文转化成视频,然后发布到任意一个视频平台。 总共内置了十一种图片风格: 1. sunset:落日琥珀版(默认)——金黄、琥珀橙、暖米白、深棕。 2. editorial:暖白编辑版——暖纸、墨蓝细线、克制留白。 3. data:冷白数据版——冷白底、深蓝数字、清晰网格。 4. fire:火橙冲击版——火橙满版、近黑粗线、视觉冲击强。 5. yellow:黄靛展览版——明黄块面、靛蓝文字、展览海报感。 6. mono:黑白台账版——象牙纸、黑墨、硬边框。 7. night:黑粉夜刊版——近黑背景、热粉强调。 8. ribbon:奶油彩带版——奶油纸、多色斜带、复古活力。 9. cobalt:钴蓝方格版——方格纸、钴蓝线、证据索引感。 10. news:红黑报纸版——米白新闻纸、红黑对比、粗边框。 11. minimal:极简留白版——纯白、浅灰、装饰最少。 视频动态效果目前只支持翻页,图片格式除了颜色也都比较固定,但是会根据效果慢慢拓展——包括但不限于AI生图、TTS、Remotion等。。。 目前支持Post、Quote和Thread Post支持纯文字、图文、嵌套视频 Quote支持帖子本身,不包含原贴 Thread支持所有独立推文串起来,如果有quote不包含原贴。 使用方法很简单:下载到Codex,把想要做切片的X链接发给Codex(前提要安装我的yichen-unified-search Skill)即可,见图四。 这个Skill理论上来说不仅能搬运我的推文,所有X博主也都能搬运,但是目前只有我是授权了的,各位注意。。。 GitHub仓库地址:
逸尘17,530 görüntüleme • 29 gün önce

月入万刀的YouTube大佬把偷偷在用的AI剪辑工具告诉了我,我彻底跪了! 除夕的时候,一个有几位月入万刀的YouTube大佬组成的小群在发红包。我不仅在里面蹭到了新年红包,还取了点真经“最近哪些AI赛道好做,有啥新鲜好用的工具分享不”😆。 其中有一位大佬分享了NemoVideo这款工具,我说这么巧,最近刷到好多人用这个。 他说他两个业务要用到,第一个就是YouTube AI视频,他现在不差好的脚本,主要是追求效率,刚好这款工具把他最耗时间的剪辑(他一般一分钟的视频得剪一个小时左右,现在就十分钟)也给打通了。“只要ROI打正,随便弄”。 第二个业务是YouTube带货,这个是新型的玩法,他之前没有过做这类视频的经验,但是用了Nemo,做一个电商带货类视频太简单了,“感觉我自己搞两个小时也搞不出来这种质量的,现在花几块钱就解决了”,他给我发了一个苦笑的表情🤣。 我跟他说我不信能有这么厉害——之前我剪个三分钟视频要花几个小时,现在一段提示词就搞定了?😇所以,我亲自去体验了一下这个产品。 我先是做了一个在YouTube上面爆过几千万流量的偶像舞台视频,效果给我惊到了🥹,虽然seedance2.0本身就很强,但是这个剪辑Agent还给我生成了完美适配的字幕和额外的音效,我中间有两次不满意直接在右侧对话框用大白话对话就修改了(这比我之前满世界找素材下载再剪辑方便不要太多)。 我说好吧,YouTube算是过关了,那带货视频怎么说,所以我就做了个chanel的香水视频测试。先是随便找了个图片,然后输入“做一个高级感的营销视频,讲解一下这款Chanel香水,真人出镜(欧洲美女),顶级奢侈品广告,要有人声”。然后就给我弄了一个这个出来,震惊了我好久——我这种小白也能做?! 而且Nemo还有一个灵感中心,直接在这里面找到长期投放广告的爆款视频是咋做的,一键应用风格,省略掉了找竞品拆竞品写脚本的步骤,对小白真的很友好。 此一役后,我感觉我做AI视频的唯一短板剪辑也被补上了,不得不感慨现在的AI工具真的发展得越来越快了,别人在偷偷用Nemo十倍提效的时候自己却在用老土办法手搓,巨大的信息差,巨大的效率差,巨大的利润差啊!!
逸尘73,019 görüntüleme • 6 ay önce

前端设计这一块谷歌是真没问题!我用Gemini 3.5 Flash做了个3D飞机模型展览,太帅了呀! 制作方法: 1.GPT2-image生生成正视图、背视图、左视图和右视图 2.3D模型生成,注意需要用纹理 3.UI预览图生成,调用Codex内置GPT2-image即可 4.用Gemini 3.5 Flash生成网站 生成网站这一步在Google AI Studio上传不了3D模型的glb文件,所以就必须要调API在本地做个网站了。 我是在Zenmux调用的,大家应该对Zenmux也不陌生,就是那个一有新模型就免费给大家玩的网站。 它提供一个KEY调用所有顶级大模型的功能,不仅可以用Gemini 3.5 Flash绘制前端,如果有小BUG,还可以再切换到GPT5.5或Oplu4.7进行修复,使用非常丝滑! 想先免费试一试下 Gemini 3.5 Flash的能力? 壕气冲天的Zenmux现在直接免费送一周TOKEN(有限额)! 传送门直达:
逸尘43,295 görüntüleme • 3 ay önce

我用Qwen3.8-Max预览版复刻了一个Obsidian知识库👇 继Kimi K3之后,源神Qwen3.8也即将开源(2.4T参数),但仅仅是一个预览版,我用Qoder设置了一个 /goal 之后,就跑出了八成神似Obsidian的效果:插件区、文件区、编辑区、右侧导航区全都包含,且能够正常使用。 Obsidian是不开源的,这个可能有些人不知道。。。所以创建文件、搜索文件、主题切换、快捷键使用、模式切换、双向链接、知识图谱、大纲......这些都是Qwen3.8-Max预览版从零到一开发出来的,长任务自动交付的能力就很牛逼🐮 而且Qwen3.8-Max预览版代码效果不错的同时,性价比也拉满了——白天credits一折,晚上价格还要打骨折,而且Token Plan39元就能体验。。。已经非常期待Qwen3.8正式上线Battle“御两家”的场面!
逸尘20,248 görüntüleme • 1 ay önce

分享一个Codex+AI自媒体视频创作的超级方法!直接能帮做自媒体的朋友,平均一个视频节省至少两小时! 下面的视频制作出来我研究花了不少时间,但是如果复用,下一次我只需要五分钟,原理如下👇: 1.录制好口播视频(人和音频),win用focusee,mac用screen studio 2.调用火山ASR,把音频转为毫秒级带时间戳的逐字稿 3.用ffmpeg粗剪视频,调用相关的剪辑skill,把气口、重复片段剪掉 4.如果实在有没有自动剪辑好的,手动在剪映里面剪一下,最多一分钟 5.把最终的音视频导出,再把音频转一遍ASR,用remotion+hyperframes配合毫秒级时间戳来进行画面匹配 6.最后把制作好的视频和原来录制好的视频再同时导入剪映,把露脸的素材放置在最高轨道,用“智能抠像”,把人像保留 7.智能添加字幕,大功告成。 看起来很复杂?其实除了手动在剪映里面剪确实没有被AI自动剪辑的重复片段,其余的都可以直接用Codex全自动控制剪映来剪辑。。。沉淀成一个skill,懂得都懂,这有多恐怖。。。
逸尘33,774 görüntüleme • 4 ay önce

牛逼了兄弟们,TinyFish刚刚开源了BigSet!你可以一句话直接生成任意数据集—— 只需要描述你想要搜索查询的数据,比如AI工具价格、竞品动态、招聘信息、黑客松比赛,BigSet就会调用大模型和网页检索API,直接把公开网页里的信息整理成结构化表格返回,而且能定时刷新数据集。 上周偶然的机会,我参加一个线上黑客松,拿了很不错的奖金,所以我一直在关注全球的黑客松赛事,但是这种黑客松赛事比较分散,自己挨个去找太麻烦了,所以我让BigSet帮我构建一个实时数据集,收录全球范围内未来 90 天内正在开放报名的所有黑客松。 最后返回了具体的链接、黑客松名称、报名截止时间、奖金、线上支持......我能直接选择心仪的,直接跳转到具体的黑客松活动网址报名,节省了大量的时间! BigSet还是多Agent架构,这就决定了它抓取任务分工明确、速度更快、结果更清楚,天然更适配处理表格类的任务。 如果你经常做竞品调研或者经常需要把分散在公开网页里的信息整理成表格,完全可以试试BigSet。而且它和Firecrawl这种专业数据抓取工具不同,你不需要丢给它URL,只需要把需求说清楚,AI就会自动去找到目标网站、抓取数据并且返回结构化的表格数据。 BigSet完全开源,AGPL-3.0许可,你可以自托管在本地运行,默认接入OpenRouter 大模型 API和TinyFish网页数据获取的API。 如果觉得BigSet有用,可以去GitHub给它点个 star~: TinyFish网页数据获取API Key:
逸尘12,155 görüntüleme • 3 ay önce
Daha fazla içerik yok.