正在加载视频...

视频加载失败

Damn!喵个咪终于有人把跨国视频内容流水线做成完全开源的免费工具了,喜大普奔!! GitHub 上拿下 1.1 万星标的 OpenCreator,最狠的一点是把多平台分发的繁琐环节全压进了一台本地电脑, 比如你扔进去一个 40分钟的长视频,单次运行直接搞定全篇字幕断句、多语种翻译和语音配音,中途不需要人工去拉一条时间轴。 谁能想到三个月前多平台矩阵分发还是靠剪辑民工拼体力, 今天一个人用单机开源工具就能当成流水线来跑了,效率提升N倍🤯 做视频出海或跨平台分发的朋友都清楚,传统流程最折磨人的地方在于工具割裂。 你得先找工具下载,丢进语音模型转文字,找大模型润色翻译,再手动导入剪辑软件对齐口播节奏,最后还要一帧帧裁切画面改竖屏。 这个项目把整条链路全焊死在了一起, 输入一个公开视频链接或本地素材,它内置的流水线会自动估算口播语速并对齐音轨,文本太长时还会调用语言模型重新精简成口语表达,直接解决配音赶不上画面的死穴。 真正让我觉得有意思的是它的多端适配, 横屏长视频跑完之后,系统能顺手自适应成适合竖屏信息流的排版,连封面素材都能同步生成,直接对应 YouTube、TikTok、B站和抖音的内容规格。 关键是它有完整的开源桌面端,底层模型和 TTS 语音服务全部支持自由配置,不用再按分钟给第三方 SaaS 平台交昂贵的切片订阅费。 内容创作者和出海团队,这个项目值得拉回本地跑一遍。 一键克隆安装的命令和本地运行的踩坑建议, 我全部整理在评论区一楼了,老规矩自取喔😉

22,127 次观看 • 7 天前 •via X (Twitter)

6 条评论

AYi 的头像
AYi7 天前

很多做自媒体和出海团队的朋友想本地跑起来试试, 替大家把核心链路和运行准备梳理清楚了: 开源项目地址在 GitHub 搜索 krillinai 旗下的 OpenCreator, 之前叫 KrillinAI。 如果本地有现成的 Node 与 Python 环境, 只需要拉取代码并启动:
git clone OpenCreator
corepack enable
pnpm install
pnpm web:dev 建议大家在实际使用时注意两点:
第一是对音频质量的要求。长视频背景音过大时, 建议先开启工具自带的人声分离模块, 否则 100 多种语言的识别准确率会有轻微波动。
第二是算力开销。横屏转竖屏涉及视觉主体追踪, 本地显卡显存建议在 8G 以上, 如果没有独立显卡也可以接入云端接口来跑繁重的音视频渲染。 拿来搬运消化高质量长视频, 是目前市面上最省心的一体化方案。

Kiki 的头像
Kiki7 天前

这个好厉害,YouTube、TikTok、B站和抖音的内容规格孰能对应?

Demetre Minchev 的头像
Demetre Minchev6 天前

@tatian

bin sun 的头像
bin sun7 天前

1.1 万星说明痛点真实:跨国分发的脏活(字幕/裁切/平台规格)才是内容团队时间黑洞。本地一机跑完比再买一套 SaaS 划算,尤其要控素材出境时。接下来看它是否支持批量模板+失败重试队列。

Wuki 的头像
Wuki7 天前

开源神器啊,直接省下几万SaaS费 🤝 good stuff on your timeline! followed :)

热币反93小禾 的头像
热币反93小禾7 天前

这效率简直是个人创作者的开挂神器

相关视频

上个月一个朋友跟我说他要做自媒体,辞职了,全职搞 我说牛逼啊,一个月后怎么样了? 他说:我这一个月,60% 的时间花在了剪视频上 不是没东西拍——选题库存了几十个,每条都有爆款潜质 但一条 5 分钟的视频,从粗剪到精剪到加字幕到调色到配乐到转场,搞一整天 一个月下来就发了 8 条,涨粉不到 500 他跟我说,他觉得自己不是在做内容创作,是在做剪辑民工 我听完第一反应是:这怎么能是这样 作为一个做过产品的人,我很清楚——自媒体的生产链有两段: 第一段是内容生产:选题、写脚本、拍摄 第二段是后期生产:剪辑、字幕、配音、特效、调色、渲染 大部分人的瓶颈根本不在第一段,是在第二段 而且第二段的成本高得离谱—— 自己剪?一条视频 4-6 小时,一周更三条就是 15 个小时,一个月 60-80 个小时,等于每天下班后的全部自由时间 找人做?一条带基础特效的视频报价 800-2000,一个月出四条就是 3000-8000 做 MG 动效?After Effects 学半年起步,外包一条 30 秒少说三五千 然后你告诉我自媒体是试错成本最低的创业方式??? 可能只有不做视频的时候,自媒体成本才低 但问题是,从策划到后期,这整条链路恰恰是最适合 AI 接管的 我给他推了一个东西,叫 Fotor 的 Fotor Agent 别把它当成市面上那些“一句话出视频”的工具——那些出来的都是不能改的 MP4,错个字就得全盘重跑,烧钱又浪费时间 Fotor Agent 是一个全流程的 AI 制作人——你丢一个 Brief 或者一条竞品视频链接进去,它自己分析结构、规划分镜脚本,然后调配你的实拍素材和它自己生成的 MG 动效,最后在多轨时间线上排好所有元素 出来的是一个完全可编辑的工程项目——视频轨、音频轨、字幕轨、MG 轨分开管理,改哪里改哪里,不用从头来 我试了一下他堆积了一个月没剪的素材 丢了十几条实拍片段 + 一份产品 Brief 进去 它自己规划了脚本结构,挑了亮点片段,加了字幕和转场,排好了时间线 十来分钟,成片出来了。我在时间线上调了两处,导出,搞定 然后我做了一件更离谱的事——我试了它的 MG 动效能力 丢了一份 PDF 产品文档进去,让它做一条 30 秒的 4K 动态信息图 出来了,成本多少?$0.06 一秒,30 秒不到 2 美金 以前找外包做一条同样的 MG 动效,报价少说三五千人民币,周期一到两周 现在 40 分钟出初版,成本十几块钱,而且还能在时间线上直接改 这意味着什么? 1、做自媒体的:以前剪一条视频一天,现在一天能出三五条。后期时间从 60% 压到 10%,剩下的时间全拿来做内容 2、接视频制作单的:品牌方一条产品视频报价 5000-2 万,你的制作成本几块钱到几十块。客户要改?不用从头做,时间线上改完重新导出,十分钟搞定 3、做课程视频的:录屏 + PPT + 口播素材丢进去,自动编排成完整课程,还能加章节标题和过渡动效 它和市面上其他 AI 视频工具最大的区别: Seedance、Sora 那些是生成素材的——但“生成一段 clip”不等于“做完一条视频” “一句话出成片”的工具市面上一堆,但出来的全是封死的 MP4,改不了就得全部重跑 Fotor Agent 是从前期策划到后期工程全链条交付——而且能吃你的真实素材,最高 30 个文件单个 5GB,实拍的东西直接丢进去 对了,后来我那朋友用了一周,从一个月 8 条变成了一周 8 条 他说他终于觉得自己是在做内容创作了,不是在做视频民工 链接放评论区:

超级个体|柿子

74,968 次观看 • 4 天前

我靠,原来抖音一晚上卖 50w 的数字人,都是基于这个项目开发的。叫MoneyPrinterTurbo,7.4 万 star。 输个主题,AI 写文案、自动从 Pexels 扒无版权素材、配音、加字幕、配 BGM、合成出片。 我已经部署到自己的mac 电脑,并拿山海经 12 祖巫的故事跑了1次, 还挺好玩,只需要输入一个标题,出来的视频成品基本不用改。 LLM 写稿、TTS 配音、素材搜索、字幕识别、视频合成,五条互不搭边的技术链路,被它串成了一条自动化流水线。每一步的提供商都是可配置的。 拆开看,总共有这几个能力可供我们学习: → 脚本层:接了 15 种大模型,内置 20 多套爆款模板,支持中文 → 素材层:自动跑 Pexels 扒无版权视频,也能往里扔自己的素材 → 配音层:9 种语音合成方案,Edge TTS 免费,Azure 和 ElevenLabs 可切 → 字幕层:Whisper 做精准对齐,Edge 做快速生成,字体大小颜色随便调 → 合成层:MoviePy 把所有东西拼成一条高清视频,竖屏横屏都行 对电脑配置很低,CPU 就能跑,根本不用显卡。还自带的 Web 界面,也能用 API 和命令行。讲真,这配置对普通电脑来说挺友好的。 想做内容的,不想露脸,就先把仓库 clone 下来跑通一条视频,看看它怎么把五步串成一步。 做开发的,抄它的模块化思路。插件式架构加多方案可替换,自己项目里就能用这套拆法。 别只收藏啊,你看老王搞得成片,是那么个意思了。然后,你拆一遍它的流水线怎么搭的,比收藏 100 个工具值。

产品经理老王霸

184,777 次观看 • 3 个月前

这绝逼是目前我用过最能打的 AI 视频工具,没有之一!!! 纯纯的解放生产力,简直就是抖音、微信视频号起号的神器!! 兄弟们,你们敢相信视频里这个 1 分钟的水循环科普动画,是我几句提示词直接跑出来的吗? 没给任何素材,没有抽卡碰运气,喵个咪,真的是把短视频的制作门槛彻底砸穿了。 以前这种信息型 MG动画视频,基本只能交给会 AE 的人一帧一帧做,贵、慢、学习成本还高。 这样一条外包通常要 3000 到 8000 块、制作周期一两周的 60 秒科普动画,我用 Fotor Video Agent 实测跑出来,大概只花了 10 分钟,全程只点了一次方案确认,剩下的它全部搞定,真的牛逼!! 脚本、中文配音、15 个动画场景和可编辑多轨项目,它一口气全给做好了,质感完全可以直接发抖音和微信视频号起号。 以前这些零件要分开做,再丢进剪映里手动拼,这次全在一个系统里自动编排到时间线上,我没再切软件。 更绝的是生成完如果想微调,根本不用推倒重抽,直接在时间线上改场景,画布上点文字和颜色就能改,调声音也不用重烧,这体验太爽了。 很多人以为这又是那种输入一句话吐出一段不可控短视频的抽卡玩具,之前我也试过很多 AI 视频工具,要么画面飘忽不定,要么只能生成一段写死的 MP4,但这次自己跑了一遍才发现完全不是一回事。 我没准备任何分镜和素材,只给了它一段明确的水循环科普需求,后面的活基本都是 Agent 在接力跑: 1️⃣它先理顺水循环的结构,拆出 6 章旁白脚本让我确认,没有擅自跳步直接生成。 2️⃣配音给了 7 种中文音色试听,我挑了 Kian 男声,声音很自然,没有那种塑料廉价感。 3️⃣最狠的是分镜对齐,它按配音时长把旁白拆成 15 句话,对应生成 15 个独立 MG 场景,从蒸发、凝结到地下水和径流,画面和解说卡得很准。 4️⃣背景音乐和海浪、雨声、水滴这 8 处场景音效也全配齐了,跟旁白分轨铺在时间线上,听感非常干净。 以前做一条这样的片子,得凑齐分镜师、插画师、配音员和剪辑师。 现在一个会选题、脚本扎实的人,自己就能跑通整条动画生产线。 做过内容的人都懂,真正的痛点不是偶尔撞大运出一条爆款,而是能不能稳定出货。 科普、历史、商业拆解、读书解说、报告可视化,这类结构清晰的内容,现在都能用这条线批量跑。 现在接视频商单的逻辑也变了,客户付钱从来不只是买第一版好看,是买后续能改。 普通 AI 工具只给一条写死的 MP4,改个字都要重抽,Fotor 端出来的是能继续改的工程文件,场景、字幕、颜色、声音和时长随时能调,这才是能持续接单的交付状态。 我顺手翻了下 Fotor 的工作台,Video Agent 只是其中一块,里面还有 AI 生图、生视频、UGC 数字人和商品视频这些入口,更像一整套给创作者准备的营销工作台,这次我只深测了 Video Agent,其他的等我测完再聊。 最后想说,AI工具把视频制作门槛打下来了,但最后能不能打动人,拼的依然是你的选题和脚本,以及最重要的,就是你的审美和品味,这个需要我们持续的提升和沉淀。 Fotor #fotorai #fotorvideoagent

AYi

390,993 次观看 • 23 天前