正在加载视频...

视频加载失败

这两天满屏都在追孙哥的新闻, 但我更关心的是另一件事 :吉隆口岸泥石流事件 给Codex一条指令:完成中国吉隆口岸事故还原视频 然后Codex + Computer Use + Chrome插件 找资料、搜现场视频、补堰塞湖和口岸被毁的画面、核对 5200 米到 1200 米那段海拔落差、做三维地形动画、生成旁白、合成导出。 网页、终端、本地工具, 它自己在里面来回切,没让我接手。 最让我意外的是它自己收尾检测: 旁白把"2026 年"念错了,它重做语音、重排字幕、重新导出,然后从最终成片里再识别一遍确认改对了。 以前 agent 的问题从来不是不会做,是做完不知道自己做错了。这次它把这一环补上了。 给它真实的工作环境和权限,一句目标能一路做到可交付。 交付物就是这支 8 分钟的片子👇

86,949 次观看 • 9 天前 •via X (Twitter)

0 条评论

暂无评论

原始帖子的评论将显示在这里

相关视频

卧槽!我一个视频小白,只用一句话,就生成这种效果的视频! 我只说了句: “我想做一个很有张力的古风视频。画里的女生想逃出来,最后又被重新困回画里,你帮我看看怎么做。” 它脑洞大开,直接给我整了一个被巨型画笔追杀的画中人。 我没写分镜,也没拆镜头,故意装成纯小白: 当用户只有一个模糊想法,甚至不知道该怎么专业表达时,它到底能不能听懂? 做过 AIGC 视频的应该都知道,痛点其实不只在生成视频。 只要你前面需求拆偏一点,后面的人物、画风和剧情就可能一起跑偏。 好不容易生成出来,想改一个镜头,很多工具给你的又只是一条写死的内容,只能回去重新抽,时间和积分继续往里烧。 而且我平时得在 不同工具之间来回切换:搬参考图、搬提示词、下载素材,再把所有东西拖进剪辑软件里重新组装。费时费力,大部分时间都浪费在了搬运上。 这次我用 Fotor Video Agent Fotor , 先用长时序规划把整条故事该怎么走拆开,再把参考图、真实录屏、生成镜头、字幕、BGM、脚步声、画布撕裂声和心跳声,自动编排进同一个多轨项目里。 我不用每做一步就换一个软件。字幕、配乐、转场和画面布局也能在这套流程里继续完成;哪里不对,就留在项目里接着改,不必为了一个局部问题把整段视频全部推倒重抽。 它最后补出了一个灰白色的线稿世界,还放进去一支巨型画笔。 这个画笔确实挺有意思,它一出现,女生为什么要跑、为什么始终逃不出去、最后又为什么会被困回画里,一下就都有了解释。整个故事有了对抗,也有了闭环。 当然,这条片绝对不是一句话扔进去,一次就直接生成完了。 前前后后至少留下了 5 个完整版本。我一直看的还是最基本的东西:逻辑自然吗?人物和画风统一吗?衔接顺不顺?我要的张力有没有出来?不行就继续改。 所以这次真正让我感觉省事的,不是它把 AI 生成的不确定性彻底消灭了,而是需求规划、素材生成和后期组装终于能留在一个项目里继续推进。 最后这个东西到底能不能用,还是得由我自己拍板。现在这版也不是每个转场都绝对丝滑,但整体我能接受,不影响故事表达。 反正后面每次都能做到这个程度的话,我肯定会继续用。 Link in my bio. Try Fotor Video Agent. 成片放下面,可以看看效果。

木马人

15,437 次观看 • 6 天前

刚才做完这个30秒的薯片广告,我确信AI不仅仅是拿来玩的了! 第一次独立完成商业视频广告制作,我看了一遍又一遍。 说实话,心里有点激动。 不是因为画面有多炫,有多好玩,而是因为这东西真的能卖钱,咱们AI博主最终还是为了低成本产出、服务客户变现嘛 以前玩AI视频,多半是图个乐,动不动就崩坏。但这回我不一样,我先用 Nano Banana 生成了几张高质感底图,然后把剩下的活儿全扔给了 Medeo。 结果你们也看到了。 最让我惊喜的其实是它的全品类能力——原以为它只能做做动漫或二次元,没想到这种高精度的商业实拍风、甚至是教学视频、知识科普和剧情短片,它全都能一站式交付 。 最让我爽的不是画质,是那个对话即创作的过程。 我没开剪映,也没拉轨道,就像跟后期小哥聊天一样, “让薯片炸开的时候更有力一点” “这一段要配那种很脆的声音,要有食欲”它就真的听懂了,还能精准修改。这种言出法随的控制力,纯靠口喷做视频,以前想都不敢想 。 以前我觉得AI做商业视频还得再等等,但这支片子做完,我改主意了。薯片的纹理全程没变,一致性完全拿捏 ,光影也对得上,完全够得上去给客户提案的标准。 我简介里一直写着,AI是为了提效和搞钱的。 这话不是虚的。 如果是纯玩,我可能不会这么兴奋。但 Medeo 让我看到了怎么低成本地帮企业做东西。这才是我们手里最硬的武器,能把需求变成真金白银交付出去,而不是发个朋友圈就完了。 以后接单,底气又足了一分。 想尝试的可以访问官网: 附视频👇

Adam也叫吉米

17,221 次观看 • 8 个月前

Phone Harness 最近火了以后,大家开始意识到 Agent 终于可以真的操作手机了。 Phone Harness 的路线过于极客。 它需要 Mac 和本地 iPhone,通过 iPhone Mirroring 把手机画面交给 Claude Code 或 Codex,再通过截图和 OCR 理解屏幕内容,最后模拟点击、滑动和输入去操作这台 iPhone。 但同样是 Phone Agent,我觉得 Airtap 把场景往外扩了一层。 它不只是给 Agent 一个遥控手机的能力,而是真的给 Agent 配了一台完整的云端 Android。 我想看看这台 Android 到底能走多远,就给 Airtap Ai 的公开测试号 +1 (650) 444-9517 发了条 iMessage,让它直接打开 Termux 跑 Python。 这件事有意思的地方在于,Airtap 后面跑的本来就是完整 Android。 所以不只是能打开 TikTok、Amazon、Google 这些 App。 还可以直接装 Termux,Termux 本身就是 Android 上的终端和 Linux 环境。 打开以后运行 pkg install python 就能把 Python 环境装进去。 到这里,这台远程手机就多了一层完全不同的能力。 它不只可以点 App。 还可以直接成为一个远程代码执行环境。 这次我让它用 Python 获取 Hacker News 当前 Top 100 热门帖子,从里面筛出 AI、LLM、Agent、AI Coding 相关内容,再根据 score 和评论数排序,最后生成一份 HTML 报告。 整个过程都发生在远程 Android 里。 Airtap 打开 Termux,跑 Python,获取数据,处理结果,再生成 ai_hn_report.html。 报告完成以后,它还能把 HTML 打开,截图,再直接通过 iMessage 把图片发回来。 这也是我觉得 Airtap 和 Phone Harness 虽然都在做 Phone Agent,但使用边界很不一样的地方。 Phone Harness 更像是让 Claude Code 或 Codex 获得操作本地 iPhone 的能力。 Airtap 更像是直接给 Agent 一台可以自己干活的 Android。 App 是它的 GUI,Termux 是它的命令行,iMessage 是我给这台手机派任务的入口。 它可以去 App 里点,也可以进终端跑 Python。 可以抓数据,可以处理文件,可以生成 HTML,最后还能把图片和结果直接发回消息里。 所以比起 AI 终于会点手机了,我现在更感兴趣的是另一件事。 当 Agent 自己拥有一台完整的手机以后,还有多少原本需要电脑和手机来回切换的工作,可以直接丢给它

白骏知识分享

59,190 次观看 • 26 天前

我用掉 100 亿 Token 后,最大的变化不是更会写 Prompt。 而是 Codex 已经从一个聊天框,慢慢变成了我的: - 自我认识系统 - 工作系统 - 信息系统 - 学习系统 - 甚至是桌面陪伴系统 我把自己最常用的 20 个技巧整理出来了。 如果你也想把 AI 从“偶尔问一句”变成真正能长期协作的伙伴,建议先收藏。 一、让 Codex 逐渐认识你 1. 每天让它问你一个问题 我设了一个自动化:每天问我一个能帮助它更了解我、也帮助我认识自己的问题。它会避开已经问过的话题,围绕一个主题慢慢聊。 2. 把对话当成自我观察 现在可以直接语音聊。长期积累下来,它能看到我的情绪、偏好、反复出现的困扰和思考方式。 3. 让它把“它眼中的你”画出来 把你们的对话和一张漫画参考图交给它,让它生成多格漫画。你会发现:很多时候我们要的不是答案,而是被理解。 二、把 Codex 变成工作系统 4. 每周做一次 Codex 使用复盘 让它回顾这周我怎么使用它、哪些沟通方式有效、哪些任务返工了、哪些项目该继续推进。 5. 把失败经验写进“第二大脑” 不只是存笔记。把失败原因、偏好、最近关注点沉淀下来,让以后不同 Agent 都能调用同一份上下文。 6. 创意任务先开 Plan Mode 创意型工作最容易“没想清楚就批量执行,最后返工”。先用计划模式讨论目标、方案、数据体系和风险,再开始做。 7. 把 Codex 当思考顾问,而不是执行员 你甚至不需要有明确答案。只要说“我想做什么”,让它帮你一起把模糊的想法拆成可执行路径。 8. 需求清楚后切到 Goal Mode 需求确认后,把结果设成目标,让它自己持续推进。我的任务最长跑过 10 小时 44 分钟。 9. 用自动化处理重复但重要的事 日报、周报、账号监控、邮箱监控、回复策略、内容归档、同步到个人网站——这些都适合交给自动化。 10. 明确任务就开多 Agent 对于翻译、多语言网站、图片生成、资料整理这类边界清晰的工作,让多个 Agent 分工并行,比一个人盯着快得多。 三、让 Codex 跨出聊天框 11. 用 Sites 一键分享作品 做好网站后,不要卡在“怎么部署”。Sites 可以直接把成品变成能分享的站点。 12. 把插件当成能力扩展包 Computer Use、数据分析、Investment Banking、GitHub、Outlook / Gmail……很多工作不是“AI 会不会”,而是你有没有给它接上正确的能力。 13. 把生图能力接进日常工作 我已经用它生成了 300 多张图。做内容、配图、产品原型和视觉探索,速度会完全不一样。 14. 接入飞书,让手机也能操控 Codex 真正高频的协作不该只发生在电脑前。把它接到飞书后,我在手机上也能下任务、收结果、继续对话。 15. 用 ChatCut 把剪视频变成工作流 不是只让 AI 帮忙剪一刀,而是把素材整理、脚本、配图、剪辑一起接进创作链路。 四、建立自己的信息雷达 16. 每天订阅 Builder 信息 我会用 Follow Builders Skill 定时追踪 Builder 的新想法、新产品和讨论,再把重要信息推送给自己。 17. 做一个“灵感箱” 任何一闪而过的想法都丢进去。后面让 AI 自动搜索、补充背景、分类、处理,而不是靠脑子记住。 18. 盯住 GitHub 和 Product Hunt 让 Agent 帮你筛新项目、周榜、日榜和真正值得试的工具。看见感兴趣的,直接让它安装或进一步研究。 五、把输入变成你的输出 19. 把任何学习材料做成 HTML 学习页 看到一场好访谈、一个视频、一篇文章:让 AI 拉取内容、生成中文文字稿,边看边记评论,最后再变成摘要或短视频。 20. 给 Codex 一个“实体感”:做成桌宠 我很喜欢 Hatch Pet。它会根据状态跑动、办公、提示待办,甚至在你切换文件夹和工作区时给建议。AI 不一定要冷冰冰地躲在聊天框里。 100 亿 Token 给我最大的启发是: 不要把 AI 只当作“问答工具”或“临时外包”。 当它拥有你的上下文、目标、工作流和反馈后,它会越来越像一个能长期协作的系统。 换电脑时,我第一个装的软件就是 Codex。 写文档、做网站、剪视频、找资料、整理灵感……它已经覆盖了我工作和生活里非常大的一部分。 你最想让我把上面哪一条展开成教程? 评论区告诉我,我下一条就拆! #codex #chatgpt @thsottaux

Vivi Xiao

103,716 次观看 • 1 个月前

Codex 隐藏玩法:把你每天重复教 AI 的提示词,直接做成 Skill 90% 的人用 Codex,其实都在重复做同一件事: 开一个新任务,把同一套要求再告诉它一遍。这些 Prompt 你可能已经复制粘贴了几十次。 但其实,这种反复使用的工作方法,完全可以直接做成 Codex Skill。 详细教程如下: 1️⃣先找一段你经常重复使用的 Prompt,比如我最近一直在用这类提示词: “执行任务前先检查需求漏洞和潜在风险,不要默认接受我的方案。涉及代码和结论必须验证,完成后按验收标准逐项检查。” 这类 Prompt 很好用,但最大的问题是:每开一个新任务,都要重新贴一次。 2️⃣直接让 Codex 把它做成 Skill把原来的 Prompt 发给 Codex,然后告诉它: 请把上面这套工作方式整理成一个可重复调用的 Codex Skill。 要求: · 明确这个 Skill 适合在什么情况下使用 · 把原来的要求整理成清晰的执行步骤 · 区分任务开始前、执行过程中和完成后的检查 · 保留必要的验证流程 · 删除重复和模糊的要求 · 不要改变原来的核心工作原则 Codex 就会把原来散乱的一段 Prompt,整理成一套完整的 Skill 工作流。 以后这些规则就不用一直躺在聊天记录里了。 3️⃣ 后面直接调用这个 Skill 再开新任务时,不需要重新复制那一大段 Prompt。 直接告诉 Codex:使用这个 Skill 完成当前任务。 最后你的 Codex 里保存的,就不再是一堆 Prompt,而是你自己的一整套工作流。 Prompt 是教 AI 这一次怎么做。 Skill 是把你的工作方法直接固化下来,以后每个项目都能重复调用。

爱丽丝呀!

40,188 次观看 • 24 天前