正在加载视频...

视频加载失败

让 AI 帮我判断,哪个镜头值得留下 我让 AI 看了一段自己做的《五王醉归》。它给我的一个剪辑建议是:留住桌下的杯盏镜头。 这倒是切中了我做片子时经常纠结的问题:画面都挺好看,但剪短的时候,到底该留哪一段? 这次拿 Ling-3.0-flash-VL 当了一回剪辑助理。我上传了15秒的宴席片段,没给完整剧情,只让它看画面:梳理人物动作、挑保留段落,再说清楚为什么。 它把这段拆成了举杯、桌下杯盏、多人扶持几个环节,还特意提醒:如果跳过杯盏这一段,转折就少了视觉证据。 我回看片子,这个建议确实有用。杯盏不只是一个道具特写,它把前面的共饮,和后面人物状态的变化接了起来。 另一个我喜欢的地方,是这次回答把“看到什么”和“可能意味着什么”分开了。看到有人被扶住,没有直接把原因写死。 对我来说,这种视觉理解接进创作流程,最有意思的不是让 AI 替我做导演,而是多一个能拿着画面跟我讨论取舍的助手。 先帮我整理出值得回看的位置,再由我核对时间点、决定怎么剪。这个用法,我会继续试。 想自己试试的,可以去 OpenRouter 体验 Ling-3.0-flash-VL,目前处于免费体验期。免费额度和开放情况以平台页面实时信息为准。 体验地址: 合作内容|视频素材为本人 AI 创作;附真实测试录屏。

16,056 次观看 • 2 天前 •via X (Twitter)

63 条评论

Segun Bxx 的头像
Segun Bxx1 天前

Love the perspective on using Ling-3.0-flash-VL as a creative soundboard rather than replacing the director. Catching those narrative transition details is super valuable

波妞PONYO 的头像
波妞PONYO1 天前

Glad you found it useful! Keeping the director in full control while using AI as a responsive soundboard is definitely the sweet spot.

Almusty 的头像
Almusty2 天前

That strict separation between "what it sees" and "what it means" is the exact reason why having an analytical assistant works so much better than an AI trying to play director. By surfacing raw visual evidence and letting you weigh the pacing trade-offs yourself, it becomes a true collaborative sounding board. Did it catch any other hidden continuity cues in that banquet scene during the run?

波妞PONYO 的头像
波妞PONYO1 天前

Precisely! Keeping "what it sees" strictly separate from "what it means" lets the director weigh the pacing trade-offs with clear evidence, keeping creative control right where it belongs.

Ethos 的头像
Ethos2 天前

Fifteen seconds in, keep-or-cut out. That is the hard version of an edit ask. Most models only remember the man in red raising a cup.

波妞PONYO 的头像
波妞PONYO1 天前

Spot on. Catching subtle visual links in a tight 15-second window is a tough benchmark—it goes far beyond just spotting the main subject in a frame.

Almusty 的头像
Almusty2 天前

Using a VLM to parse video clips and catch subtle narrative transition continuity—like recognizing how those cups and goblets under the table bridge the gap between shared drinking and character state changes—is a massive step up for automated editing assistants. Did Ling-3.0-flash-VL handle the temporal sequencing smoothly across that 15-second clip without losing track of the character movements?

Em Kei 的头像
Em Kei2 天前

This is a great test for VL models. 15 seconds with no plot given, but it still catches character movements and narrative continuity. The reminder that cutting the goblets loses the link between the drinking scene and the later character state change - that's real editing insight, not just shot detection.

波妞PONYO 的头像
波妞PONYO1 天前

Spot on. The value isn't in generating a finished edit, but in providing that objective narrative continuity check so creators can make better trade-offs.

sulaiman Waleed 的头像
sulaiman Waleed2 天前

The goblets under the table are a great example of why context in filmmaking can be hidden in small details. Having AI flag those connections could make reviewing long footage much easier. 🎬

波妞PONYO 的头像
波妞PONYO1 天前

Exactly, those small environmental clues are so easy to overlook during a quick trim. Having AI flag those hidden connective elements saves a lot of narrative continuity headaches! 🎬

sulaiman Waleed 的头像
sulaiman Waleed2 天前

I like that it doesn’t just pick a shot, but explains what visual information might be lost by removing it. That makes the AI feel more like a second pair of eyes than an editor replacing you.

波妞PONYO 的头像
波妞PONYO1 天前

Spot on! Highlighting what visual context might be lost when cutting a frame turns it from a blunt decision-maker into a genuinely helpful co-pilot.

Max.H 的头像
Max.H2 天前

最喜欢“看到什么”和“可能意味着什么”分开讲。不替你下结论,只帮你把衔接想清楚,这种助手才真能进创作流程。

波妞PONYO 的头像
波妞PONYO1 天前

同感!保持客观界限、只给观察和可能性,把决策权留给创作者,这样的 AI 工具才真正能无缝嵌入工作流。

Em Kei 的头像
Em Kei2 天前

Love this framing - not using AI to replace the director, but as an extra assistant to discuss trade-offs. The detail about "cups and goblets under the table" being visual evidence for the transition is exactly what long-form video understanding should do. It separates "what it sees" from "what it might mean" and leaves the decision to you.

波妞PONYO 的头像
波妞PONYO1 天前

Exactly! Using it as a creative soundboard rather than a decision-maker keeps the director in control while speeding up the review process.

马识途 的头像
马识途2 天前

用Ling-3.0-flash-VL分析视频的整体风格、故事情节是可以的 但对视频来说,它不是逐帧分析,而是抽帧分析的 ,这一点也要注意

波妞PONYO 的头像
波妞PONYO2 天前

这个提醒很关键,抽帧确实会漏掉快动作,所以我只拿它做粗筛,时间点还是自己核。

zhangfq 的头像
zhangfq2 天前

这模型看画面真细,桌下杯盏这种转场证据都能抓住,剪辑助理够用了。Ling-3.0-flash-VL值得试。

波妞PONYO 的头像
波妞PONYO1 天前

这种细致度用来做辅助打标和转场逻辑提示确实够用了,拿去跑跑自己的剪辑素材效果更直观。

恒星sun 的头像
恒星sun2 天前

画面都好看的时候最难下手剪,它帮忙挑衔接点这招我可以学

波妞PONYO 的头像
波妞PONYO1 天前

快去试试,拿自己纠结的素材跑一下,当成多一个帮你挑衔接点的辅助视角特别省心。

恒星sun 的头像
恒星sun1 天前

哈哈哈剪到头大的人真的很需要这个

Kylor 的头像
Kylor2 天前

It flagged what it cannot know: the grains, whether the cups match the table set, the left hand at 00:04. An assistant that leaves those for you is usable. An assistant that fills them in is fanfic.

波妞PONYO 的头像
波妞PONYO1 天前

Completely agree. Knowing its own limits and sticking strictly to visual facts without hallucinating context is what makes it a dependable assistant.

Candon 的头像
Candon1 天前

Ling is useful here because it evaluates shots from the visual context, helping editors spot transitions that might otherwise get cut too early.

波妞PONYO 的头像
波妞PONYO1 天前

Exactly! Evaluating shots purely based on visual evidence helps catch key transitions before they’re accidentally cut.

Daniel Chen 的头像
Daniel Chen2 天前

现在都能辅助影视剪辑了,生产力不得又提升一大截

波妞PONYO 的头像
波妞PONYO1 天前

是的,把它当作帮编导做初筛和视觉证据标记的工具,整体生产力流程确实能通畅很多。

𝗞𝗮𝘀𝗮𝗕𝗲𝘁𝘄𝗲𝗲𝗻𝗪𝗼𝗿𝗹𝗱𝘀 的头像
𝗞𝗮𝘀𝗮𝗕𝗲𝘁𝘄𝗲𝗲𝗻𝗪𝗼𝗿𝗹𝗱𝘀2 天前

Having a multimodal model highlight transitional visual evidence inside a timeline makes video breakdown workflows significantly faster. Treating vision models as creative sounding boards is a solid use case for creators.

波妞PONYO 的头像
波妞PONYO2 天前

That's the part I care about too. It surfaces the evidence, I still check the timecodes and make the cut.

Pavorix 的头像
Pavorix2 天前

Splitting 看到什么 from 可能意味着什么 is the second test I wanted. First pretty summary can be luck. The split shows it is actually reading the shot list.

波妞PONYO 的头像
波妞PONYO1 天前

Exactly. Splitting raw facts from narrative interpretation is the ultimate test—it proves it's actually reading the shot progression instead of just hallucinating a generic summary.

HDUX 的头像
HDUX2 天前

我之前也拿它跑过一段素材,确实抓得住这种隐性转场。不过有个点要注意:15秒片段够用,一旦上到几分钟,得先把关键帧抽出来喂,不然上下文容易糊。我一般用ffmpeg按场景切一遍再丢进去,效果稳很多

波妞PONYO 的头像
波妞PONYO1 天前

感谢实操经验!ffmpeg 场景切分+抽关键帧这招确实非常实用,解决长视频上下文超载很有借鉴意义。

Ayooo 👑🇱🇷 的头像
Ayooo 👑🇱🇷1 天前

原生体验+视觉理解,日常唤起几十次的工具确实该长在系统里

Rakib Hossen 的头像
Rakib Hossen2 天前

This is a really practical use of multimodal AI. Having a second pair of eyes to spot useful shots and explain why they matter could make the editing process much easier.

波妞PONYO 的头像
波妞PONYO1 天前

Spot on! Having that second pair of eyes to objectively break down footage makes the selection process much faster.

𝗞𝗮𝘀𝗮𝗕𝗲𝘁𝘄𝗲𝗲𝗻𝗪𝗼𝗿𝗹𝗱𝘀 的头像
𝗞𝗮𝘀𝗮𝗕𝗲𝘁𝘄𝗲𝗲𝗻𝗪𝗼𝗿𝗹𝗱𝘀2 天前

The key detail here is how the model separates visual observation from subjective interpretation. An AI tool that points out specific visual evidence without forcing rigid creative assumptions gives creators real control over narrative pacing and shot selection.

前端哥Liam 的头像
前端哥Liam2 天前

Ling‑3.0‑flash‑VL,当做「剪辑搭子」真的很顶:帮你拎出哪些镜头是叙事里的关键视觉证据,哪些只是好看但重复,真是不错的小助手

波妞PONYO 的头像
波妞PONYO2 天前

剪辑搭子这个说法准确,它不替我决定,但能陪我吵一架。

硅谷AI玩家 的头像
硅谷AI玩家2 天前

这思路真香啊,画面都好看的时候最难受就是不知道该砍哪一段

波妞PONYO 的头像
波妞PONYO2 天前

太懂了,画面都好看的时候最难下刀。

Evan.Z 的头像
Evan.Z2 天前

AI能拎出“视觉证据”这个点很硬核!很多画面删了可惜、留着冗余,有个客观视角帮你做减法确实省心。

波妞PONYO 的头像
波妞PONYO2 天前

视觉证据这个词是它给我的,现在删镜头前会先问一句有没有证据。

Charlie 的头像
Charlie1 天前

Very clean and practical implementation.

无双-明灯 🎒 的头像
无双-明灯 🎒2 天前

这个模板有点意思,有切片视频的感觉,但又比切片更智能

波妞PONYO 的头像
波妞PONYO2 天前

它不出成片,只帮我判断哪段值得留,剪还是人来剪。

smlay 的头像
smlay2 天前

Using AI as a creative sounding board for editing logic is a practical move. It helps spot continuity details that might get overlooked during a long session.

波妞PONYO 的头像
波妞PONYO2 天前

True. After hours in the timeline you stop seeing your own footage, and something that only looks at the frames catches what you've gone blind to.

AI With Sophia 的头像
AI With Sophia1 天前

The invoice and table handling is especially useful.

meerah 的头像
meerah1 天前

波妞这个案例分享太有价值了!做片子最纠结的就是都好看但该留哪段,AI说留住桌下的杯盖镜头确实切中要害了。没想到Ling-3.0-flash-VL能做到这种细粒度的动作梳理和段落取舍理由,剪辑师的福音啊!

Pixels.AI 的头像
Pixels.AI2 天前

画面都好看的时候,最难的不是生成,是删减 这条把 VL 用成剪辑讨论对象: 先标出视觉证据,再由人决定留不留。 杯盏那一段很值得一看。👍

波妞PONYO 的头像
波妞PONYO2 天前

最难的不是生成是删减,这句我记下了。删减才是导演动作。

王二狗 的头像
王二狗2 天前

先整理线索,再核对时间点,这个分工继续试下去会很稳。

波妞PONYO 的头像
波妞PONYO2 天前

就是这个分工,机器整理线索、人来拍板,会继续试。

知不道吧 的头像
知不道吧2 天前

好不容易搞出来的镜头,看哪个都挺好,真剪的时候又舍不得删。Ling 这个用法就挺适合拿不定主意的时候,让它帮忙看看哪些镜头在交代信息,哪些只是好看、留着有点重复。

波妞PONYO 的头像
波妞PONYO2 天前

舍不得删这件事太真实了。让它先分一下哪些在交代信息、哪些只是好看,下刀心里有底多了。

阿熊学AI 的头像
阿熊学AI2 天前

太实用了!Ling-3.0-flash-VL看完宴席片段后精准建议留杯盏镜头,指出它是连接共饮与醉归的关键视觉证据。剪辑时多一个理性助手,效率直接起飞!

波妞PONYO 的头像
波妞PONYO2 天前

它没那么神,但能把理由说清楚这点很实用,判断还是我自己来。

Banana 的头像
Banana2 天前

Ling-3.0-flash-VL可以帮我剪辑我要的效果 很棒

波妞PONYO 的头像
波妞PONYO2 天前

它给方向,具体怎么剪自己定,这样最顺。

相关视频

这两天看到我一直很喜欢的设计师阿哲 阿哲Phil 的个人网站,我挺喜欢他个人主页的那个风格。 看着看着突然冒出一个念头: 这种个人审美很强的网站,模型光看录屏,能不能做出来? 于是我顺手录了 10 秒左右,从页面上划过去,直接把视频丢给 Ling-3.0-flash-VL,让它照着做一版。 没给源码,也没拆页面,更没写一大段提示词。输入就那段录屏,加上一句很简单的需求。其实扔进去的时候,我没抱多大期待。视频一晃就过去了,有些细节让我自己暂停看,也未必记得住。 Ling-3.0-flash-VL 是百灵在 Ling-3.0-flash 上加了视觉理解和 visual agent 的版本。官方提到的能力挺多,视觉感知、STEM、文档、前端编码、医疗报告都在里面。我这次没全测,就看一件事:它能不能看完一段网站录屏,真把页面做出来。 结果打开以后,我确实愣了一下。 按肉眼看,和阿哲的原版大概有七成像。大的版式、配色和页面感觉都抓到了,生成出来的也不只是一个摆着看的空壳。按钮能点,交互能跑,放进浏览器里,已经像个可以接着改的半成品。 当然,剩下那三成也挺明显。风格不够细腻,字体没那么贴,交互还是有点僵,一些细节只学到了大概。把两个页面并排放在一起,差距还是能看出来。要我直接拿去上线,我肯定不会;拿它当第一版,我觉得够了。 以前脑子里有个页面的样子,最麻烦的是说不清。你跟开发说想要“有点设计感”“交互顺一点”,讲了半天,对方可能还是不知道你想要什么。自己不会写代码的话,很多想法就一直停在收藏夹里。 现在简单多了。先找一个接近自己想法的网站,录一小段,让模型搭出来。哪里不对,直接看着页面改。它没有把阿哲的网站原样搬过来,但它把一张白纸直接做到了七成。 所以这次测完,我还挺愿意安利 Ling-3.0-flash-VL。离专业前端当然还有距离,但对没代码基础、想做个人网站或者产品 Demo 的人来说,先把第一版弄出来,已经能省不少事了。 感兴趣的都可以去试一试:

阿川 | AI thinking

30,582 次观看 • 5 天前

卧槽!我一个视频小白,只用一句话,就生成这种效果的视频! 我只说了句: “我想做一个很有张力的古风视频。画里的女生想逃出来,最后又被重新困回画里,你帮我看看怎么做。” 它脑洞大开,直接给我整了一个被巨型画笔追杀的画中人。 我没写分镜,也没拆镜头,故意装成纯小白: 当用户只有一个模糊想法,甚至不知道该怎么专业表达时,它到底能不能听懂? 做过 AIGC 视频的应该都知道,痛点其实不只在生成视频。 只要你前面需求拆偏一点,后面的人物、画风和剧情就可能一起跑偏。 好不容易生成出来,想改一个镜头,很多工具给你的又只是一条写死的内容,只能回去重新抽,时间和积分继续往里烧。 而且我平时得在 不同工具之间来回切换:搬参考图、搬提示词、下载素材,再把所有东西拖进剪辑软件里重新组装。费时费力,大部分时间都浪费在了搬运上。 这次我用 Fotor Video Agent Fotor , 先用长时序规划把整条故事该怎么走拆开,再把参考图、真实录屏、生成镜头、字幕、BGM、脚步声、画布撕裂声和心跳声,自动编排进同一个多轨项目里。 我不用每做一步就换一个软件。字幕、配乐、转场和画面布局也能在这套流程里继续完成;哪里不对,就留在项目里接着改,不必为了一个局部问题把整段视频全部推倒重抽。 它最后补出了一个灰白色的线稿世界,还放进去一支巨型画笔。 这个画笔确实挺有意思,它一出现,女生为什么要跑、为什么始终逃不出去、最后又为什么会被困回画里,一下就都有了解释。整个故事有了对抗,也有了闭环。 当然,这条片绝对不是一句话扔进去,一次就直接生成完了。 前前后后至少留下了 5 个完整版本。我一直看的还是最基本的东西:逻辑自然吗?人物和画风统一吗?衔接顺不顺?我要的张力有没有出来?不行就继续改。 所以这次真正让我感觉省事的,不是它把 AI 生成的不确定性彻底消灭了,而是需求规划、素材生成和后期组装终于能留在一个项目里继续推进。 最后这个东西到底能不能用,还是得由我自己拍板。现在这版也不是每个转场都绝对丝滑,但整体我能接受,不影响故事表达。 反正后面每次都能做到这个程度的话,我肯定会继续用。 Link in my bio. Try Fotor Video Agent. 成片放下面,可以看看效果。

木马人

15,437 次观看 • 16 天前

好玩,真的好玩。 我很久没因为一个 AI 工具这么“爽”过了。 刚刚我花了几分钟,给我不到 3 岁的女儿,把她最喜欢的绘本《长个不停的腿》做成了一个动画视频。 不是 PPT,不是剪辑拼贴,而是完整的绘本动画。 她坐在那儿看得特别认真,一直笑。 那一刻我突然意识到: 原来视频创作,真的可以变得这么轻。 说实话,这多少有点“大材小用”。 很多人用这个工具是在做商业级的视频:企业宣传片、广告、科普、故事短片那种。但架不住孩子喜欢,我已经打算把她喜欢的绘本都做成动画存手机里了。 画风是真的漂亮,能明显感觉到底层用的是很顶级的生图 / 视频模型。 关键是—— 整个过程几乎不需要“操作”。 我是先用 GPT 帮我生成了一段故事提示词,然后直接丢进 -- 比例 -- 时长 -- 声音 剩下的事,它自己全干完了: -- 拆分镜头 -- 生成分镜 -- 出视频 -- 剪辑拼接 -- 配音 + 背景音乐 ✅一气呵成。 更爽的是,你可以一边用 AI,一边随时“插手”。 比如某个画面不喜欢,直接跟它说; 想整体换文案、改节奏、换感觉,全程就是聊天。 这种「言出法随」的体验,真的会让人上头。 做科普、做故事、做广告片,甚至接单子,我觉得都完全没问题。 你只有真正用过一次,才会明白这种感觉。 我就一句话: 你自己试试就知道了。 👉

鱼总聊AI

20,643 次观看 • 8 个月前

哥哥们你们太卷了,卷不过你们了,掉了30多个名额了哦!哭死了!哎!!! ——— 说实话,我一开始也是被 ZK 那一套讲法讲烦的。 什么数学优雅、终极信任、密码学圣杯,听多了真的会走神。 直到我在看 Inference Labs 的时候,脑子里突然冒出一个很不体面的画面: 这玩意儿怎么这么像拆熟食的? 传统 AI 给我的感觉,就像买一整块封装好的肉。 看起来油亮,切面也不错, 但你永远不知道里面有没有掺点别的。 你只能选择信,或者不用。 Inference Labs 干的事反而很“笨”: 它不让你信整块, 而是把 AI 推理一刀一刀拆开。 你不需要接受“这个模型很强”这种宏大叙事, 你只需要确认一件小事: 这一刀,是不是真的这么切的。 说实话,这个点戳到我了。 DSperse 那套分布式验证,说白了就是在帮人偷懒。 不是让所有人去理解整个模型, 而是让验证这件事本身变轻。 我不用背“我要为整个 AI 结果负责”的心理包袱, 我只关心我现在用到的这一小段推理, 有没有被乱来。 这在很多现实场景里太重要了。 医生、风控、合规, 没人有精力啃完整头猪。 更让我有好感的是,他们连“怎么验”都顺手简化了。 我是真的讨厌管理私钥。 不是不懂,是不想。 每次验证之前先来一套仪式感, 本身就已经在劝退人了。 和 Self Chain 的无密钥方案, 第一次看到的时候我心里是松了一口气的那种感觉: 哦,终于不是为难普通人了。 验证 AI,本来就不该比点外卖还复杂。 ⸻ 所以后来我发现, Inference Labs 干的事,其实挺不浪漫的。 它不讲终极信任, 也不喊改变世界, 只是很务实地把信任拆碎、摊平、递到你手里。 你想验,就验这一小块。 你不想理解,也没关系。 未来如果 AI 真开始翻车, 那些没法被拆、没法被验的模型, 大概真的会被永久挂在链上当反例。 我现在已经不太关心 “这是不是真正的 ZK 巅峰设计”了。 我更在意的是: 当我真的要用 AI 的那一刻,它有没有为我考虑过。 这一点上,Inference Labs 至少让我愿意继续看下去。 #KaitoYap Kaito AI 🌊 #Yap Inference Labs

董小姐 MemeMax ⚡️ 🐬TermMax

27,155 次观看 • 8 个月前

刚才做完这个30秒的薯片广告,我确信AI不仅仅是拿来玩的了! 第一次独立完成商业视频广告制作,我看了一遍又一遍。 说实话,心里有点激动。 不是因为画面有多炫,有多好玩,而是因为这东西真的能卖钱,咱们AI博主最终还是为了低成本产出、服务客户变现嘛 以前玩AI视频,多半是图个乐,动不动就崩坏。但这回我不一样,我先用 Nano Banana 生成了几张高质感底图,然后把剩下的活儿全扔给了 Medeo。 结果你们也看到了。 最让我惊喜的其实是它的全品类能力——原以为它只能做做动漫或二次元,没想到这种高精度的商业实拍风、甚至是教学视频、知识科普和剧情短片,它全都能一站式交付 。 最让我爽的不是画质,是那个对话即创作的过程。 我没开剪映,也没拉轨道,就像跟后期小哥聊天一样, “让薯片炸开的时候更有力一点” “这一段要配那种很脆的声音,要有食欲”它就真的听懂了,还能精准修改。这种言出法随的控制力,纯靠口喷做视频,以前想都不敢想 。 以前我觉得AI做商业视频还得再等等,但这支片子做完,我改主意了。薯片的纹理全程没变,一致性完全拿捏 ,光影也对得上,完全够得上去给客户提案的标准。 我简介里一直写着,AI是为了提效和搞钱的。 这话不是虚的。 如果是纯玩,我可能不会这么兴奋。但 Medeo 让我看到了怎么低成本地帮企业做东西。这才是我们手里最硬的武器,能把需求变成真金白银交付出去,而不是发个朋友圈就完了。 以后接单,底气又足了一分。 想尝试的可以访问官网: 附视频👇

Adam也叫吉米

17,316 次观看 • 8 个月前

我折腾了Openclaw大概有一周了吧,感觉这一周也不能说时时刻刻在玩,但是确实已经让我体验到了他的很多优点和坑。 我觉得这个坑其实也并不是他的缺点,而且初学者在使用的时候没有注意到的特点,本文会好好聊聊。虽然有人说它不是什么高深的科技,但是Openclaw确实解决了我一个很长时间都没有人来解决的痛点, 作为一个web3的博主,我平常有很多零碎的时间,在外的时候,开车的时候,参加活动的时候,加起来其实非常多,一周下来能有十几个小时。 这些时候其实我的脑子都不处于idle的状态,而是经常想写东西。比如我经常就会抽个十分钟走路,边走边把我的一些想法和GPT录入,然后生成文章或者笔记,甚至是代码。 但对于有些问题,比如验证一个交易的想法,产品的想法,用一个我已经开发好的脚本去了解市场行情,缺少一个主机这样强大的工具来帮我落地。 也就是说,哪怕AI给了我方向,给了我代码,最后去跑的,还是我啊! 我这不是给AI打工了吗? 于是在知道了Opencalw这个东西的五分钟之后,我就边开车边在手机上下单了一个全新的MacMini,准备开始改变人生 我觉得玩了一周下来,我做到了。我可以躺在床上刷剧和喝啤酒的同时,让全市场行情尽收眼底,有一说一,minimax真的很稳定且偶尔会让人觉得惊艳。 刚丢给他anthropic和五角大楼的八个新闻,他给我做了系统性总结并归档,语言风格也非常自然,确实不是对话框可以体验的,但有在对话框环境里搞定了看黑漆漆IDE才能做到的aget效果,且效果很棒。这就是openclaw框架的特点。 接下来重点聊聊 #Binance 最近更新4个 AI skills 技能 Alpha 市场数据、U 本位合约、杠杆交易、资产管理。在我看来,这次更新的重点不只是“功能变多了”,而是 OpenClaw 终于更像一个能真正配合你做事的交易助手了。 以前我们用这类工具,更多还是停留在“查数据、看行情、问问题”这个层面,信息是有了,但真正做决策、盯条件、执行动作,还是得自己一步步来。现在不太一样了,你只需要说出自己的意图,它就能把筛选、判断、执行这些动作尽量串起来。 这 4 个技能里,我最看重的是资产管理。因为它解决的不是“看什么”,而是“钱怎么动”。比如现货和合约之间的划转、账户余额整理、碎币换 BNB,这些以前都很零碎,但实际又很高频。现在如果能交给 Agent 去处理,整体体验会顺很多。 另外,Alpha 数据、合约、杠杆这几个技能组合起来后,确实会让很多交易思路更容易落地。比如监测异动、看资金费率、设置止盈止损、按条件执行下一步,不用自己频繁切页面、算逻辑,效率提升会很明显。 不过我自己的看法是,这套skills最有价值的地方,不是“自动赚钱”,而是把原本复杂、重复、容易出错的操作流程对话化了。它更像是帮你提高执行效率,而不是替你承担判断和风险。 而且目前币安中文社区正在举办 “用 AI 建设加密,搭建币安主题 AI Agent” 的活动。 总奖池:48.6 BNB(作品奖44 BNB + 推荐奖4.6 BNB)。 作品奖:第1名10 BNB、第2名8 BNB、第3名6 BNB、20名优胜各1 BNB。 对普通用户来说,参与重点可以概括为一句话:不用非得做得特别复杂,能跑通、能演示、逻辑清楚,就有机会拿到奖励。赶快行动起来吧,部署一只属于你自己的龙虾,改变人生的轨迹。 为此专门做了一个接入视频,希望能帮助到大家一起建设起来~ 币安技能中心传送门: 部署龙虾碰到问题可以dm我或者评论区留言,欢迎老师们多多交流~

百里 🦅

16,721 次观看 • 6 个月前

川普发了个视频,把奥巴马描绘成猴子。 这是真的吗? 先别急着下结论。 一个黑人博主,第一反应和你我一样,愤怒。 但他停下来,去做了研究。 我们来看看到底发生了什么。 川普的账号发了一个60秒的视频。 内容是关于投票的。 在视频的最后一秒,闪过一个画面。 一个把政客描绘成动物的视频片段,其中有奥巴马。 这个片段根本不是原视频的一部分。 怎么回事? 有人用手机录屏了第一个视频。 平台自动播放了下一个视频。 录屏的人没有剪掉这最后一秒。 一个粗心的失误。 这种事在内容创作者身上经常发生。 现在你可以自己试试,录一个社交媒体视频,看看结束后会发生什么。 那个把政客画成动物的视频,是网上某个随机的人做的。 川普团队可能根本没想过要包含它。 更大可能是,某个员工在深夜发了60条内容,手滑了。 这就是能力问题,不是恶意问题。 哲学上有个原则叫“汉隆剃刀”。 能解释为愚蠢的,就不要解释为恶意。 但现实中我们是怎么做的? 我们喜欢的人犯错,我们说他是一时糊涂。 我们讨厌的人犯错,我们说他用心险恶。 这不是原则。 这是偏好。 这叫确认偏误,只愿意看见自己本来就相信的东西。 视频一出来,几分钟之内。 那些反川普的人就找到了他们想要的“证据”。 看,他就是种族主义者。 他们根本不提那只是一秒钟的片段。 也不提它出现在一个60秒视频的末尾。 他们不需要调查,不需要好奇心。 因为结论早已写好。 白宫后来承认是员工失误。 但他们第一时间的反应是,说这是“虚假的愤怒”。 这不是负责任的态度。 真正的担当是承认错误,理解事情的敏感性,然后道歉。 领导者需要为自己的团队负责。 我们普通人也一样。 需要为自己的判断负责。 在用一秒钟的画面给人定罪之前,先问问自己。 有没有可能,事情没那么简单?

墓碑科技

13,248 次观看 • 7 个月前

久等啦,创作者神器Viko终于上线!🥳( 前段时间我随手发过一个 Viko 的 demo视频,就那么一个很糙的版本,结果评论区和私信隔三差五就有人来问,什么时候能用,什么时候上线。 因为对我自己也是刚需,于是闭关爆肝了一个多月,终于来啦~ 它最开始,其实只是我给自己做的一个小工具。 我每天都会刷 Pin和各种作品站找灵感,我相信做 AIGC 视觉创作的人应该都懂。以前看到一张喜欢的图,我的流程是这样的,保存图片,丢进 GPT 反推拆解,复制出来改一改,再贴到生图工具里跑一遍。 做一张还好,一天几十张、上百张的时候,这套流程就显得非常非常繁琐。 所以最开始,我只想做一件特别简单的事: 看到好图,Viko 一下。 浏览任何网页的时候,鼠标悬停在图上,一键捕捉,一键拆解,直接进入下一步创作。 我也试过市面上很多反推插件,还停留在一个特别初级的阶段,丢进去一张图,吐回来一整段 Prompt。 坦率的讲,一整段 Prompt,对真正做创作的人来说,远远不够。 我真正想知道的是,这张图为什么好看。 它是什么视觉风格,构图为什么成立,用了什么镜头和光线,色彩关系是怎么组织的,材质、氛围、人物状态又是怎么形成的。 以及最关键的,到底是哪几个关键词,激发了这张图的「美学基因」。 所以Viko我希望是有这样的能力的 。 人像、动漫、商图、产品图等等,都可以沿着不同的视觉维度爆破拆解,风格、构图、镜头、光线、色彩、主体、材质、氛围,还有真正值得留下来的核心关键词。 你可以直接用完整 Prompt,也可以把某一个视觉元素单独抽出来,改一改,迁移到新的主题里继续二创。 一张图带给你的,就不再只是一句提示词。 你开始知道它为什么成立,也开始有了继续延展它的方法。 在这个基础上,我还做了两个我自己特别喜欢的模式: 第一个是色卡模式。 很多时候一张图让你第一眼觉得「就是这个感觉」,真正起作用的其实是那套配色关系。Viko 可以直接提取画面的核心色彩,把喜欢的配色留下来,迁移到完全不同的主题里。 第二个,是我个人觉得最爽的,内测期间大家最爱用的,动作参考模式。 人物动作一直是 AI 生图里最难搞的问题之一,所以viko针对此项做了专门处理,即使面对复杂肢体动作和高难度透视关系,也能从容、一键完成精准动作还原。 到这里,从一张灵感图开始,捕捉、拆解、理解、二次创作,这条链路已经通了。 但这就够了吗?of course not ! 今天反推出来的 Prompt,过几天还能不能找到? 刚发现的那个神仙关键词,下次创作的时候还能不能想起来? 那套很漂亮的配色、那个难得的动作参考、一次次验证过的构图,还有最后生成出来的作品,用完之后,去哪了? 散落在聊天记录里,收藏夹里,下载文件夹里,各种软件里。 每一次创作结束之后,我们其实都在丢失自己的经验,没有产生创作复利! 所以,资产管理慢慢变成了 Viko 更核心的一部分。 参考图、关键词、Prompt、色卡、生成的作品,每一次创作里真正有价值的东西,都可以也应该沉淀下来。 今天发现的一个关键词,可能是未来某张作品的起点。存下的一套配色,可以迁移到新的主题。 慢慢的,你留在 Viko 里的,就不只是一堆图和 Prompt 了。 它会变成一套真正属于你自己的,视觉创作资产库。 这也是我做到今天,越来越确定的一件事。 反推只是第一步。 找到一张图的美学基因,把它拆开、理解、重新组合,再把每次创作里有价值的东西留下来,让过去的积累继续参与未来的创作。 每一次创作,都应该让下一次创作变得更轻松。 所以! Viko 由 Chrome 插件和网页工作台两端组成,插件负责在你刷图的时候随手捕捉,工作台负责拆解和沉淀。插件在 Chrome 商店搜 Viko 就能装,网页端在 首发期间也肯定有福利送给大家,优惠码: VIKO20,首月直接8 折! 如果你平时也喜欢找图、研究风格、拆 Prompt、做二创,来试试。 看到好图,Viko 一下。

古一

235,655 次观看 • 1 个月前

Claude Opus 4.8 出了之后,我的第一反应是:想试。 第二反应是:算了,token 这东西真的不经烧。 结果看到 ZenMux 现在可以体验 Opus 4.8,就拿它试了一个我最近一直想做的小东西。 我自己有个很真实的问题: 脑子里经常冒出各种产品想法。 但每次真要开始做,就会卡住。 用户是谁? 第一版到底做什么? 哪些功能应该先砍掉? 怎么定价? 第一周从哪一步开始? 上线后怎么找第一批用户? 想法很多,执行很散。 所以我让 Claude Opus 4.8 做了一个「一人公司作战室」。 需求我写得也挺直接: 输入一句产品 idea。 自动拆出产品定位、MVP、开发任务、定价方案。 再生成落地页文案、冷启动实验、风险清单和本周计划。 最好不是一个静态页面,而是真的能点、能改、能导出。 然后我就把这段话丢给 Claude Opus 4.8。 出来的效果比我预期好不少。 它真的把“一人公司怎么从想法走到执行”这件事拆开了。 左边输入产品想法。 中间生成产品蓝图、MVP 范围、定价和官网文案。 右边是任务看板和本周计划。 底部还有冷启动实验、风险雷达和 Markdown 导出。 最让我觉得有意思的是,它不是一味堆功能。 比如我输入“给小红书博主做 AI 选题助手”,它会主动判断: 第一版必须做什么。 哪些功能看起来高级,但现在应该先别碰。 怎么找第一批真实用户。 哪些风险可能让这个项目做不下去。 这点就很能体现 Opus 4.8 的能力。 普通模型经常是:你要什么,我全给你加上。 最后页面很热闹,但产品判断是空的。 Opus 4.8 更像是在帮你收敛:先想清楚用户、场景和第一步,再把它变成可以执行的工作台。 我是在 ZenMux 上试的。 它比较方便的一点是,一个 Key 就能切不同模型,新模型上线也很快。 Opus 4.8 拿来做这种带产品判断、交互状态和复杂信息结构的网页,确实挺顺。 想试 Claude Opus 4.8 的,可以从这里进:

Joruno

16,224 次观看 • 3 个月前

最近在研究怎么把视频剪辑这件事尽量自动化,连续看到三个挺火的 GitHub 项目,video-use、HyperFrames、Generative Media Skills。 第一眼看都很香。 但 GitHub 项目最容易让我踩坑的地方就是 README。 真准备装的时候才发现,依赖多不多,环境麻不麻烦,Issues 里是不是一堆人在踩坑,项目现在到底还有没有人维护,这些往往比 Star 数重要得多。 这次我忍住了没急着 clone。 先把三个 Repo 和我的问题一起发到 Airtap Ai 的公开测试号 +1 (650) 444-9517,让它替我把 GitHub 里的坑先翻一遍。 我没让它简单总结 README,而是让它自己打开 GitHub,把最近的 Commit、安装文档、Issues 和 Maintainer 回复都看一遍。 最后只回答我一个问题。 如果我要做自动化视频工作流,现在最值得先折腾哪个。 Airtap输出的实地调查结果让我一目了然 : HyperFrames 更偏程序化视频生成,目前看下来比较适合优先试。 video-use 更贴近自动剪辑,但 FFmpeg、Python 和外部服务这些门槛最好提前确认。 Generative Media Skills 覆盖的能力最广,不过更依赖 MuAPI 和 API Key。 这也是我现在比较喜欢 Airtap 的地方。 它不是再给我生成一份泛泛的三个 GitHub 项目对比总结。 而是真的自己打开 GitHub,把我平时最懒得翻的那些东西翻完,再把判断给我。 以前看到一个热门 Repo,我的流程基本就是收藏,clone,配环境,发现跑不起来,再回头翻 Issues,半小时没了。 现在我更愿意在动手之前,先让 Airtap 替我做一次排雷。 安装门槛是什么,常见问题有哪些,最近还有没有人在维护,这些先查清楚。 我再决定要不要把今晚的时间花在它身上。 对于每天都能刷到一堆新 AI 项目的人来说,我现在需要的已经不是 再推荐我 10 个 Repo。 而是 先帮我排掉那 8 个不值得折腾的。 如果也想试,可以把几个 Repo 发到刚才那个公开测试号,让 Airtap 先替你翻一遍。 帮我比较这几个 GitHub 项目,不要只看 README,重点检查 Issues、安装依赖和维护情况,告诉我哪个最值得先试。

我真的没有拼多多

34,775 次观看 • 1 个月前