Loading video...

Video Failed to Load

Go Home

上一次用的是可灵的模型,这一次用的是 sd2.0 的模型,角色选取的是我之前生成图片的其中的一个角色。 感觉在情绪把控这方面,真的已经很到位了,很难以想象两年前的AI还不会吃面,现在就已经能够精准的落泪了。 这才720p看着就这么的高清,那4k会是什么样子的

12,334 views • 13 days ago •via X (Twitter)

0 Comments

No comments available

Comments from the original post will appear here

Related Videos

之前用 Seedance 2 做了个做酸菜鱼的视频, 生成到第10秒的时候,美女的手直接伸进滚烫的锅里搅拌。AI完全不知道那样会烫。 当时觉得好笑,后来越想越觉得,这不只是 bug这么简单,现在的 AI 根本还没到理解物理世界怎么运转这一层。 这半年做了太多AI视频了,每次满心欢喜等它生成,结果经常是人物动作接不上、物体空间瞬移、手还没碰到东西物体就动了,各种幻觉 bug,真的挺折磨。 最近看到黄碧薇教授 Biwei Huang 的 Aether AI 官宣融资,认真看了一下方向,感觉它解释了很多视觉 AI 里反复出现的问题。 Aether AI 做的是因果世界模型。这个词听起来很学术,但放到视频生成里其实很好理解。 今天的视频模型,Sora、即梦、Veo,已经能生成非常真实的画面。杯子掉落、水洒出来、机械臂抓取,看起来越来越像真的。但它们很多时候是在根据海量视频经验预测下一帧,类似画面后面通常会发生什么,就生成什么。 所以桌子高了 2cm,机械臂就可能失效。明明伸过去的角度看起来对,杯子却自己飞起来了。画质够了,数据也不少,但模型没有真正理解这个动作为什么会带来这个结果。 Aether AI想做的,就是让 AI 学到变量之间的底层规律,比如桌子高度变了会带来什么影响,物体受力之后会怎么运动,一个动作会导致什么后果。 这类东西学进去,模型才能在没见过的场景里稳定推演、举一反三。对视频生成、机器人、自动驾驶、3D 世界模拟都会很关键。 视觉 AI 下一阶段的方向,可能就是从生成看起来合理的画面,走向理解画面为什么会这样变化。 黄教授 Biwei Huang 做因果AI 超过 12 年,这次 Aether AI 融资,我觉得是一个值得关注的信号:因果世界模型正在从学术前沿走向产业。 想了解的可以戳一下官网看看:

Adam也叫吉米

72,562 views • 2 months ago

Harry 是我的好朋友,他一直以来展示踏实靠谱的性格特征,持续的构建 Everlyn: 中心化的AI 视频模型 一开始 Everlyn 在开发阶段,目前使用 Everlyn-1.5 模型已经可以顺畅生成各种视频。 这值得令人兴奋,因为在Web3 领域终于诞生了用户可用的 AI 产品 这次不是概念,而是真实可以用的产品 而且相比于其他模型, Everlyn 的生成速度是其他模型的2-4倍,费用也比其他模型低 花费10美元的情况下,Everlyn (Pro) 可以生成125段视频,Kling 2 Master 只能生存 20 段 Everlyn 是类似社区节点的 Lyn miners(矿工) 进行去中心化的运营,过去一周内就已经有了1w名付费用户,一周内的收入也有 140,000 代币 TGE 之后 Lyn miners 将有更多参与网络发展的方式 视频生成领域的市场规模是足够大的, Sara2.0 也印证了这一点, Everlyn 大概率不会上演 TGE 之后协议空无一人的情况 因为 Everlyn 也从未承诺过视频用户会获得什么,而是社区用户自主为 Everlyn 付费,这是正确且健康的模式 代币的代码是: $LYN 15:00 将在 Binance Alpha 上线 15:30 在 Binance 合约 上线 团队的学术背景很强, Haryy 本来就是视频领域的专家,核心顾问的 Yann LeCun 还是图灵奖的获得者 项目由 Yzi Labs 孵化,完成了 1500 万融资,大家可以在 Binance Alpha 阶段订阅一下 其他视频模型在初创阶段就能获得亿元融资,Everlyn 在当前和未来的发展中应当展现的市值是多少呢? 相信 Everlyn 很快将推出下一代更真实,更便捷的模型

Vand Ni|Asian bro

20,175 views • 10 months ago

最近币圈是不是你妈进游资了,以前我觉得这个很扯,现在又觉得很现实。 HIPPO我是超级底部筹码,我是10.11大跌的时候在最底部把套利的很多meme直接全平了拿到现在。但是0.006的时候我就砸了很多出去。因为我觉得可能是和pippin一样,10X砸完收工。是的,PIPPIN我也拿了10X。但是砸完发现,价差还在扩大,一度将近-30%。让我想到了CUDIS,害怕ADL只能顶着溢价减仓套利的仓位,而且仓位本身还膨胀的很大,被迫亏出去一些。 玩了这么多年了,以前的感觉就是,狗庄撅个屁股就知道他要干嘛了。现在的感觉就是真的有点难了,其实这些人能这么顺利操纵,和10.11后盘口深度稀薄了超级多也有很大的关系。所以现在即使控制好了敞口,做了一系列风险控制,在已经考虑很多的情况下也只能和狗庄互掏的不相上下。操纵的人也在进化,真的很累,已经好多天没好好休息了。这也是我昨天说,当套仔们都开始被搞的时候,我真的有点悲观的原因,因为这代表着散户已经被干完了。 币安现在的后半夜,真的是全员恶人集合大乱斗,全是狗庄在疯狂的掏,涨幅榜和跌幅榜就像是两个世界,但昨天的涨幅榜就可能是今天的跌幅榜,就像jelly mmt。一边是cudis,hippo这些,一边是uai这些。UAI可能是错杀,可能是有人TWAP下错单子?因为最底部我看了就1M多持仓,链上价格正常,但也不敢多买,生怕是UXLINK,因为看不到任何消息。但万一不是我想的这样,是故意的呢?那更可怕了。反正总结就一句话,本就稀薄的流动性,更是雪上加霜了。 总之,越来越黑森林了,就一个目的,把兜里还剩钱的往死里掏吃干抹净,我是真劝你们,真别玩这些东西。专科生真就别非不服气要去干博士生了,真的。经验不够就是死,纯粹进去做波动的,就是百家乐。非要玩那个逼山寨就去找热点,比如炒了很久的隐私,今天又在炒储存。实在不行giggle那些消息面,波动也很大。这样亏钱的速度可以慢一点。 昨天觉得很累,今天又感觉胜负欲被激起来了,我决定每天蹲这些畜生老庄,更耐心更小心,互相掏,看尼玛谁掏的过谁。

带带带比特

55,800 views • 9 months ago

非常Nice啊,这模型完全免费,Token终于可以自由白嫖了,甚至视频模型都是免费的,太爽了。 它叫Agnes AI,全球模型榜前十,6 月 1 号起把自己家三个核心模型全免费开放了,无限期。图片模型在 artificial analysis 上榜了,文字模型一周被干了一万亿 Token。我把它接进 Claude Code,配起来十分钟的事,Token 随便用。 这玩意到底是什么呢。 Agnes AI 是全球模型榜单前十的一个 AI Lab,这次免费开放的是三个模型,文本、图片、视频。 文本模型叫 agnes-2.0-flash。能写代码,能做知识问答,能跑 Agent,能规划复杂任务。在 Claw-Eval 智能体评测榜进了 Top 10。说真的,这周它还要上 1M 超长上下文,以前用 200K 的模型跑到 150K 就降智,这种破事不用再忍了。 图片模型叫 agnes-image-2.1-flash。图改图、多图融合、换背景、改文字、图像修复,电商主图和广告素材这种反复改的场景,太合适了。最近还加了 4K 超高清输出,最高 4096×4096,生成的图可以直接进印刷,不是那种看着还行一放大就糊的草稿。 视频模型叫 agnes-video-2.0。原生音画同步,首帧生视频、首尾帧生视频、多镜头切换都支持,720P 和 1080P 随便选。 接进 Claude Code 怎么搞,其实很简单。 第一步,去 注册,拿到 API key。 第二步,打开 cc-switch。右上角选 Claude CLI,右上角点 + 号,选自定义配置。把 API key 填进去,请求地址写 格式选 OpenAI Chat Completions。 第三步,点获取模型列表,选 agnes-2.0-flash。 第四步,点左上角设置,找到路由,打开路由总开关,Claude 打开。 完事。 回到 Claude Code 正常发消息,模型就已经切过去了。我试了一个在酒吧吉他弹唱的视频,和真人区别不大。 现在 Token 不要钱,Agent 该跑几轮跑几轮,该拆几步拆几步。反正我觉得这才是免费开放最爽的部分,不只是省钱,是心理上解放了。 我测试了一下视频模型,能用,就是慢了点,文字模型还是比较快的。 开发者文档在 OpenClaw、Hermes、Claude Desktop 的,也有现成教程。

产品经理老王霸

51,324 views • 1 month ago