小互's banner
小互's profile picture

小互

@xiaohu119,220 subscribers

带你了解全球最前沿科技、AI动态... AI 精华,讲到你懂:https://t.co/nvuDIvoNg1

Shorts

卧槽 影眸科技(Hyper3D) 发布的世界生成模型 WorldGen 有点东西 它和其他可交互世界模型有不一样,它可以从一张 2D 图片,生成是一个完整的自带物理规律 3D 场景 更牛P的是: 每个物体都是独立的:就是场景里的桌子、椅子、小道具都能单独拉出来拆解成科移动、替换或微调的子3D模型。 自带物理规律:模型能理解空间摆放关系,并自动推断出碰撞、质量、摩擦力等属性。 直接对接生产管线:生成的资产可以无缝导入 Blender、Unity 或团结引擎,直接用于游戏关卡搭建、影视制作、XR 内容以及具身智能(机器人/机械臂)仿真训练

卧槽 影眸科技(Hyper3D) 发布的世界生成模型 WorldGen 有点东西 它和其他可交互世界模型有不一样,它可以从一张 2D 图片,生成是一个完整的自带物理规律 3D 场景 更牛P的是: 每个物体都是独立的:就是场景里的桌子、椅子、小道具都能单独拉出来拆解成科移动、替换或微调的子3D模型。 自带物理规律:模型能理解空间摆放关系,并自动推断出碰撞、质量、摩擦力等属性。 直接对接生产管线:生成的资产可以无缝导入 Blender、Unity 或团结引擎,直接用于游戏关卡搭建、影视制作、XR 内容以及具身智能(机器人/机械臂)仿真训练

124,693 görüntüleme

Seedance 2.0 限制真人出镜的原因找到了 🤣

Seedance 2.0 限制真人出镜的原因找到了 🤣

710,390 görüntüleme

早啊 篮球我还是爱看这种的🤣

早啊 篮球我还是爱看这种的🤣

297,748 görüntüleme

MiniMax 推出MiniMax Design 是一款面向商业视频与内容创作者的 AI Agent 客户端 配合其H3模型 通过 AI Agent把策划、分镜、生成、剪辑到交付的全流程串联了起来 下面是根据拍摄制作的一个特效AR视频 他内置了针对不同商业场景的专属模板,直接套用就能出片: 自动理解意图 无限画布(节点图协作) 技能与插件生态 开箱即用的预设技能 配合MiniMax H3 视频模型非常划算,不仅开源,且 API 价格极低(768P 约 0.5 元/秒,2K 约 0.8 元/秒,年卡低至 0.4 元/秒)

MiniMax 推出MiniMax Design 是一款面向商业视频与内容创作者的 AI Agent 客户端 配合其H3模型 通过 AI Agent把策划、分镜、生成、剪辑到交付的全流程串联了起来 下面是根据拍摄制作的一个特效AR视频 他内置了针对不同商业场景的专属模板,直接套用就能出片: 自动理解意图 无限画布(节点图协作) 技能与插件生态 开箱即用的预设技能 配合MiniMax H3 视频模型非常划算,不仅开源,且 API 价格极低(768P 约 0.5 元/秒,2K 约 0.8 元/秒,年卡低至 0.4 元/秒)

18,299 görüntüleme

2024年8月 - 2025年2月 AI出现了两次跃迁 一次是Deepseek R1的降本增效,效率大跃迁 一次是Grok 3的大力出奇迹,20万张GPU,有钱就是牛 目前来看,算力依然是紧俏资源,R1虽然训练用的资源少,但是在使用推理上耗费的算力依旧缺口非常大,但是终究都要走到降本增效的道路上》 视频来自:Arena 数据是2024年8月 - 2025年2月,Lmarena AI竞技场排名的变化。

2024年8月 - 2025年2月 AI出现了两次跃迁 一次是Deepseek R1的降本增效,效率大跃迁 一次是Grok 3的大力出奇迹,20万张GPU,有钱就是牛 目前来看,算力依然是紧俏资源,R1虽然训练用的资源少,但是在使用推理上耗费的算力依旧缺口非常大,但是终究都要走到降本增效的道路上》 视频来自:Arena 数据是2024年8月 - 2025年2月,Lmarena AI竞技场排名的变化。

552,103 görüntüleme

捕捉到了精髓… 脾气非常大 智商非常低 非常没有耐心 又非常非常小气…

捕捉到了精髓… 脾气非常大 智商非常低 非常没有耐心 又非常非常小气…

283,889 görüntüleme

卧槽,兄弟们,这个牛P啊 真是个伟大发明啊! 你让 Claude 帮你写了一个网页,但是想精准定位修改某一个地方,很难向AI描述出来 这个工具非常牛逼 安装后,你只需要: 1、点击任何网页元素 2、添加备注说明(如“这个按钮太小了”、“这个文字拼错了”) 工具自动捕获以下信息: 元素名称(class) CSS 选择器 元素坐标(位置) 元 素上下文(所在组件、文件路径等) 然后生成结构化的 Markdown 给你,你复制粘贴给AI就行,它就能精准知道你想修改什么👇

卧槽,兄弟们,这个牛P啊 真是个伟大发明啊! 你让 Claude 帮你写了一个网页,但是想精准定位修改某一个地方,很难向AI描述出来 这个工具非常牛逼 安装后,你只需要: 1、点击任何网页元素 2、添加备注说明(如“这个按钮太小了”、“这个文字拼错了”) 工具自动捕获以下信息: 元素名称(class) CSS 选择器 元素坐标(位置) 元 素上下文(所在组件、文件路径等) 然后生成结构化的 Markdown 给你,你复制粘贴给AI就行,它就能精准知道你想修改什么👇

199,733 görüntüleme

LibTV 全新视频 Agent 评测 可以接入Claude Code,一句话出片... LiblibAI 发布了一个全新的工作流 AI视频 Agent 平台LibTV,它可以在一张无限大的画布上,通过拖放节点来组合各种模型进行视频生成创作。 最牛P的是他们发布了一个skill技能,接入Claude Code、小龙虾,让AI能自动帮你编排节点... Claude Code等通过 Skill 接口全自动调用它的各种节点,自动帮你搭建节点,从剧本构思到最终成品剪辑自动跑完,一句话进去,成片出来。 我测试的过程中一直感叹,非常的牛P...

LibTV 全新视频 Agent 评测 可以接入Claude Code,一句话出片... LiblibAI 发布了一个全新的工作流 AI视频 Agent 平台LibTV,它可以在一张无限大的画布上,通过拖放节点来组合各种模型进行视频生成创作。 最牛P的是他们发布了一个skill技能,接入Claude Code、小龙虾,让AI能自动帮你编排节点... Claude Code等通过 Skill 接口全自动调用它的各种节点,自动帮你搭建节点,从剧本构思到最终成品剪辑自动跑完,一句话进去,成片出来。 我测试的过程中一直感叹,非常的牛P...

144,689 görüntüleme

卧槽 牛P了 特斯拉接入 Grok 后 现在Grok能调用车辆的各个摄像头来观察周围都是什么 这代表着特斯拉机器人其实已经在路上疯狂奔跑了

卧槽 牛P了 特斯拉接入 Grok 后 现在Grok能调用车辆的各个摄像头来观察周围都是什么 这代表着特斯拉机器人其实已经在路上疯狂奔跑了

189,886 görüntüleme

卧槽 Telegram 发布重大更新 - 现在机器人能发富文本了 - 还能让AI帮你管理群聊 - Telegram 终于上手表了 这不得够微信学习十来年?? 以前 bot 回消息只能纯文本,现在AI Bot支持: ・表格、清单、嵌套引用块 ・行内插图、图片轮播、拼图 ・可折叠段落、脚注、标题锚点 ・数学公式、上下标 单条最多塞 32768 个字符,超过 8000 字会自动折叠成一个"显示更多"按钮 适合 AI bot 输出长答案、做内容卡片的场景

卧槽 Telegram 发布重大更新 - 现在机器人能发富文本了 - 还能让AI帮你管理群聊 - Telegram 终于上手表了 这不得够微信学习十来年?? 以前 bot 回消息只能纯文本,现在AI Bot支持: ・表格、清单、嵌套引用块 ・行内插图、图片轮播、拼图 ・可折叠段落、脚注、标题锚点 ・数学公式、上下标 单条最多塞 32768 个字符,超过 8000 字会自动折叠成一个"显示更多"按钮 适合 AI bot 输出长答案、做内容卡片的场景

68,143 görüntüleme

这个视频有意思 不过不是AI生成的 是用Blender+After Effects 制作的 有没有大神能用 AI 复刻一下...

这个视频有意思 不过不是AI生成的 是用Blender+After Effects 制作的 有没有大神能用 AI 复刻一下...

215,053 görüntüleme

阿里刚发布了Qwen3.6-Plus 直接冲着"国产最强编程模型"来的 跑分上,SWE-bench 和 Claw-Eval 都超过了 GLM-5 和 Kimi-K2.5,是目前国产模型里最接近 Claude 的 实测了一下前端,确实有点东西 阿里云百炼已上架,价格不到 Claude 的十分之一 阿里这几天连发三个模型,平均一天一个: 3月30号,Qwen3.5-Omni 全模态 4月1号,Wan2.7-Image 图像生成 4月2号,Qwen3.6-Plus 编程模型 感觉熟悉的千问节奏又回来了..

阿里刚发布了Qwen3.6-Plus 直接冲着"国产最强编程模型"来的 跑分上,SWE-bench 和 Claw-Eval 都超过了 GLM-5 和 Kimi-K2.5,是目前国产模型里最接近 Claude 的 实测了一下前端,确实有点东西 阿里云百炼已上架,价格不到 Claude 的十分之一 阿里这几天连发三个模型,平均一天一个: 3月30号,Qwen3.5-Omni 全模态 4月1号,Wan2.7-Image 图像生成 4月2号,Qwen3.6-Plus 编程模型 感觉熟悉的千问节奏又回来了..

101,639 görüntüleme

3D 圈的人看到这个应该会沉默几秒 3D 模型再次进化 Hyper3D 这个 BANG to Parts功能有点牛P 你丢给它一个完整的 3D 模型,AI 会自动帮你把它拆解成一个个独立的、完整的的3D零件 也就是可以将任何完整的 3D 模型自动拆解成多个3D的零件 拆好的零件可以直接用来做动画、改材质、甚至去 3D 打印 这能帮 3D 设计师省下大把“手动擦屁股(清理模型)”的时间 更狠的是:拆完还能接着拆 整车 → 拆出车轮 → 车轮再拆出轮毂、轮胎、螺丝。 理论上你想拆多细拆多细。 而且每个零件都是独立完整的 3D 模型:单独换材质、单独改形状、甚至单独重新生成一个新的换上去 3D 模型第一次变成了“乐高”,而不只是“手办” 还有一个关键点是:拆出来的每个零件都是完整、独立、可编辑的 3D 模型。换材质、改造型、缩放变形、甚至整个重新生成一个换上去,都行 借助目前Codex和Claude code的强大能力,打造一个 3D 模型/开发工作流,非常牛P

3D 圈的人看到这个应该会沉默几秒 3D 模型再次进化 Hyper3D 这个 BANG to Parts功能有点牛P 你丢给它一个完整的 3D 模型,AI 会自动帮你把它拆解成一个个独立的、完整的的3D零件 也就是可以将任何完整的 3D 模型自动拆解成多个3D的零件 拆好的零件可以直接用来做动画、改材质、甚至去 3D 打印 这能帮 3D 设计师省下大把“手动擦屁股(清理模型)”的时间 更狠的是:拆完还能接着拆 整车 → 拆出车轮 → 车轮再拆出轮毂、轮胎、螺丝。 理论上你想拆多细拆多细。 而且每个零件都是独立完整的 3D 模型:单独换材质、单独改形状、甚至单独重新生成一个新的换上去 3D 模型第一次变成了“乐高”,而不只是“手办” 还有一个关键点是:拆出来的每个零件都是完整、独立、可编辑的 3D 模型。换材质、改造型、缩放变形、甚至整个重新生成一个换上去,都行 借助目前Codex和Claude code的强大能力,打造一个 3D 模型/开发工作流,非常牛P

30,049 görüntüleme

Seedance 2.0 今天正式开放了 API 各大平台陆续接入了 Seedance 2.0,告别了生成视频排队状态 而且有的平台还给开放了支持上传真人照片的能力 Tekan AI是首批支持真人人脸的,估计是他们主要是广告场景 Seedance 2.0用来生成广告真是真不错 上传一张脸,Seedance 2.0 直接用这张脸生成视频,全程面部一致。

Seedance 2.0 今天正式开放了 API 各大平台陆续接入了 Seedance 2.0,告别了生成视频排队状态 而且有的平台还给开放了支持上传真人照片的能力 Tekan AI是首批支持真人人脸的,估计是他们主要是广告场景 Seedance 2.0用来生成广告真是真不错 上传一张脸,Seedance 2.0 直接用这张脸生成视频,全程面部一致。

88,279 görüntüleme

可以的有意思 好玩 试玩:

可以的有意思 好玩 试玩:

28,515 görüntüleme

人家老马搞出来的这个UI就是看着高级 Grok 3的思考模式UI效果 高级而不失优雅🙂

人家老马搞出来的这个UI就是看着高级 Grok 3的思考模式UI效果 高级而不失优雅🙂

248,394 görüntüleme

Claude 开发者大会给KOL发的这个Cardputer感觉很不错 售价 $29.9(约 ¥215) 可以: 在 Cardputer 上敲问题 → 通过 WiFi 发到你电脑 → 电脑上的 Claude Code 处理 → 结果回传到小屏幕显示 当语音对讲口:按住按键说话 → 录音传到你电脑 → STT 转文字 → 喂给 Claude → TTS 播回小喇叭 当 Claude 的"实体宠物":屏幕上跑个像素小动物,Claude 思考时它在动,回答时它说话 也可以把把 Cardputer 接到 OpenClaw上,支持语音输入、TTS 语音回答

Claude 开发者大会给KOL发的这个Cardputer感觉很不错 售价 $29.9(约 ¥215) 可以: 在 Cardputer 上敲问题 → 通过 WiFi 发到你电脑 → 电脑上的 Claude Code 处理 → 结果回传到小屏幕显示 当语音对讲口:按住按键说话 → 录音传到你电脑 → STT 转文字 → 喂给 Claude → TTS 播回小喇叭 当 Claude 的"实体宠物":屏幕上跑个像素小动物,Claude 思考时它在动,回答时它说话 也可以把把 Cardputer 接到 OpenClaw上,支持语音输入、TTS 语音回答

59,387 görüntüleme

Seedance 2.0 最佳使用方法是在小云雀里面 随便丢抖音视频链接,作为参考视频,然后上传你的视频,它就能参考视频来帮你生成视频… 很牛P,就是时间特别久😊

Seedance 2.0 最佳使用方法是在小云雀里面 随便丢抖音视频链接,作为参考视频,然后上传你的视频,它就能参考视频来帮你生成视频… 很牛P,就是时间特别久😊

63,477 görüntüleme

Remotion 推出这个面向 Claude Code 的 视频制作 Agent Skills 不错 只需输入你的需求Claude Code 便可以制作一个完整的宣传小视频给你 我要求Claude code 根据它对我的了解,调用 Remotion 技能帮我生成一个小视频... 这个比较简单,但是官方的演示的很炫酷,需要再研究下怎么弄。 有谁懂这个?带带我?

Remotion 推出这个面向 Claude Code 的 视频制作 Agent Skills 不错 只需输入你的需求Claude Code 便可以制作一个完整的宣传小视频给你 我要求Claude code 根据它对我的了解,调用 Remotion 技能帮我生成一个小视频... 这个比较简单,但是官方的演示的很炫酷,需要再研究下怎么弄。 有谁懂这个?带带我?

58,552 görüntüleme

Anthropic 发布了 Skill Creator 的重大更新 核心变化:内置测试用例生成 写完一个 Claude 技能,怎么知道它到底能不能被正确触发?以前靠手动试,现在 Skill Creator 内置了测试功能,帮你自动跑评估。 你现在可以给技能定义一组测试提示词,描述"什么样的回答算合格",然后让系统自动跑测试、出报告。 不需要写代码,不需要搭测试框架。 具体新增了四个能力: 自动化评估(Evals): 定义测试提示词和预期结果,系统自动运行并追踪通过率、耗时、token 用量。当模型更新或基础设施变化时,你能立刻发现技能是否"退步"了。 多 Agent 并行测试: 测试用例不是排队跑的,而是在独立的 Agent 中并行执行,每条测试互不干扰,各自有独立的 token 和耗时统计。 A/B 对比: 系统用"比较器 Agent"对两个版本的技能做盲测对比,去掉主观偏见。你改了技能描述,想知道新版比旧版好还是差,直接跑一轮对比就有答案。 触发率优化: 这可能是最实用的功能。系统会分析你的技能描述和测试提示词,建议怎么改描述才能减少误触发和漏触发。官方测试中,6 个公开的文档类技能有 5 个的触发准确率得到了提升。

Anthropic 发布了 Skill Creator 的重大更新 核心变化:内置测试用例生成 写完一个 Claude 技能,怎么知道它到底能不能被正确触发?以前靠手动试,现在 Skill Creator 内置了测试功能,帮你自动跑评估。 你现在可以给技能定义一组测试提示词,描述"什么样的回答算合格",然后让系统自动跑测试、出报告。 不需要写代码,不需要搭测试框架。 具体新增了四个能力: 自动化评估(Evals): 定义测试提示词和预期结果,系统自动运行并追踪通过率、耗时、token 用量。当模型更新或基础设施变化时,你能立刻发现技能是否"退步"了。 多 Agent 并行测试: 测试用例不是排队跑的,而是在独立的 Agent 中并行执行,每条测试互不干扰,各自有独立的 token 和耗时统计。 A/B 对比: 系统用"比较器 Agent"对两个版本的技能做盲测对比,去掉主观偏见。你改了技能描述,想知道新版比旧版好还是差,直接跑一轮对比就有答案。 触发率优化: 这可能是最实用的功能。系统会分析你的技能描述和测试提示词,建议怎么改描述才能减少误触发和漏触发。官方测试中,6 个公开的文档类技能有 5 个的触发准确率得到了提升。

46,969 görüntüleme

Videos

xiaohu's profile picture

这才是真正的AI输入法 😂

小互

1,413,277 görüntüleme • 8 ay önce

xiaohu's profile picture

艹 这个有点逼真啊🫣

小互

748,057 görüntüleme • 1 yıl önce

xiaohu's profile picture

Codex 成瘾患者 正在接受治疗... 😅

小互

157,600 görüntüleme • 3 ay önce