Loading video...

Video Failed to Load

Go Home

昨晚刚测完 3.7 Flash 的充沛额度,今晨 Antigravity 紧接着推送了 v2.9.1 版本。实测 3.7 Flash 的响应速度极快,在开启高档推理时依然保持稳定吞吐,长文本流式输出几乎没有停顿感。 在实际工作流中,直接让它查询当天社交平台上的前沿 AI 热点,它能自主调起 agent-reach 工具并在后台执行终端检索,几秒内就把各家动态提炼成结构化研报。配合 v2.9.1 新增的 inheritCustomizations 配置,自定义 Agent 可以一键继承全局已有的 skills 和 rules,避免了重复繁琐的配置。 这次底层更新还把 MCP 工具返回的大图和 PDF 等二进制对象改为自动存盘并按文件引用,彻底解决了内联数据塞爆上下文的问题。同时修复了长对话停止后偶发无法回到空闲状态、以及代码审查面板在折叠区域遗漏搜索匹配项的已知缺陷。 整套环境大幅提升了多 Agent 自动化排障与高频长上下文调用的稳定性。适合日常重度依赖自定义规则、联网调研与代码重构的开发者,今天可以直接拉取最新版本。

19,525 views • 1 month ago •via X (Twitter)

27 Comments

码农暖爸's profile picture
码农暖爸1 month ago

平时还是使用它的IDE多点 希望Gemini 4快点来吧

Wei佳's profile picture
Wei佳1 month ago

同感期待,不过我两个都在用

NoMagic's profile picture
NoMagic1 month ago

最近在试水Gemini吗?

Wei佳's profile picture
Wei佳1 month ago

主要是速度快,额度多,用不完,不想浪费哈哈

NoMagic's profile picture
NoMagic1 month ago

哈哈,这波codex可惨了.丢了无数用户!~

Wei佳's profile picture
Wei佳1 month ago

codex额度降太多了

Simon's profile picture
Simon1 month ago

我的antigravity登不上

Wei佳's profile picture
Wei佳1 month ago

检查是不是美国IP和美国账号

Jeffery the Bluey's profile picture
Jeffery the Bluey1 month ago

been using Gemini 3.7 Flash on Antigravity CLI this week, quite impressive. So how's GUI?

Wei佳's profile picture
Wei佳1 month ago

The gui is okay to use and makes dialog management easier

onecookie's profile picture
onecookie1 month ago

订阅的是AI Pro吗?我看前三个月40港币,挺香的

Wei佳's profile picture
Wei佳1 month ago

是的,Google One AI Premium。前三个月 40 港币这个新手车非常值,开通后直接调 3.7 Flash 额度池很深,还有就是我有个学生号

onecookie's profile picture
onecookie1 month ago

👍👍

祐's profile picture
祐1 month ago

作者,这里用Gemini 生图吗?

晚晚's profile picture
晚晚1 month ago

高档推理还能这么快,确实有点离谱,agent-reach 是内置能力吗?

Wei佳's profile picture
Wei佳1 month ago

agent-reach是我自己安装的mcp,本地codex,grok build,cc,antigravity 我都会使用

大猩猩AI量化's profile picture
大猩猩AI量化1 month ago

我前几天看你分享,买了pro。但是我让它作图,每天只能做10个图,有些郁闷。

rockstar's profile picture
rockstar1 month ago

IDE和他这个agent app使用体验差别大吗?

NO ONE's profile picture
NO ONE1 month ago

通过代理登录使用稳定吗?代码开发方面怎么样?

Trader Fond's profile picture
Trader Fond1 month ago

cline上支持3.7xhigh 好像就是3.1pro 加 3.7叠起来的 比3.7 high 强多了

Wei佳's profile picture
Wei佳1 month ago

cline订阅?

Trader Fond's profile picture
Trader Fond1 month ago

我是接vertex ai的

独坐春秋's profile picture
独坐春秋1 month ago

为啥我的一直显示地区不可用,可是我谷歌账号地址是新加坡的

Jin's profile picture
Jin1 month ago

它回答的太快了,有时候回答的事实性内容会错,我经常让 grok 做二轮核查

Wei佳's profile picture
Wei佳1 month ago

比起3.6flash要稍微靠谱一点,主要速度快了反而觉得没有思考,我也是这样的感觉,但是这几次让他做的,回答还是比较满意,遇到难的还是直接gpt或者让gpt. review

Chasen's profile picture
Chasen1 month ago

依旧Gemini窜稀版的爽感

Wei佳's profile picture
Wei佳1 month ago

哈哈,gemini写大型项目不行,小修小补可以的

Related Videos

蚂蚁百灵刚刚发布了 Ling-3.0-flash: 一个AI 执行层的关键拼图 刚刚看到 Ling-3.0-flash 正式发布,我觉得这款模型值得认真关注。原因很简单:在 AI 工程越来越深入到实际业务的今天,大家早就不满足于模型“会不会想”了,更关键的是它“能不能持续做”。 尤其是在 Agent 工作流中,需要高频调用工具、迭代代码、处理长程任务时,一个响应快、执行稳的执行引擎成了刚需。Ling-3.0-flash 的出现,正好瞄准了这个缺口。 1. Agent 的执行层 从我的角度看,它最聪明的一点是没有去硬拼超大模型的深度推理能力,而是把自己定位成一个高速执行引擎——负责把已经规划好的任务快速落地。 这在实际应用中特别实用,比如当大模型把方案设计好之后,剩下的代码生成、工具调用、批量处理就需要一个既快又稳的模型来接手。 2. 为什么它能兼顾速度和成本 技术细节上,它采用 124B 参数的 MoE 架构,但实际激活参数约 5.1B,在推理速度和运行成本之间找平衡。 它还支持混合推理模式:简单任务可以关闭 Reasoning,降低延迟,适合大批量处理;复杂任务则可以开启思考模式,保持逻辑连贯。 原生支持 256K 上下文,对需要持续读取历史指令和项目状态的 Agent 工作流也很重要。 3.如何使用 我觉得 Ling-3.0-flash 最适合做 Agent 工作流里的执行节点。反复调用 API 或 MCP 工具时,它能根据结构化错误信息自我诊断和修复,不容易在循环调试中卡死,因此适合放进 Loop 或 Graph 架构。 4.结对编程和批量任务 结对编程是一个典型场景:人负责架构规划、边界定义和测试,Ling-3.0-flash 负责快速生成代码、调用工具、读取报错,并根据反馈持续修改。 批量处理长文档、日志、简历和结构化数据时,它看重的也是速度、格式稳定性和成本控制。直播数字人或高频办公协作,则需要它的低延迟响应来减少体验断层。 5.边界 当然,它不是万能模型。复杂系统不能只靠一句指令搞定;缺乏架构和测试环境时,结果可能跑偏;需要深度冷门知识的研究任务,还是更适合交给更大规模的推理模型。 更合理的用法是:大模型负责搜索、规划和架构设计,把方案写成规范文档;Ling-3.0-flash 负责高频工具调用、代码执行和批量处理。 总结:Ling-3.0-flash 不是来替代所有模型的,而是把 Agent 工作流里“执行层”这件事做得更快、更稳。大模型负责想清楚,它负责做出来。

奶牛叔

66,157 views • 2 months ago

最近拿 StepFun 的 Step 3.7 Flash 跑了一次完整的自动编程流水线,从需求文档到能用的工具,65 分钟,中间没碰键盘。 先说模型。Step 3.7 Flash 的定位是把 Agent 工作流从头跑到尾:规划、写代码、跑测试、审代码、出错重试,看的是整条流程跑完的综合效率。原生多模态,开源可部署。Agent 循环一次要调几百次模型,快和便宜在这里不是锦上添花,是能不能跑得起的问题。 再说项目。hero-coding 是我用 Go 写的一个自动编程流水线:输入一份 Markdown 需求文档,四个 Agent 执行——Planner 把需求拆成带依赖关系的小任务,Worker 在独立的 git worktree 里写代码提交,Verifier 跑测试出硬证据,Reviewer 审 diff,通过就合入主干,不过就打回重做。四个角色全部由 Step 3.7 Flash 驱动,区别只是 system prompt 和工具权限。 这次给它的需求:做一个 Agent 运行日志分析工具,读日志文件,统计每个 Agent 的调用次数、成功率、平均耗时、token 消耗,找出最慢和最不稳定的 Agent。 实际跑下来: · Planner 把需求拆成 6 个任务,自动排好依赖顺序 · 6 个任务全部自动交付,逐个合入主干 · 期间 Reviewer 打回 5 次——有测试全绿但被审出正确性问题的,有只改测试期望值想糊弄过去被拒收的,全部在重试轮次内自动修复 · 不是一个模型在自言自语,是多个 Agent 在互相检查,而且检查真的拦住了东西 · 最终产出的 CLI 直接能用,视频结尾是它分析真实日志的输出 视频是完整过程的运行日志。 国内: 海外: StepFun

劳伦斯

52,280 views • 3 months ago

🚀Anthropic 悄无声息地推出了一项功能:Agent Teams 让 Claude 在 Claude code 内构建自己的 AI 代理团队! 该功能改变了传统的上下级 AI 架构,允许 Claude 构建一个同级代理团队。 这些代理可以共享任务列表、直接互相发送消息并审查彼此的工作,实现类似于真人团队的协作模式。 在演示中,一个由 QA 工程师、前端开发者和后端开发者组成的 3 人团队展示了这一能力。 QA 代理发现 3 个错误后,直接向前后端开发者发送反馈。开发者修复问题后,应用程序在一轮测试中即成功上线。 该功能在 Claude Code v2.1.32 及更高版本中可用。以下是开启方法与运行规则: 1. 启用方法 确保版本符合要求。在 settings.json 中添加以下配置: "env": { "CLAUDE_CODE_EXPERIMENTAL_AGENT_TEAMS": "1" } 或者将此内容粘贴给 Claude 并说明“添加到我的设置中”,随后重启。 2. 提示词设定 使用纯英文进行提示。开始时需要设定一个明确的目标(代理启动时没有上下文)。 提示词示例:"使用 Sonnet 创建一个 3 人团队",并详细描述每个角色的职责、交付物以及完成后需要联系的下一个代理。 3. 运行规则 - 每个代理拥有自己的独立文件。 - 必须定义确切的输出。 - 指定明确的通信链路(谁与谁交谈)。 - 团队规模建议保持在 3-5 个代理。 4. 适用场景与限制 该功能适用于有独立部分且可以并行运行的复杂工作。对于简单或顺序任务,不建议使用该功能,因为团队协作会消耗 3-4 倍的 Token。

Lonely

19,931 views • 3 months ago