正在加载视频...

视频加载失败

这个 AI 编程工具叫 Pi,用了以后再也不想回 Claude Code 了! • 32K 上下文的本地模型跑多轮任务,比 Cline、OpenCode 更轻、更省上下文 • 把 OpenCode 换成 Pi,同一个任务从反复返工变成一次做对 • 缺什么能力,就让 Pi 自己做,或者装别人做好的扩展 100% 开源,完全免费。

103,934 次观看 • 2 个月前 •via X (Twitter)

0 条评论

暂无评论

原始帖子的评论将显示在这里

相关视频

非常Nice啊,这模型完全免费,Token终于可以自由白嫖了,甚至视频模型都是免费的,太爽了。 它叫Agnes AI,全球模型榜前十,6 月 1 号起把自己家三个核心模型全免费开放了,无限期。图片模型在 artificial analysis 上榜了,文字模型一周被干了一万亿 Token。我把它接进 Claude Code,配起来十分钟的事,Token 随便用。 这玩意到底是什么呢。 Agnes AI 是全球模型榜单前十的一个 AI Lab,这次免费开放的是三个模型,文本、图片、视频。 文本模型叫 agnes-2.0-flash。能写代码,能做知识问答,能跑 Agent,能规划复杂任务。在 Claw-Eval 智能体评测榜进了 Top 10。说真的,这周它还要上 1M 超长上下文,以前用 200K 的模型跑到 150K 就降智,这种破事不用再忍了。 图片模型叫 agnes-image-2.1-flash。图改图、多图融合、换背景、改文字、图像修复,电商主图和广告素材这种反复改的场景,太合适了。最近还加了 4K 超高清输出,最高 4096×4096,生成的图可以直接进印刷,不是那种看着还行一放大就糊的草稿。 视频模型叫 agnes-video-2.0。原生音画同步,首帧生视频、首尾帧生视频、多镜头切换都支持,720P 和 1080P 随便选。 接进 Claude Code 怎么搞,其实很简单。 第一步,去 注册,拿到 API key。 第二步,打开 cc-switch。右上角选 Claude CLI,右上角点 + 号,选自定义配置。把 API key 填进去,请求地址写 格式选 OpenAI Chat Completions。 第三步,点获取模型列表,选 agnes-2.0-flash。 第四步,点左上角设置,找到路由,打开路由总开关,Claude 打开。 完事。 回到 Claude Code 正常发消息,模型就已经切过去了。我试了一个在酒吧吉他弹唱的视频,和真人区别不大。 现在 Token 不要钱,Agent 该跑几轮跑几轮,该拆几步拆几步。反正我觉得这才是免费开放最爽的部分,不只是省钱,是心理上解放了。 我测试了一下视频模型,能用,就是慢了点,文字模型还是比较快的。 开发者文档在 OpenClaw、Hermes、Claude Desktop 的,也有现成教程。

产品经理老王霸

55,427 次观看 • 3 个月前

Claude有个很让人不爽的点!! 每次新模型发布,官方非订阅用户连体验的资格都没有!! 想起之前在 ZenMux 充了钱还没用完,登上去一看,没想到已经上架了Claude Fable 5 , 也算是第一时间体验上了这个“目前最强模型”。 听说这模型死贵!! 于是很慎重的用它跑了一个支付模块重构的任务! 零代码基础,只能把之前Codex的输出给复制进去, 任务要求比较复杂: 保持原 API 兼容; 拆出 PaymentRequested / PaymentSucceeded / PaymentFailed; 补幂等,避免重复扣款; 改状态机; 更新单测; 输出迁移风险; Fable 5 不算快,面对这个长任务,它做对了两件事: 第一,先拆计划,再执行。 它把兼容层、事件定义、状态机、handler、测试、回滚风险都列出来了。 第二,最后主动自检。 它自己指出:支付成功事件必须幂等;旧接口“返回成功”不再等于“扣款完成”,调用方文档要改。 结果看起来,还是一如既往的稳! 但是真的贵,就这么几分钟,直接跑了十多美金!! 所以,我觉得要是家里没有矿,还是不要随便用Fable 5 ,根本不适合当常驻模型! 感谢Zenmux让我体验了一下“宇宙最强”! 虽然有点贵,但有时候相比价格,省心省力会更重要。 比如多文件重构、复杂迁移、PR review、长链路 Agent workflow这些复杂任务,偶尔用用,还是可以的! 最后说一下 Zenmux,它有个PK 模式我一直很喜欢,可以同屏对比多个模型输出、延迟和成本。 现在刚好还有个限时的充值返赠活动: 充 20 美元送 10 美元 充 50 美元送 30 美元 如果你想第一时间体验Claude Fable 5或者其他模型,现在就是下手的最好时间!

沐阳

15,442 次观看 • 3 个月前

Damn,三天前大家还在争论哪家大模型写代码更便宜, 今天老黄Jensen Huang 和NVIDIA 英伟达直接掀桌子了: 问题根本不在模型, 在你的脚手架太蠢了。 英伟达与 MIT 团队公开了全新架构 SoL-Pi, 放弃人工打补丁, 让算法自己演化出四套运行时机制。 不仅在 GPT-5.6 Sol 和 Opus 5 上守住了评测水准, 更把 API 成本直接削去三分之一。 那些天天盯着大模型降价、却任由 Agent 脚手架疯狂烧钱的团队, 建议把这篇论文打印出来贴在工位上。 英伟达实验室开源的SoL-Pi 论文,可以说是做了一件全行业早就该做的事: 用自动演化系统重新锻造 Agent 运行脚手架。 在 51 个真实编程任务的严苛评测中, 面对 GPT-5.6 Sol 和 Claude Opus 5 这种巨无霸, 任务得分毫发无损, 但直接把 Token 消耗腰斩了 49%, 每跑一小时就能从 API 账单里直接省出 8.75 到 13.50 美元。 很多团队以前做智能体全靠工程师人肉写死调度逻辑, 试几个用例就自以为调好了, 跑进几十步的复杂长任务里, 臃肿的上下文几分钟就能把账单干爆、把模型智商撑死。 英伟达这次最聪明的一步, 是彻底放弃了人类手工调优。 他们把脚手架扔进多个不同的代码环境里, 让系统开启自动化研究循环, 像自然选择一样让无数机制自我对抗淘汰, 最终只有四个物理机制活了下来。 首先颠覆的是执行节奏。 以前 Agent 走一步看一步, 调一次工具往返一次, 动作融合机制直接把连贯动作在端侧合并批处理, 砍掉了一大半网络和上下文震荡。 然后是给运行中的上下文无损脱水。 它不是等上下文满了再调大模型写假大空的摘要, 而是在任务行进中对观察结果进行重组打包, 并在委托阅读长文件时强制保留证据行, 既把整个 API 成本砍掉整整三分之一, 又死死守住了关键代码细节不被遗忘。 以前是工程师凭直觉给 Agent 编死板的笼子, 从今天起是算法在残酷淘汰中自己进化出最精密的骨骼。 如果你的代码 Agent 每小时也能凭空省下十几美元, 你会选择把省下来的钱用来多跑十倍的并发测试, 还是换更大参数的模型? 我先说, 肯定无脑拉满并发, 把原本舍不得跑的全量回归测到爽。 开源代码、论文地址和这套四机制的详细对照表, 我整理好放在一楼了。

AYi

49,296 次观看 • 10 天前

Codex 5.6 这 4 个设置,能砍掉 80% 无效 token 浪费,复杂长任务效率还能提升 70% 很多时候不是模型不够强,而是你的上下文、缓存和工具配置正在拖后腿。 1️⃣ 尽量吃满 prompt cache 固定不变的项目规则、AGENTS.md、开发规范、长期 prompt 放前面,经常变化的需求放后面。这样更容易命中缓存,减少重复计算和重复上下文token消耗。 2️⃣ 长任务要及时压缩上下文 不要让日志、失败方案和旧历史一直堆在会话里。 直接输入prompt: “请整理当前任务上下文,清理失效方案、重复日志和无关历史,只保留当前目标、关键决策、核心约束、当前进度、未解决问题和下一步行动,后续基于最新摘要继续执行。” 3️⃣ MCP 不要装一堆不用的 Browser、Figma、GitHub、文档 MCP 都很强,但工具越多,上下文负担也越大。当前项目需要什么,就加载什么,别让一堆无关工具长期占着上下文。 4️⃣ 保持项目配置稳定 不要频繁切模型、工作目录、工具配置和开发规则。稳定的 prompt、稳定的工具链和固定项目结构,更容易持续复用缓存,也能减少 Agent 反复重新理解项目。 真正高效的 Codex 工作流: 高缓存命中 → 干净上下文 → 必要工具 → 稳定配置 很多时候 Codex 不需要再变强,你只需要做的,就是别再浪费它的上下文。

govin.eth | G哥

219,312 次观看 • 1 个月前

终于,终于有人把所有模型缝合到一起了😭 Claude Code 编码、codex生图、检索抖音,小红书,youtube x的热点信息……全在一个工作台里 这就是我一直在等的“缝合怪max”!! 以前我得开五六个客户端,Claude 写完复制到 Midjourney 出图,再切到 Codex 写代码,脑子都要炸了 现在 dethink 直接把这些全塞进来了 一个界面切遍所有模型——Claude、Grok、Gemini、DeepSeek、Kimi、GLM 关键是 Claude Code 和 Codex 也在里面,编码、写作、生图,一个工作台全干了 更爽的是什么?微信、支付宝直接付款 不需要外币卡,不需要找代充,不需要担心封号 $20 / $100 / $200 三档套餐,按 token 计费,用多少算多少 以前想用多个模型,要么分别订阅(每个月固定扣费,用不用都得付),要么来回切账号 dethink 按 token 计费,$20 / $100 / $200 三档,用多少算多少 对我这种有时候用得多、有时候用得少的人来说,这种灵活性才是真正省钱的地方 而且所有模型在一个工作台里,Claude 写文案、Grok 出图、Gemini 做分析,切换无缝 省下的不只是钱,是那种"终于不用管支付问题、不用来回切工具“的心智负担 还有三个让我意外的点: 1. 数据聚合直接内置 想查抖音、小红书、YouTube、X 的热点?直接在 dethink 里搜 以前我得开 Semrush、飞瓜、新榜好几个工具,现在一个地方全搞定 做选题、找热点、SEO 分析,效率直接翻倍 2. 图像生成的组合玩法 你可以用 Claude 理解需求、优化提示词,然后调用 GPT Image 2 或 Grok Image 出图 相当于把“最会理解人话的模型”和“最会画图的模型”组合起来用 以前我得在 Claude 和 Midjourney 之间来回复制粘贴,现在一句话搞定 3. 桌面端真的好用 Windows 和 macOS 都支持,本地文件直接拖进去就能让 AI 处理 做 Agent 任务、跑工作流,比网页版丝滑太多 现在 dethink 8月15日刚上线,前 500 名注册直接送 $5 使用额度 给大家申请了8折优惠码,限量500个!先到先得了:DETHINK2026 如果你也在用多个 AI 工具,每个月为订阅费头疼 或者你想用海外模型但支付一直是个坎,真的可以试试 dethink 链接:

超级个体|柿子

88,924 次观看 • 1 个月前