Video yükleniyor...

Video Yüklenemedi

Ana Sayfaya Dön

最近挖到一个 Harness 硬核的开源项目:pi(前阵子刚从 badlogic 迁到 earendil-works 旗下)。 是一套为开发者兜底的 AI Agent 基础设施全家桶 + 终端编程助手 CLI。 少造点轮子:直接提供了一套 unified API(pi-ai),几行代码抹平多模型的接入差异,无缝切模型。 并发 Tool Calling 绕过卡脖子:这玩意的 runtime 默认支持工具并行执行,直接绕过了挨个串行排队的傻等,大幅降延迟。甚至还能让开发者精细化控制大模型的“思考预算”(Thinking Budgets)。 终端直接跑通的爽点:如果你不想从头拼装,直接 npm install -g Earendil-works/pi-coding-agent,终端里当场就能跑通一个交互式的 AI 编程搭子。不用跳出命令行去切网页,沉浸式干活,极度拉高 ROI。 仓库👇👇👇👇

12,681 görüntüleme • 4 ay önce •via X (Twitter)

0 Yorum

Yorum bulunmuyor

Orijinal gönderinin yorumları burada görünecek

Benzer Videolar

说个暴论,今天之后前沿大模型的战争已经彻底换赛道了,顶级工程能力的边际成本,今天被彻底打穿了!🤯 Grok 4.5 今天正式发布,直接掀翻了前沿大模型的定价桌子。 对标 Claude Opus 级别的编码与智能体能力,输入定价仅为后者五分之二,输出定价仅为其四分之一, 叠加 4.2 倍的单任务 token 效率提升,再加上更快的推理速度,没有死磕通用榜单第一,直接在开发者最买单的真实生产场景里,扔下了一枚性价比核弹。 这不只是单模型的胜利,更是垂直整合闭环的胜利,背后站着的也不再是孤军奋战的Elon Musk 的XAI实验室,还有SpaceXAI 的模型能力,加 Cursor 的开发者工具生态,加 SpaceX 特斯拉海量内部工程场景的三位一体飞轮, 开发者工具提供真实交互数据反哺训练,场景验证真实需求分布,模型持续迭代优化,这种闭环比单纯堆参数刷通用榜单难复制得多,也更贴近真实生产力落地。 但绝大多数人没看懂,token 效率才是智能体时代的真正杀手锏。 大多数人只会盯着基准分数的高低较劲,却忽略了效率叠加低价的复合效应,单次问答看起来差距甚微,但在多步工具调用自我修正的完整智能体工作流里,token 消耗直接等于延迟与真金白银的成本,跑完整端到端工程项目, Grok 4.5 的实际花费可能只有 Opus 方案的十分之一,速度优势更是碾压级,这对生产部署的意义,远大于跑分多几个百分点。 顶级工程能力的边际成本,今天被彻底打穿了, 2 美元输入 6 美元输出的定价,第一次把顶级编码与智能体能力,从企业级奢侈品降到了个人开发者和小团队可以放开用的价位,这会直接加速智能体 AI 从演示 demo 走向大规模生产落地,也必然倒逼头部厂商在短期内跟进调价,前沿大模型的价格战,今天才算真正拉开序幕。 更恐怖的是迭代加速度,SpaceX 今年计划每月发布一款从头训练的新模型,内部海量工程数据的持续喂养,会让它的进化速度甩开传统实验室的节奏。 我觉得这件事最本质的意义,是 AI 行业的竞争逻辑正在悄然转向, 它不再是堆出一个全能的通用神坛模型,而是在最高价值的垂直赛道里,做到够用的智能,加极致的效率,加亲民的价格, 大多数开发者日常 80% 的需求,从来不是解出世界最难的题,而是可靠地写代码调 bug 搭系统,Grok 4.5 精准命中了这个痛点。 当顶级工程能力的边际成本被彻底打穿,下一波 AI 生产力的爆发,会不会比所有人预想的都要早呢?

AYi

45,594 görüntüleme • 2 ay önce

终于,终于有人把所有模型缝合到一起了😭 Claude Code 编码、codex生图、检索抖音,小红书,youtube x的热点信息……全在一个工作台里 这就是我一直在等的“缝合怪max”!! 以前我得开五六个客户端,Claude 写完复制到 Midjourney 出图,再切到 Codex 写代码,脑子都要炸了 现在 dethink 直接把这些全塞进来了 一个界面切遍所有模型——Claude、Grok、Gemini、DeepSeek、Kimi、GLM 关键是 Claude Code 和 Codex 也在里面,编码、写作、生图,一个工作台全干了 更爽的是什么?微信、支付宝直接付款 不需要外币卡,不需要找代充,不需要担心封号 $20 / $100 / $200 三档套餐,按 token 计费,用多少算多少 以前想用多个模型,要么分别订阅(每个月固定扣费,用不用都得付),要么来回切账号 dethink 按 token 计费,$20 / $100 / $200 三档,用多少算多少 对我这种有时候用得多、有时候用得少的人来说,这种灵活性才是真正省钱的地方 而且所有模型在一个工作台里,Claude 写文案、Grok 出图、Gemini 做分析,切换无缝 省下的不只是钱,是那种"终于不用管支付问题、不用来回切工具“的心智负担 还有三个让我意外的点: 1. 数据聚合直接内置 想查抖音、小红书、YouTube、X 的热点?直接在 dethink 里搜 以前我得开 Semrush、飞瓜、新榜好几个工具,现在一个地方全搞定 做选题、找热点、SEO 分析,效率直接翻倍 2. 图像生成的组合玩法 你可以用 Claude 理解需求、优化提示词,然后调用 GPT Image 2 或 Grok Image 出图 相当于把“最会理解人话的模型”和“最会画图的模型”组合起来用 以前我得在 Claude 和 Midjourney 之间来回复制粘贴,现在一句话搞定 3. 桌面端真的好用 Windows 和 macOS 都支持,本地文件直接拖进去就能让 AI 处理 做 Agent 任务、跑工作流,比网页版丝滑太多 现在 dethink 8月15日刚上线,前 500 名注册直接送 $5 使用额度 给大家申请了8折优惠码,限量500个!先到先得了:DETHINK2026 如果你也在用多个 AI 工具,每个月为订阅费头疼 或者你想用海外模型但支付一直是个坎,真的可以试试 dethink 链接:

超级个体|柿子

88,924 görüntüleme • 1 ay önce

卧槽,答案终于揭晓了! 那个在open router上持续霸榜的神秘模型,是阿里推出的全新大模型“蚂蚁百灵”!今天我们来深度聊一聊这个模型。 用过AI来完成前端开发的朋友肯定懂: 要让AI做出想要的UI总是要找参考,再不然就是要依赖设计 skill 的帮助。 但这种界面一旦看多了,就会陷入审美疲劳。 原因在于不管你是对标UI还是使用skill,结果都是被限定在固有的生成范围内。 最近小灰测了新模型 Ling-2.6-1T (由蚂蚁集团 Ant Ling 开发),发现它刚好就能打破这个限制。 它生成的页面不仅审美极度在线,而且自带高质量的交互效果,做出来的东西终于不再是干巴巴的呆板网页了。 但用它有个必须要避开的坑:Ling 2.6 1T 默认是没有深度思考模式的。 它在计算资源分配上极其克制,如果你偷懒丢一句"给我写个好看的界面",那么它大概率会给你一个准确但极其敷衍的结果。(视频1) 那么怎么取巧使用它? 小灰分享一个能逼出它真实设计水平的实操工作流:把它当成主规划师,先拆解风格,再写代码。 跟它对话时,你可以直接下这种指令: 1. 强制思考:先别急着写代码!帮我分析这个产品的定位,明确它的视觉情绪、色彩规范和排版布局,把思路列出来。(比如明确告诉它你要包豪斯风格或者北欧风)。 2. 落地执行:等它把设计语言梳理清楚,你确认没问题了,再让它基于这套标准去生成具体的 TailwindCSS 样式和前端页面。 用这种先 Plan 后做的方式,出来的页面不仅美观,而且风格极其统一。(视频2) 目前在Openrouter中可以免费体验该模型。 选对工具打破模板限制,用高审美的模型直接拔高视觉质感,能帮我们省下大把死磕 CSS 的时间。 期待大家都能快速做出让人眼前一亮的作品!

程序员小灰

15,021 görüntüleme • 4 ay önce