正在加载视频...

视频加载失败

最近挖到一个 Harness 硬核的开源项目:pi(前阵子刚从 badlogic 迁到 earendil-works 旗下)。 是一套为开发者兜底的 AI Agent 基础设施全家桶 + 终端编程助手 CLI。 少造点轮子:直接提供了一套 unified API(pi-ai),几行代码抹平多模型的接入差异,无缝切模型。 并发 Tool Calling 绕过卡脖子:这玩意的 runtime 默认支持工具并行执行,直接绕过了挨个串行排队的傻等,大幅降延迟。甚至还能让开发者精细化控制大模型的“思考预算”(Thinking Budgets)。 终端直接跑通的爽点:如果你不想从头拼装,直接 npm install -g Earendil-works/pi-coding-agent,终端里当场就能跑通一个交互式的 AI 编程搭子。不用跳出命令行去切网页,沉浸式干活,极度拉高 ROI。 仓库👇👇👇👇

12,602 次观看 • 2 个月前 •via X (Twitter)

0 条评论

暂无评论

原始帖子的评论将显示在这里

相关视频

说个暴论,今天之后前沿大模型的战争已经彻底换赛道了,顶级工程能力的边际成本,今天被彻底打穿了!🤯 Grok 4.5 今天正式发布,直接掀翻了前沿大模型的定价桌子。 对标 Claude Opus 级别的编码与智能体能力,输入定价仅为后者五分之二,输出定价仅为其四分之一, 叠加 4.2 倍的单任务 token 效率提升,再加上更快的推理速度,没有死磕通用榜单第一,直接在开发者最买单的真实生产场景里,扔下了一枚性价比核弹。 这不只是单模型的胜利,更是垂直整合闭环的胜利,背后站着的也不再是孤军奋战的Elon Musk 的XAI实验室,还有SpaceXAI 的模型能力,加 Cursor 的开发者工具生态,加 SpaceX 特斯拉海量内部工程场景的三位一体飞轮, 开发者工具提供真实交互数据反哺训练,场景验证真实需求分布,模型持续迭代优化,这种闭环比单纯堆参数刷通用榜单难复制得多,也更贴近真实生产力落地。 但绝大多数人没看懂,token 效率才是智能体时代的真正杀手锏。 大多数人只会盯着基准分数的高低较劲,却忽略了效率叠加低价的复合效应,单次问答看起来差距甚微,但在多步工具调用自我修正的完整智能体工作流里,token 消耗直接等于延迟与真金白银的成本,跑完整端到端工程项目, Grok 4.5 的实际花费可能只有 Opus 方案的十分之一,速度优势更是碾压级,这对生产部署的意义,远大于跑分多几个百分点。 顶级工程能力的边际成本,今天被彻底打穿了, 2 美元输入 6 美元输出的定价,第一次把顶级编码与智能体能力,从企业级奢侈品降到了个人开发者和小团队可以放开用的价位,这会直接加速智能体 AI 从演示 demo 走向大规模生产落地,也必然倒逼头部厂商在短期内跟进调价,前沿大模型的价格战,今天才算真正拉开序幕。 更恐怖的是迭代加速度,SpaceX 今年计划每月发布一款从头训练的新模型,内部海量工程数据的持续喂养,会让它的进化速度甩开传统实验室的节奏。 我觉得这件事最本质的意义,是 AI 行业的竞争逻辑正在悄然转向, 它不再是堆出一个全能的通用神坛模型,而是在最高价值的垂直赛道里,做到够用的智能,加极致的效率,加亲民的价格, 大多数开发者日常 80% 的需求,从来不是解出世界最难的题,而是可靠地写代码调 bug 搭系统,Grok 4.5 精准命中了这个痛点。 当顶级工程能力的边际成本被彻底打穿,下一波 AI 生产力的爆发,会不会比所有人预想的都要早呢?

AYi

45,344 次观看 • 16 天前

卧槽,答案终于揭晓了! 那个在open router上持续霸榜的神秘模型,是阿里推出的全新大模型“蚂蚁百灵”!今天我们来深度聊一聊这个模型。 用过AI来完成前端开发的朋友肯定懂: 要让AI做出想要的UI总是要找参考,再不然就是要依赖设计 skill 的帮助。 但这种界面一旦看多了,就会陷入审美疲劳。 原因在于不管你是对标UI还是使用skill,结果都是被限定在固有的生成范围内。 最近小灰测了新模型 Ling-2.6-1T (由蚂蚁集团 Ant Ling 开发),发现它刚好就能打破这个限制。 它生成的页面不仅审美极度在线,而且自带高质量的交互效果,做出来的东西终于不再是干巴巴的呆板网页了。 但用它有个必须要避开的坑:Ling 2.6 1T 默认是没有深度思考模式的。 它在计算资源分配上极其克制,如果你偷懒丢一句"给我写个好看的界面",那么它大概率会给你一个准确但极其敷衍的结果。(视频1) 那么怎么取巧使用它? 小灰分享一个能逼出它真实设计水平的实操工作流:把它当成主规划师,先拆解风格,再写代码。 跟它对话时,你可以直接下这种指令: 1. 强制思考:先别急着写代码!帮我分析这个产品的定位,明确它的视觉情绪、色彩规范和排版布局,把思路列出来。(比如明确告诉它你要包豪斯风格或者北欧风)。 2. 落地执行:等它把设计语言梳理清楚,你确认没问题了,再让它基于这套标准去生成具体的 TailwindCSS 样式和前端页面。 用这种先 Plan 后做的方式,出来的页面不仅美观,而且风格极其统一。(视频2) 目前在Openrouter中可以免费体验该模型。 选对工具打破模板限制,用高审美的模型直接拔高视觉质感,能帮我们省下大把死磕 CSS 的时间。 期待大家都能快速做出让人眼前一亮的作品!

程序员小灰

15,021 次观看 • 3 个月前

有个事我憋很久了,今天必须说一下。 市面上那些标榜 AI 驱动交易的 Bot,我深度用过几款之后发现一个特离谱的现象:它们所谓的 AI 就是接了一个 GPT 或者 Claude 的 API,把 K 线数据原封不动丢进去,让一个从来没被训练过理解金融时间序列的通用模型给你输出买卖建议。说难听点,跟拿 ChatGPT 算命没什么区别。 所以 AIX 的多模型路由方案,是我接触这个项目之后第一个真正觉得"方向对了"的设计。 它同时接了 GPT、Claude、DeepSeek R1、Gemini 这些通用模型,也集成了 Kronos 这类专门为金融预测训练的专业模型。中间多了一层调度层,根据当前市场状态智能路由,震荡市用一套推理框架,单边趋势切另一套算法组合。 这个设计的聪明之处在于它承认了一个很朴素的事实:没有一种模型能在所有行情里通吃。趋势跟随在单边市是神,进了震荡就是来回止损。反过来网格在震荡舒服,单边一来直接穿仓。通用大模型做策略意图理解很强但看 K 线的能力确实有限,专用金融模型在时序预测上更精准但没办法理解你用自然语言描述的策略逻辑。没有一个模型能同时搞定所有事。 AIX 干的事不是选一个最强的模型然后迷信它,而是让不同模型在不同环节轮班上岗,动态调权重。这个思路在传统量化里叫多因子动态权重,AIX 把它搬到了 LLM 和时序模型的协同上。 我体验下来的感受是它不像那种一问一答的 Bot,更像有一个小团队在后台协作,你只需要给方向,它自己去协调谁干什么。这个架构如果跑通,抗单一模型失效的能力跟那些只接一个 API 的项目不在一个数量级。 个人分享,非投资建议。

DeFi狙击手 | Ai🕊️

15,968 次观看 • 2 天前

炒美股的兄弟们有福气了。龙哥找了一个开源软件,胜过彭博。 彭博终端一年订阅费够买辆二手车,FinceptTerminal零元。 这不是玩笑。彭博那玩意儿起步价两万美金一年,专业版往二十万走。普通散户、刚起步的量化团队、小型投资机构,基本被这个门槛挡在外面。 FinceptTerminal 干的事就一个:把这堵收费墙拆了。 2.7万星,纯 C++ 写,说明不是花架子。打开终端,股票、期货、外汇、宏观数据全在一个界面里,不用切来切去。行情实时刷新,技术分析工具直接能用,想跑量化模型也行,不是那种只能看 K 线的半成品。 几个实在的亮点:。 数据覆盖广。美股、欧股、亚太市场,外汇和大宗商品都进来了,宏观指标也能拉。不是只盯一个市场的玩具,是真的能当工作台用。 交互式探索。看数据不是死盯屏幕等刷新,可以自己下钻,点开某个行业、某只股票、某段时间,层层扒下去,找到你想看的那个数字。 开源免费。代码全在 GitHub 上,想改就改,想集成进自己的系统也行。彭博打死不让你碰它的数据接口,这个反过来。 举个场景。你想研究美股科技板块最近一周的资金流向,打开 FinceptTerminal,调出行业列表,点进科技板块,叠加宏观指标和个股资金数据,一套下来不用切软件、不用导 CSV、不用手动算比例。 安装也不麻烦,GitHub 上有详细说明,Linux 和 macOS 都支持。 金融圈一直有个怪现象:干活的人用的工具最贵,最需要数据的人反而买不起数据。这种开源项目能跑出来,说明大家真的受够了。 不是要替代彭博,专业机构该买还是买。但对于还在摸索阶段、想认真研究市场、但预算有限的人来说,这玩意儿就是真香的答案。 有兴趣的去 GitHub 翻代码就知道了。

空投龙 | 预测世界杯就在Gate

11,690 次观看 • 1 个月前

帅不帅不知道 但美女确实流口水了 无法反驳 不知道你有没有发现,在以太坊或者传统的 Layer2 上,交易就像在单行道上开车:前面的车没走,后面的车只能等 这种串行执模型,就是导致 Gas 费飙升和网络拥堵的元凶 #Miden 如何通过并行执行打破链上拥堵? Miden 的思路很硬核:把单行道变成超级多车道的高速公路 核心逻辑:从排队到并行 #Miden 引入了一种以动作为中心的并发状态模型 在以太坊: 所有人共用一个账本,状态更新必须按顺序来,因为大家可能会抢同一个变量 在 #Miden : 账户和票据是独立的,只要你和我的交易不涉及同一个账户,我们就可以在各自的设备上同时完成计算并生成证明 链上订单簿的终极方案 目前的 DEX 大多采用 AMM,很大程度是因为链上串行执行撑不起高频的订单簿 想象一下,如果一个去中心化交易所在 Miden 上运行: 由于交易是并行执行的,一千个用户同时下单,他们是在自己的客户端生成证明,然后异步提交给节点,节点只需要验证这些证明的数学正确性,而不需要像传统链那样一个个排队跑逻辑 结果就是: 毫秒级的响应体验,却拥有以太坊级别的安全性 更绝的是,Miden 的账户天生就是智能合约, 不需要像以太坊那样通过 ERC-4337 这种复杂的补丁来实现 在 #Miden,你可以轻松设定: 多重签名: 必须两个设备同时确认 限制消费: 每天只能转出 100 刀 资产找回: 即使私钥丢了,也可以通过预设的逻辑找回 这种把隐私、并行、安揉进底层的设计,才是未来 DApp 爆发的基石 #Miden #KaitoYap Kaito AI 🌊 #Yap

Winner🔶BNB |🐬 TermMax

29,986 次观看 • 6 个月前