正在加载视频...

视频加载失败

阿里刚发布了Qwen3.6-Plus 直接冲着"国产最强编程模型"来的 跑分上,SWE-bench 和 Claw-Eval 都超过了 GLM-5 和 Kimi-K2.5,是目前国产模型里最接近 Claude 的 实测了一下前端,确实有点东西 阿里云百炼已上架,价格不到 Claude 的十分之一 阿里这几天连发三个模型,平均一天一个: 3月30号,Qwen3.5-Omni 全模态 4月1号,Wan2.7-Image 图像生成 4月2号,Qwen3.6-Plus 编程模型 感觉熟悉的千问节奏又回来了..

102,067 次观看 • 6 个月前 •via X (Twitter)

0 条评论

暂无评论

原始帖子的评论将显示在这里

相关视频

非常Nice啊,这模型完全免费,Token终于可以自由白嫖了,甚至视频模型都是免费的,太爽了。 它叫Agnes AI,全球模型榜前十,6 月 1 号起把自己家三个核心模型全免费开放了,无限期。图片模型在 artificial analysis 上榜了,文字模型一周被干了一万亿 Token。我把它接进 Claude Code,配起来十分钟的事,Token 随便用。 这玩意到底是什么呢。 Agnes AI 是全球模型榜单前十的一个 AI Lab,这次免费开放的是三个模型,文本、图片、视频。 文本模型叫 agnes-2.0-flash。能写代码,能做知识问答,能跑 Agent,能规划复杂任务。在 Claw-Eval 智能体评测榜进了 Top 10。说真的,这周它还要上 1M 超长上下文,以前用 200K 的模型跑到 150K 就降智,这种破事不用再忍了。 图片模型叫 agnes-image-2.1-flash。图改图、多图融合、换背景、改文字、图像修复,电商主图和广告素材这种反复改的场景,太合适了。最近还加了 4K 超高清输出,最高 4096×4096,生成的图可以直接进印刷,不是那种看着还行一放大就糊的草稿。 视频模型叫 agnes-video-2.0。原生音画同步,首帧生视频、首尾帧生视频、多镜头切换都支持,720P 和 1080P 随便选。 接进 Claude Code 怎么搞,其实很简单。 第一步,去 注册,拿到 API key。 第二步,打开 cc-switch。右上角选 Claude CLI,右上角点 + 号,选自定义配置。把 API key 填进去,请求地址写 格式选 OpenAI Chat Completions。 第三步,点获取模型列表,选 agnes-2.0-flash。 第四步,点左上角设置,找到路由,打开路由总开关,Claude 打开。 完事。 回到 Claude Code 正常发消息,模型就已经切过去了。我试了一个在酒吧吉他弹唱的视频,和真人区别不大。 现在 Token 不要钱,Agent 该跑几轮跑几轮,该拆几步拆几步。反正我觉得这才是免费开放最爽的部分,不只是省钱,是心理上解放了。 我测试了一下视频模型,能用,就是慢了点,文字模型还是比较快的。 开发者文档在 OpenClaw、Hermes、Claude Desktop 的,也有现成教程。

产品经理老王霸

55,427 次观看 • 3 个月前

有个事我憋很久了,今天必须说一下。 市面上那些标榜 AI 驱动交易的 Bot,我深度用过几款之后发现一个特离谱的现象:它们所谓的 AI 就是接了一个 GPT 或者 Claude 的 API,把 K 线数据原封不动丢进去,让一个从来没被训练过理解金融时间序列的通用模型给你输出买卖建议。说难听点,跟拿 ChatGPT 算命没什么区别。 所以 AIX 的多模型路由方案,是我接触这个项目之后第一个真正觉得"方向对了"的设计。 它同时接了 GPT、Claude、DeepSeek R1、Gemini 这些通用模型,也集成了 Kronos 这类专门为金融预测训练的专业模型。中间多了一层调度层,根据当前市场状态智能路由,震荡市用一套推理框架,单边趋势切另一套算法组合。 这个设计的聪明之处在于它承认了一个很朴素的事实:没有一种模型能在所有行情里通吃。趋势跟随在单边市是神,进了震荡就是来回止损。反过来网格在震荡舒服,单边一来直接穿仓。通用大模型做策略意图理解很强但看 K 线的能力确实有限,专用金融模型在时序预测上更精准但没办法理解你用自然语言描述的策略逻辑。没有一个模型能同时搞定所有事。 AIX 干的事不是选一个最强的模型然后迷信它,而是让不同模型在不同环节轮班上岗,动态调权重。这个思路在传统量化里叫多因子动态权重,AIX 把它搬到了 LLM 和时序模型的协同上。 我体验下来的感受是它不像那种一问一答的 Bot,更像有一个小团队在后台协作,你只需要给方向,它自己去协调谁干什么。这个架构如果跑通,抗单一模型失效的能力跟那些只接一个 API 的项目不在一个数量级。 个人分享,非投资建议。

DeFi狙击手 | Ai🕊️

17,513 次观看 • 2 个月前

OpenAI 深夜放炸弹,GPT 5.4 来了!🤯 这次是真 “大一统” 了,推理、编程、操控电脑、搜索、百万 Token 上下文,一个模型全干了!之前得在不同模型之间反复横跳,现在一个 GPT 5.4 全搞定,恐怖的是每条线都拉到顶尖水平,几乎没有短板。 来看看跑分,SWE-Bench Pro 57.7% 编程登顶,FrontierMath 数学第一,ARC-AGI-2 抽象推理 83.3% 创下新高,把 Gemini 3.1 Pro 和 Opus 4.6 全踩脚下。幻觉率比 GPT-5.2 暴降 33%,工具搜索功能直接把 Token 消耗砍掉 47%,又准又省。 值得关注的是「原生操控电脑」能力,OSWorld-Verified 拿下 75% 成功率,超过了人类的 72.4%。也就是说,GPT 5.4 操作电脑比大部分人都熟练了😂 而且是真的能看截图,自己点鼠标键盘完成任务 实际工作能力的表现也很不错,在GDPval 测试里,GPT 5.4 拿了 83%,追平甚至超越行业专业人士!这个测试横跨 44 种职业,让 AI 真刀真枪交付成果,做 PPT、建 Excel 模型、写法律分析,也就是说 AI 干活比大多数打工人还靠谱了。 有意思的是,两天前 GPT 5.3 Instant 撞车 Gemini 3.1 同一天发布,算是给 GPT 5.4 铺路了,先出个日常对话版本,再放大招。 OpenAI 最近这波节奏很猛,短时间连发两个模型,明显是要把之前被 Claude 抢走的编程用户拉回来。 AI 模型的军备竞赛已经白热化了,你现在主力用的是哪个 AI 模型?打算换 GPT 5.4 试试吗?

程序员鱼皮

23,679 次观看 • 7 个月前

终于,终于有人把所有模型缝合到一起了😭 Claude Code 编码、codex生图、检索抖音,小红书,youtube x的热点信息……全在一个工作台里 这就是我一直在等的“缝合怪max”!! 以前我得开五六个客户端,Claude 写完复制到 Midjourney 出图,再切到 Codex 写代码,脑子都要炸了 现在 dethink 直接把这些全塞进来了 一个界面切遍所有模型——Claude、Grok、Gemini、DeepSeek、Kimi、GLM 关键是 Claude Code 和 Codex 也在里面,编码、写作、生图,一个工作台全干了 更爽的是什么?微信、支付宝直接付款 不需要外币卡,不需要找代充,不需要担心封号 $20 / $100 / $200 三档套餐,按 token 计费,用多少算多少 以前想用多个模型,要么分别订阅(每个月固定扣费,用不用都得付),要么来回切账号 dethink 按 token 计费,$20 / $100 / $200 三档,用多少算多少 对我这种有时候用得多、有时候用得少的人来说,这种灵活性才是真正省钱的地方 而且所有模型在一个工作台里,Claude 写文案、Grok 出图、Gemini 做分析,切换无缝 省下的不只是钱,是那种"终于不用管支付问题、不用来回切工具“的心智负担 还有三个让我意外的点: 1. 数据聚合直接内置 想查抖音、小红书、YouTube、X 的热点?直接在 dethink 里搜 以前我得开 Semrush、飞瓜、新榜好几个工具,现在一个地方全搞定 做选题、找热点、SEO 分析,效率直接翻倍 2. 图像生成的组合玩法 你可以用 Claude 理解需求、优化提示词,然后调用 GPT Image 2 或 Grok Image 出图 相当于把“最会理解人话的模型”和“最会画图的模型”组合起来用 以前我得在 Claude 和 Midjourney 之间来回复制粘贴,现在一句话搞定 3. 桌面端真的好用 Windows 和 macOS 都支持,本地文件直接拖进去就能让 AI 处理 做 Agent 任务、跑工作流,比网页版丝滑太多 现在 dethink 8月15日刚上线,前 500 名注册直接送 $5 使用额度 给大家申请了8折优惠码,限量500个!先到先得了:DETHINK2026 如果你也在用多个 AI 工具,每个月为订阅费头疼 或者你想用海外模型但支付一直是个坎,真的可以试试 dethink 链接:

超级个体|柿子

88,924 次观看 • 1 个月前

Kimi要去香港上市了,一次发布同时完成了三件事:产品更新、市场重定价、IPO 预路演,喵的真是一场伟大的操盘!!! K3发布前脚刚砸跌纳斯达克1%,然后转头Kimi就启动港股IPO筹备,一场发布干了几个亿路演的活,真特么牛逼,背后有高人哈哈,来一起回顾这场牛逼的操盘吧: 7 月 17 日凌晨,月之暗面发了 Kimi K3,2.8 万亿参数,Arena 前端代码排名第一,即将开源。 然后 24 小时内发生了两件事, 第一件,华尔街半导体股开盘重挫,纳斯达克跌了 1%,标普 500 跌了 1%,CNN 和彭博社的报道标题里,中国 AI 模型冲击美股是关键词。 第二件,《投资界》报道说 Kimi 已通知投资者调整公司架构,筹备赴港 IPO,最快 6 个月内完成港股上市。 别人的股价在跌,自己的股价准备开始。 这两件事放在一起,是不是比 2.8 万亿参数精彩多了, 一个中国开源模型的 Arena 排名,能直接变成纳斯达克 1% 的跌幅,不是因为 K3 全面超越了谁,它在综合智能指数上排第四,Fable 5 在 35 项评估里赢了 22 项,并不是新王者。 那华尔街在怕什么呢? 我觉得怕的不是这个模型本身,他们怕的其实是前沿能力 + 开放权重 + 中国公司这个组合,对闭源 AI 万亿美元资本支出的那个底层假设,突然给了一个反面例证。 那个假设很简单:最先进的 AI 能力是稀缺的,稀缺就应该贵,贵就需要巨额资本支出,巨额资本支出会带来长期的定价权。 K3 在这个假设上钻了一个空子, Arena 前端人类盲测第一,输入 $3,输出 $15,Fable 5 的输出是 $50,权重 7 月 27 日开放,之后任何人可以自己部署、微调、塞进私有工作流。 如果,注意是如果啊兄弟们,$15 的输出价格就能拿到人类盲测投票第一的前端 coding 能力,而且权重马上开源,那花几千亿美元训练闭源模型、然后收 $50 输出费用的商业模式,是在修一条收费高速公路,还是在一座即将免费的桥旁边建收费站。 华尔街的反应不是说这个模型太强了,是担心这个定价让整个投资回报率的算术变得不好看了。 这是第一层,第二层更有意思, Kimi 通知投资者调整架构,启动赴港 IPO,从短期不着急上市到筹备港股上市,不到一年。 这个时间窗口的选择显然不是偶然, Arena 前端第一 + 华尔街震动 + CNN/彭博头版,这套组合给了 Moonshot 一个全球定价时刻,在它走向公开市场之前,让全世界的投资者都知道了它的名字,而且不是在中国 AI 追赶者的叙事里,是在能让纳斯达克跌 1% 的叙事里。 IPO 需要的是一个让承销商可以讲的故事,K3 在 24 小时内把这个故事递到了全球财经媒体的头版上。 别人花几个亿做路演,Moonshot 用一次模型发布就做到了。 以前 AI 模型发布的受众是开发者和从业者,现在它的受众包括华尔街交易员、半导体分析师和港股承销商。 AI 模型发布正在从技术事件变成宏观事件。 这个转变一旦成立,以后每一家前沿 AI 公司的新模型发布,都不会只是开发者社区的节日,它会像上市公司的财报,不只是我们做到了什么,更是这个做到的事,让谁的假设失效了。 K3 不是第一个触发这个转变的模型,但它是第一个让发布即冲击这个范式变得如此清晰可见的。 一个中国公司,把开源模型的 Arena 排名推到前端第一,然后让大洋彼岸的半导体股跌了 1%,再趁势启动自己的 IPO 筹备,感觉有点像在上演一场关于定价权的公开争夺🤔。。。。 而争夺定价权最好的方式通常不是发论文,最好的方式就是让你的产品发布,直接变成别人股价的变量。

AYi

89,164 次观看 • 2 个月前