Video yükleniyor...

Video Yüklenemedi

Ana Sayfaya Dön

Qwen 今天发了 Qwen3.6-Plus,顺手把它接到 Claude Code 里试了下,效果比预期好不少。我让它帮我做一个工程师的个人作品网站,主要看审美和前端实现的表现,直接感受是这次质量提升很明显,Agentic Coding 也更清楚了。放到前端开发和长一点的任务里,它不会停在给你一段代码上,而是会自己接着拆需求、找路径、改代码、跑测试,发现问题再继续修,中间少了很多反复接手的地方。 这次另一个比较明显的点,这次任务拆解、规划、编码交付这条链路更好了,多模态和推理也基本到位了,图像、文本、视频这些输入能放到同一条链路里统一处理,接真实工程任务的感觉更完整,执行过程录了个视频,大伙有兴趣可以看看它是怎么一步步跑下来的。

94,740 görüntüleme • 5 ay önce •via X (Twitter)

0 Yorum

Yorum bulunmuyor

Orijinal gönderinin yorumları burada görünecek

Benzer Videolar

刚去小米店摸了下它的折叠机有感,大家有没有注意到在安卓这边折叠机都叫“Fold”,而苹果选了“Duo”。 其实从字面意思来看,Fold就是折叠,强调这个动作,很直观,但苹果使用了Duo这个从拉丁语来的词,它其实是有一组,一对的意思,是个组合。重点从“能折”转到“两种体验(一个手机两个形态,手机+iPad)是一对、能一起用合二为一,强调的是体验。 现在在回过头来看苹果的那个折叠动画,就解释了这个Duo,它从手机形态打开到iPad形态,或者反过来闭合起来,动画是连续的,强调只是变了形态,从人的大脑认知来看也是一样,你看到的东西没有消失后又出现一次。并没有安卓那样,从一个形态关闭后,又重新打开了另一个形态,中间过程不连续,是断开的。所有安卓折叠机都是这样,你在外屏打开一个app,在展开的时候,内屏是从黑到重新打开app的一个过程。所以并不能简单理解苹果的和其它安卓在这方面,就是多做了个过场动画那么表面。 另外苹果在这个时候推出Duo,一个呢,当然也是供应链技术发展到了苹果认为相对成熟的时候,二呢,也是它的AI布局,目前Apple Intelligence在今年也会迎来大更新,苹果相信在手机+iPad这个二合一的组合形态下,人们可以更好的体验AI的各种操作。简单的任务可以在手机形态下进行,复杂点的比如Codex和Claude这样的编程任务,也方便在iPad这个形态下进行。 如果说安卓或者是更早的微软Surface Duo开启了折叠这个形态,那么Apple可以说是重新定义了它。后续发展会更有意思,感谢自己处在这个科技飞速发展的时代,可以亲自见证这些迭代的过程。 当然我个人现在并不会买第一代的Duo,毕竟它相机过于拉胯了,这个是我个人非常看重的一个工具。 大家Enjoy!😊

小鹏Digital

28,907 görüntüleme • 13 gün önce

我去!image2和seedance2.0简直绝配 还记得在视频号上「流量上百万」靠流量日入过千的机器人变形视频吗 现在又有羊毛可以薅了 而且光变现就有两种方式,第一种直接发布这种视频,我能赚流量的钱 第二种,那通过这个视频会有很多的商家来找我给他们做,一单200,这个是我验证过的 而且获客也很简单,发两条在自己的视频号上就可以了,土老板很喜欢这个,做出来的视频样式就在下面 而且这个平台是「字节官方开白名单的平台」我一定要推荐一下! 就是之前我推GPT会员购买的GamsGo做出来的rita 真的一定要去试一下,链接我放下面了,而且这是我实际接到的第一个需求,后面还有一个需求,我下一条就马上写出来给你。真的AI赚钱很轻松 而且 Rita 不只是视频生成这一个功能,它一站式集成了 Seedance 2.0、Kling、Runway 这些视频模型,还有 Midjourney、Flux 、image2这些生图模型,Claude、GPT、Gemini 这些对话模型 一个平台搞定全部,不用在五六个工具之间反复横跳,效率真的不是提升一点 还有一点很实在:新人注册直接送 100 积分,Seedance 2.0 可以先体验再决定要不要付费 Mega 套餐 $11.99 一个月,1200 积分,算下来比官方便宜不少,试错成本低很多。 想试试的直接点这个链接,有什么问题直接评论区反馈给我!:

叫我阿杭

60,231 görüntüleme • 5 ay önce

最近我用了 Grok Bot 一段时间,这是我最近最喜欢的 Agent 产品之一。 原因甚至不是 Grok 有多聪明。 是它真的有一台自己的电脑。 AI Agent 的最终形态,其实就是给 AI 发一台电脑。 xAI 给 Grok Bot 配了一台持续存在的云电脑,里面有浏览器、文件系统和终端。登录状态、文件、浏览器 Session 都会留下来,你把电脑关了,它也可以继续干活。 听起来只是一个产品功能,实际用起来,我觉得它把 Agent 的体验往前推了一大截。 比如我每天都要刷 X。 以前让我用 AI 帮忙看 X,工作流通常是这样的: 我刷到一条东西,复制给 AI;AI 觉得有意思,我再去找原帖;再开几个链接;再把资料复制回来;让它查证;最后再让它帮我写。 AI 干了很多活,但真正操作互联网的那个人一直是我。 Grok Bot 让我第一次很自然地把这部分也扔掉了。 我直接在它那台电脑上把 X 登录好,然后告诉它去刷我的 timeline,看看今天大家在讨论什么,发现有意思的东西就点进去,把原帖、引用、相关讨论都看一遍,再去外面查资料,最后觉得值得写的,帮我整理成帖子。 它就真的去操作浏览器了。 网页没有 API 没关系,没有 MCP 也没关系。只要人能打开网页、登录、点击,它就有机会自己完成。xAI 自己对 Grok Bot 的定义其实也很明确,它可以登录并使用网站和 App,用 computer use 处理那些没有干净 API 的软件。 这才是 Agent 真正重要的一步。 过去一年大家一直在给 Agent 加工具,Search、Browser、Code、MCP、Connector… 工具越来越多,可我的体验经常还是我才是所有 Agent 背后那个最累的 Agent。 我同时开着好几个 AI。这个查资料,那个写代码,另一个做图,还有一个跑 Deep Research。 A 做完以后我复制给 B,B 做完以后再扔给 C。 名义上我有一支 AI 团队,实际上我是这支团队里专门负责复制粘贴、开网页和催进度的项目经理。 Grok Bot 有一个特别戳我的能力**,它甚至可以去操作另一个 Agent。** 我可以在它的浏览器里登录其他 AI 产品,然后告诉 Grok Bot 这个任务你去交给它。 等它跑完,把结果拿回来,然后继续完成后面的事情。 到这里整个关系就开始发生变化了。 以前是我管理五个 Agent。 现在我开始尝试只管理一个 Agent,然后让它去管理剩下几个。 而 Grok Bot 本身也支持多个 Bot 协作,它们可以互相发消息、传递上下文、交接任务,同时共享用户的云电脑、文件和登录状态。 我觉得这才是真正让我兴奋的地方。 过去我们把 Agent 想成一个会调用很多工具的模型。Grok Bot 给我的感觉,更像是第一次给 AI 分了一张办公桌。 电脑在那,账号在那,浏览器开着。有什么事情直接发消息给它,它自己去开网页、找东西、操作软件、叫别的 Agent 干活。 这和在聊天框下面再塞十个按钮,完全是两种产品感受。 只要 Agent 真正获得了电脑,它能接管的就不再是一两个 AI 功能,而是今天已经存在的整个软件世界。 几十年来所有软件,最终都默认一个前提是屏幕前坐着一个人。 现在这个人,第一次可以不是我了。

sleepy.md

21,551 görüntüleme • 25 gün önce

Anthropic 在 2026 年 9 月 17 日公布了一组进展:在两名技术人员监督下,Claude 用了不到四周时间,协助优化了 30 多个开源生物学模型,其中包括 AlphaFold3 和 Boltz-2,相关优化代码已经开源。 这件事情吸引人的地方,在于它处理实际科研代码的具体过程,也就是从进入工程仓库、定位问题、修改代码,到最后一步步拿指标做检查。 顺着这种科研工作流的思路,我最近试用了 ScienceBuddy。它是 PhAI Labs 推出的生物医学 Agent 工作台,我先用它跑了一个具体的文献梳理任务。 我给出的提示词是整理近几年用机器学习预测 CRISPR-Cas9 脱靶活性的相关研究,主要看基因编辑在目标区域之外产生误切的情况。 为了方便后续比对,我直接指定了输出结构,要求把研究任务、数据规模、主要发现、研究局限和 DOI 整理成规整的列。 ScienceBuddy 在当前任务窗口里生成了一张论文信息表格。不同研究使用的数据集、得出的结论以及原文入口被归纳在同一套字段下。这样的交互挺省事:输入的提示词、生成的表格以及后续的追问都停留在同一个工作界面,左侧列表也保留着历史任务记录,随时可以点回来继续补充条件。 拿到了整理好的表格,我抽查了其中一行,点击 CRISMER 对应的 DOI 链接,跳转到了 bioRxiv 上的原始预印本摘要。 表格里抓取的 CHANGE-seq 和 SITE-seq,确实是原文摘要里明确写出的训练数据;论文自身报告的 F1 值为 0.728、PR-AUC 值为 0.818,也逐字出现在摘要数据中,页面同时标有预印本提示。这里需要说明,这些准确率数值是 CRISMER 那篇论文自己的实验结果,并不是软件的性能数据。这次抽查做的事情很简单,就是顺着生成结果里的来源链接,确认关键字段能不能在原文里找到出处。 在另一个关于 GEO 公开组学数据的任务中,我查看了它的运行轨迹(Trajectory)。界面上展示了 query_geo、fetch_source、query_pubmed 等工具调用节点,清晰记录了系统在推进任务时尝试发起的查询动作。 关于底层的实现,项目方提到 ScienceIDE 是 ScienceBuddy 的底层技术框架,主要作用是把真实的科研代码封装成 Agent 可以执行、练习和验证的环境,并尝试通过科学标准来检查结果。面向普通用户日常使用的产品是 ScienceBuddy。 整套体验下来,最直观的感受是ScienceBuddy 把文献线索集中整理成表,并在同一个任务流里继续追问,遇到关键数据也能够直接从引用中找到 DOI 回原文做核对。 产品访问地址是 PhAI Labs 开发。我体验的时候 Preview 版本处于免费开放状态。如果平时需要梳理生物医学领域的论文脉络或收集开题证据,可以找一个具体课题试一试。

雪踏乌云

59,121 görüntüleme • 4 gün önce

大半夜体验完 Manus AI, 达到了今天的使用限制,说一下自己的感受🧵 整体来讲,真的很强大, 主要体现在 Manus 能够: 🔧展示完整的推理逻辑,有个 Manus 电脑的东西为你呈现所有过程和进展; 🏗️调用各种API 协同完成任务; 📃最终非常实际的交付给你一个可用的文件。 🌟「真正能干活」的AI Agent,这个定位真的太准确了。 以下是一些实例: 1️⃣基础任务完成度高 比如最近日本可以看樱花了,整理一个具体的旅行清单包括日程、推荐景点、住宿、交通等等; 家里领导喜欢看红楼梦,梳理一下红楼梦的人物关系。 以下是分别让他做的一个 pdf 文档和可以互动的网页,完成度是真的很高,不过人物关系上有一点小错误,无伤大雅。 其他比如让他阅读视频给到总结,甚至让他剪辑播客都是可以的(只是效果不太好)。 但是我尝试让他给我画一些图🗺️,这方面还有所欠缺,给到的理由是第三方 API 接口出错。同时网上说她可以做ppt,确实是可以的,但是能做ppt的工具都存在一个共同问题,逻辑还行,但就是丑。所以“美术”相关工作我理解还是做不了的。 另外,他是一个完成特定任务的助手,不要把它当作聊天机器人,不然他每次跟你聊天都要思考十几分钟,真的很难受。 2️⃣测一测他懂不懂Web3 给了两个任务: a) 我们今天发了一个depin的研报,花了一个多月,自认为还行,让他给这个研报评分,并且给到其他更好的文章推荐。 我们的depin报告如下 他给到的内容如图3,更详细的评价文档我传了一个Google 链接,放在最后了,各位可以自行查看(包括前面的红楼梦人物关系图)。 整体来看,他快速学习和阅读了大量 web3 depin 的报告,并且从多个维度给出了我们报告的评价,以及推荐的其他报告和对应的评价。 b) 假设我是一个 交易所cmo,如何做华语市场的传播策略,包括华语媒体和华语kol的整理和评级。很遗憾,我已经等了一个多小时他还没思考完,如果明天有结果,我也会传到Google link里。(Manus 可以离线、多任务思考,所以可以同时开启多个任务,或者关机后之前的任务仍然会运行) 不过我看到了他的实时分析过程,在阅读各个媒体、kol 的官网文章,历史推文等等,形成自己的分析。见图4 所以我理解在他的大脑里是有 web3 内容,并可以实时学习的。 3️⃣除了懂,他能否与 Web3 交互 以上的推理其实都和 Web3 没有实际关系,我更关心他能否拿到链上数据,甚至能够交互。比如是否知道 $SOL $ETH 能在哪些地方质押,收益如何等等,还有一些深入的分析问题。 很遗憾,今天的使用次数达到限制了。明天再说吧👋 -------------------------------------------- 等待 Manus 思考结果的时候,我也看了一些其他的博主评价和官方的介绍,我觉得有一点说的很好: “没有开源,就没有 Manus AI” 从一个体验过多个AI产品的小白角度,我其实觉得 Manus 会这么火爆的原因主要在于:调用了多种 API 接口,配合自己的推理算法最终呈现了一个很好的产品。 这让我想到 ai16zdao 每周都有新的人贡献 plugin(比如 微信,deepseek),让这个网络不断壮大; Virtuals Protocol 通过打通 agent 得底层框架,形成 agent 经济体;还有 Hey Anon 不只是有链上数据,还能直接帮你交互等等。 某一天,web2 和 web3 的 AI 产品肯定会更加紧密的相互协作,并出来几个不错的case。 最近有一些 betting 的产品已经初现端倪。 Manus 也会开源自己的能力,为了更大的 AGI 世界。 如果真到了那一天,我就真的要失业了🥲 ( Google drive 素材链接:

Zolo 🌊

40,430 görüntüleme • 1 yıl önce

我不准备把 BerryCode 做成最便宜的中转站。 现在市面上有 0.06 倍、0.1 倍、0.2 倍的渠道,我知道这些价格看起来非常诱人,但我现在只能做到 GPT 官网口径 0.28X,也就是 0.4 折,用 1 M token, 综合下来大约在 0.4~0.6 人民币;换句话说,它不是最低价那一档。 但我能保证一件事:BerryCode 现在只做纯 GPT。 坦诚讲,我的能力还撑不起 Claude 中转。 Claude 封号太严,我承担不起这个风险,也不想为了多卖一个模型,把一个自己都没把握的东西塞给用户。后面我会自己体验一批价格合适、稳定性还不错的 Claude 中转站,如果真的好用,我会直接推荐给大家。 但 GPT 对我来说,是另一回事。 我现在用 Pro 账号做号池,配合一部分补充渠道去填 token 缺口,即便不卷到全网最低价,毛利润率依然能做到 30% 左右,这个数字对我来说已经够了。 我有一个暴论: **你现在能看到的大部分 AI 机会,其实都已经开始走下坡路了。** 中转站最近在推特被骂得很惨,卖数据、掺水、跑路,大家骂得不算冤,因为这个行业确实混进来了太多只想短期收割的人。 而且后面中转站这个生意只会越来越不稳定。 官方会持续封控各种渠道,低价货源会越来越少,成本会越来越高,如果一个站唯一的竞争力就是便宜,那它迟早会遇到一个问题: 成本涨了以后怎么办? 2C 用户对价格很敏感,你今天用低价把人吸进来,明天成本上升你要涨价,用户凭什么继续用你? 所以我现在越来越确定一件事: **中转站最后拼的不是谁便宜,而是谁值得被信任。** 信任从哪里来?我有几个思考: 第一,你得有自己的个人 IP。 如果一个完全匿名的站跑路,用户连骂谁都不知道;但我这个账号就在这里,几千个关注我的人也都在这里,BerryCode 真出了问题,我不可能装作没发生过。 第二,你不能什么模型都往上写。 我现在不碰自己没把握的 Claude,不碰我无法承担封控风险的渠道,只做我能解释清楚成本、稳定性和边界的 GPT。 第三,你得承认自己不是万能的。 我不说 BerryCode 永远不出问题,也不说它多便宜,我只能说我会把每一次问题都摊开讲,把修复过程讲出来,把我能做到的稳定性做到极致。 真正长期使用中转站的人,需求和轻量用户是不一样的。 轻量用户可能只看今天谁便宜 20%,但那些每天要跑 Codex、Vibe Coding、自动化任务、长上下文任务的人,他们更关心的是: 会不会突然跑路? 会不会掺模型? 会不会偷偷改请求? 会不会跑到一半没额度? 出了问题有没有人处理? 尤其是国内那些真的在用 AI 做业务的人,他们并不只是想省几块钱,他们想要的是一个能长期放在工作流里的入口。 这也是我为什么选择用更稳的方式做 BerryCode。 一个 Pro 账号 1400 左右,我拿它做号池,成本不低,但我心里踏实;我宁愿少赚一点,也不想把整个站建在自己都解释不清楚的便宜渠道上。 坦诚讲,我为什么要做中转站? 第一,肯定是赚钱。 去年炒币负债以后,我现在确实很需要现金流,这个没什么好装的,来推特的人也不是为了单纯装逼,大家都要吃饭。 第二,我的推特一个月涨了 4200 个粉,但我前阵子很迷茫,不知道该把这些流量导向哪里。 推特上很多商业模式,本质还是拉人头,做应用也好,做服务也好,很多钱来得快,但不一定长久。 中转站当然也不是一个完美的行业,但只要我不赚那些没良心的钱,只要我真的能给用户提供稳定、透明、可用的服务,那这个钱我觉得可以由我来赚。 第三,这一个礼拜搭 BerryCode,我认识了很多以前接触不到的人。 有做政务网站的,有用 AI Vibe Coding 做产品的,有自己搭工作流的,有在公司里偷偷把 AI 引进业务流程的。 我每天通宵改代码、测接口、修登录、修支付、修人机验证,虽然累,但我很久没有这么强烈地感觉到,自己正站在一个还在生长的行业里。 这个感觉有点像早年的币圈。 混乱是真的混乱,但开放也是真的开放;风险是真的风险,但机会也是真的机会。 所以从今天开始,BerryCode 正式进入压力测试和拉新阶段。 活动很简单: 充 20,送 10 平台额度; 充 200,送 100 平台额度; 最高充 2000,送 1000 平台额度。 我需要通过真实用户的使用,知道服务器、号池、支付、监控、客服到底要做到什么程度,才算是一个能长期运营的站。 如果你只是想找全网最低价,那 BerryCode 大概率不是最适合你的。 但如果你想找一个价格不离谱、模型边界讲清楚、出了问题有人处理、愿意长期把信任一点点攒起来的 GPT 中转站,可以来试试。 后面这个群也不叫 BerryCode 交流群了。 我想把它叫做: 才谷和他的朋友们。 欢迎体验,也欢迎挑毛病。 我现在最需要的不是一句“支持”,而是真实用户把问题砸到我脸上,然后我一个一个修掉。

Mr. 才谷

10,554 görüntüleme • 4 ay önce

非常Nice啊,这模型完全免费,Token终于可以自由白嫖了,甚至视频模型都是免费的,太爽了。 它叫Agnes AI,全球模型榜前十,6 月 1 号起把自己家三个核心模型全免费开放了,无限期。图片模型在 artificial analysis 上榜了,文字模型一周被干了一万亿 Token。我把它接进 Claude Code,配起来十分钟的事,Token 随便用。 这玩意到底是什么呢。 Agnes AI 是全球模型榜单前十的一个 AI Lab,这次免费开放的是三个模型,文本、图片、视频。 文本模型叫 agnes-2.0-flash。能写代码,能做知识问答,能跑 Agent,能规划复杂任务。在 Claw-Eval 智能体评测榜进了 Top 10。说真的,这周它还要上 1M 超长上下文,以前用 200K 的模型跑到 150K 就降智,这种破事不用再忍了。 图片模型叫 agnes-image-2.1-flash。图改图、多图融合、换背景、改文字、图像修复,电商主图和广告素材这种反复改的场景,太合适了。最近还加了 4K 超高清输出,最高 4096×4096,生成的图可以直接进印刷,不是那种看着还行一放大就糊的草稿。 视频模型叫 agnes-video-2.0。原生音画同步,首帧生视频、首尾帧生视频、多镜头切换都支持,720P 和 1080P 随便选。 接进 Claude Code 怎么搞,其实很简单。 第一步,去 注册,拿到 API key。 第二步,打开 cc-switch。右上角选 Claude CLI,右上角点 + 号,选自定义配置。把 API key 填进去,请求地址写 格式选 OpenAI Chat Completions。 第三步,点获取模型列表,选 agnes-2.0-flash。 第四步,点左上角设置,找到路由,打开路由总开关,Claude 打开。 完事。 回到 Claude Code 正常发消息,模型就已经切过去了。我试了一个在酒吧吉他弹唱的视频,和真人区别不大。 现在 Token 不要钱,Agent 该跑几轮跑几轮,该拆几步拆几步。反正我觉得这才是免费开放最爽的部分,不只是省钱,是心理上解放了。 我测试了一下视频模型,能用,就是慢了点,文字模型还是比较快的。 开发者文档在 OpenClaw、Hermes、Claude Desktop 的,也有现成教程。

产品经理老王霸

55,220 görüntüleme • 3 ay önce

今天大家都约会跨年了吧?是不是饭店爆满?酒店爆满?至于我还在一线奋斗吗? 如果回到最底层去看区块链,其实它只解决了一个问题。 程序是不是按照约定执行了。 EVM 时代,这个问题的答案是,用全网重复执行来换确定性。 所有节点跑一遍同样的程序,用资源浪费换信任。 但这个模型一旦遇到复杂程序,就开始崩。 状态越复杂,成本越高。 逻辑越多,执行越慢。 ZK 的出现,并不是为了让链更快,而是为了换一种证明方式。 不是你跑过,而是你能证明你跑对了。 问题在于,大多数 ZK 系统,只解决了证明问题,没有解决编程问题。 开发者写的依然是“执行逻辑”,只是最后被翻译成电路。 而 Miden 真正不一样的地方,在于它一开始就假设。 程序不是给机器跑的,是给人验证的。 这就是为什么 Miden 要单独设计一套 VM。 不是因为 EVM 不够好,而是因为 EVM 从来不是为可证明性而生。 Miden VM 的核心不是 Gas,不是吞吐,而是可组合的证明语义。 每一段程序,在设计时就已经被拆解成可以被证明的最小单元。 你写代码的时候,不是在思考执行顺序。 你是在定义一条可被验证的状态转换路径。 这听起来抽象,但它会直接改变开发者的行为方式。 在 Miden 上,状态不是默认共享的。 状态是本地的、私有的、按需提交证明的。 这意味着什么。 意味着你不再被迫把所有中间状态暴露给链。 你只需要在关键节点,证明结果成立。 这对应用层的影响非常大。 比如钱包逻辑。 在传统模型里,账户状态是公共的。 余额、nonce、授权路径,全在链上。 在 Miden 的模型里,账户更像一个本地程序。 你控制状态。 链只验证结果。 这让很多过去“不可能”的设计,第一次变得合理。 比如复杂账户抽象。 比如多步条件执行。 比如带隐私的业务逻辑。 更重要的是,这套模型天然降低了应用复杂度对链的压力。 在 Miden 上,复杂性不会扩散。 你写复杂逻辑,只会增加你自己的证明成本,而不会拖慢全网。 这和 EVM 体系是反的。 EVM 的复杂性是外溢的。 一个复杂合约,会影响所有人。 Miden 的复杂性是内收的。 复杂度由使用者自己承担。 这背后其实是一种非常明确的价值取向。 让写复杂程序的人,为复杂性买单,而不是让整个系统为其兜底。 这也是为什么 Miden 更像一台操作系统,而不是一条普通公链。 它不是在堆功能,而是在重新划分责任边界。 链负责验证正确性。 程序负责证明自己。 当你站在这个角度看,就会明白 Miden 为什么不急着追 TPS。 也不急着推生态数量。 因为它赌的是一个长期趋势。 链上程序一定会越来越复杂。 而复杂程序,必须有更强的可验证结构。 如果你只用 Miden 来写简单合约,那你感受不到它的优势。 但一旦你开始尝试写有状态的、长期运行的、需要隐私的逻辑。 你会发现,传统模型根本撑不住。 所以 Miden 的真正目标用户,不是短期应用开发者。 而是那些想把“业务逻辑本身”搬到链上的团队。 当链不再只是结算层,而开始承载程序可信度。 Miden 这种设计,就会显得非常超前。 这也是我对 Miden 的核心判断。 它不是为当前周期服务的链。 而是在为下一代链上程序,提前搭好运行环境。 在 ZK 赛道里, 速度会被追平,成本会被压低。 真正拉开差距的,只会是编程模型本身。 而 Miden,走的是一条非常少有人敢走的路。 从源头重写规则,而不是在旧规则上修补。 Miden #Miden #KAITO

比克大魔王

89,488 görüntüleme • 9 ay önce

MiMo推出1000 Token/s超高速模型|体验测评 MiMo 推出了 MiMo V2.5 Pro UltraSpeed 超高速的模型版本,能够实现每秒输出超过 1,000 Token 的速度。 同时,这应该也是全球第一个达到这个速度的万亿(1T)参数模型。 藏师傅提前试了一下,做了三个测试,确实爽。 第一个跑了一个比较复杂的 3D 采矿小游戏测试。在没有素材的情况下,我让它全部用 Three.js 前端代码来生成素材。整体要求比较完整,虽然第一次实践时出了一些小问题,但在跟他沟通修改建议后,非常完美地实现了任务。 这次测试的各项指标如下:思考的 TPS:804 Token/s,峰值速度:810 Token/s,首次响应时间:4.71 秒。 第二个测试给了一个官网,其头部包含一个相对复杂的 3D 动画。 这次的输出速度快了非常多:峰值达到了 1426 Token/s,首次响应只用了 0.83 秒,在 32 秒内输出了 25624 个 Token,总计生成了 1000 行代码。 第三个测试给了一个更复杂的官网。我要求这个官网的 Header 头部包含以下 3D 效果:地球边缘、轨道上的飞船、星际尘埃、航线图、舷窗的 HUD 样式。 这个效果非常好,整体的视觉样式、状态、SVG 动画和驾驶卡片都非常精细,还有滚动的视差效果 这个输出的 TPS 达到了 1136 tokens/s,首次响应是 4.5 秒 官方测试平台下面有个数据展示,会显示相关信息 在流式输出的情况下,当你看着它只用 20 秒就产生一个非常复杂的 3D 游戏时,那种场景还是比较震撼的 之前的这些(比如说 Groq 之类的)超高速推理方案,在模型能力或者是整体水平上都会有所下降,但是 MiMo 这个在测试的时候,我没有看到这种迹象 最近很多公司都开始推出这种超高速的 API 服务,比如之前 OpenAI 和 Anthropic 都有 Fast 模式 在 Agent 场景下,模型输出效率的提升会直接带动每一步 Agent 操作的效率: 如果一个任务预估一分钟完成,你就会盯着它直到结束,然后立刻投入测试。如果需要五分钟才完成,你可能就会去干别的事,然后再回来看,难免会浪费一些时间 这种效率提升在 Sub-Agent 和并发场景下更加明显。因为它可以更快地产出大量结果,想象一下,如果同时启动一两百个 Sub-Agent,在模型能力没有衰减的前提下,速度提高 10 倍,体验是非常爽的 毕竟这本质上是面向那种对效率有极高要求的 To B 客户所推出的 希望后面大家卷起来,优化一下成本,让普通用户也能放开用这种 UltraSpeed 模型

歸藏(guizang.ai)

27,376 görüntüleme • 3 ay önce

被 Astra 震撼后的一个顿悟 —— 要给自己配置无限额度的最强算力 下午 Tibo 重置之后,我又满血复活了,然后重新跑了一个工作任务,做培训资料。 在这之前,因为额度不够,我先用 DeepSeek 4.1 做了一些信息抓取,也跑了一版培训资料。结果怎么说呢,生成出来的东西基本就是一坨,完全不具备可用性,还花了很多时间,烧了大几百万、甚至上千万 token。 这过程中我还顺手研究了一下 CC Switch 和 Open Code X,真挺有意思的。 CC Switch 我感觉做得非常棒,比较轻量,Open Code X 也有一些可取之处。这两个东西如果以后有人能融合一下,我觉得会很有意思。 话说回来。 Tibo 重置之后,我把同一个任务重新交给 Astra 跑了一遍。 结果出来的时候,我直接傻了。 它把我原来文件夹里的资料重新抓了一遍,又结合自己检索到的一些信息,最后整合成了一份可以直接拿来做培训的资料。 最让我惊讶的是,它还帮我配了对应的图片和演示视频。 而我的资料文件夹里,其实相关视频并不少。但它最后挑出来两个,刚刚好就是在我看来最有代表性、也最能说明这个功能的两个。 这个感觉就很夸张。如果只是抓资料、做总结,那还是效率工具。 但它能从一堆素材里面,挑出最适合放在这里的内容,那一瞬间我真的感觉: 它理解了这个东西。 不是简单的检索,也不是信息拼接。 它知道这个培训资料想讲什么,也知道什么东西最适合拿来说明。 有那么一瞬间,让我感觉 AGI 了。 然后我脑子里面冒出来一个非常现实的想法: 我还招什么人? 至少资料检索、竞品研究、培训资料整理、信息汇总这一类工作,我招一个实习生,真没有一个 200 刀的 Pro 账户有用。 而且还便宜高效得多。 我现在只恨一件事: 当初为什么没有多囤几个 200 刀的 Pro… 下一个目标,就是等重新开放之后,给自己配置无限额度的 Pro 账户。 另外下午还跑了一个鹈鹕测试。我不懂背后的运动学细节,但成片的协调、平衡和 taste 已经很惊艳。 9分钟就跑出了这样的效果,很高级 视频放在下面,大家可以自己感受。 “今天,骑得开心”

Robinson · 鲁棒逊

39,928 görüntüleme • 15 gün önce

太牛了,海滩这么穿我能理解,滑雪场这么穿我直接 CPU 干烧。 这是图啥?图一个我命由我不由天气? 看迷糊了真的。 这一刻我终于明白了: 滑雪不是运动,是一种精神状态。 至于穿多少——取决于你对人生的理解有多开放。 近期最硬的山寨币非 $M 莫属 先看 $M 本身的价格状态。 这段时间整体行情其实不算好,但 M 的走势很明显不一样 价格一直在高位区间横着走,没有出现那种一泻千里的踩踏。 从K线图上看,放量拉升后并没有直接回到起点,而是反复换手、震荡消化,说明一个问题: 筹码在被接走,而不是被砸穿。 更关键的是,M 现在还没上线一线交易所的现货。 现货主要集中在二线平台,但已经先上了币安合约。 这个顺序本身就很有意思: 先给高风险玩家用合约定价,再慢慢铺现货流动性, 说明项目方并不急着一次性把故事讲完,更像是在控节奏。 在现在这个环境里, 市场已经不太买画饼 + 一次性拉满的账了, 反而更愿意给节奏清楚、预期分阶段释放的项目时间。 再说 M 背后的 MemeMax在做什么。 它不是又一个发币的平台,而是想把炒 meme这件事,做成一个长期能产生交易量的基础设施。 现在大多数 meme 项目,生命周期都很短: 拉一波、砸一波、换下一个。 MemeMax 明显是想解决这个问题。 核心点:meme 专用的高杠杆 Perp 交易。 大家都知道,meme 的波动有多夸张, 一天 100% 上下是常态。 MemeMax 直接顺着这个特性来, 提供最高 20x 到 100x 的 meme 合约。 重点不只是能开多, 而是终于能系统性地做空 meme了。 过去市场只有追涨,现在是涨跌都能赚钱, 这对交易量意味着什么,其实不需要多解释。 Hyperliquid 已经验证过这种模式能把量打到多夸张, MemeMax 做的是更垂直、更极端的版本。 MemeCore Intern | MemeMax⚡️ #KaitoYap #Yap

memory

32,389 görüntüleme • 9 ay önce