Video yükleniyor...

Video Yüklenemedi

Ana Sayfaya Dön

我超,牛逼! 目前最大的开源CAD操作数据集放出来了,超过1000小时。 Markov Labs发布了面向Computer-Use的CAD数据集,覆盖SolidWorks、Siemens NX、AutoCAD等主流软件。 内容包括屏幕录制、鼠标键盘操作、输入图纸、输出文件、评分标准和旁白讲解。 专业CAD软件操作复杂、界面密集,以前很难找到足够规模的真实操作数据来训练Agent。 现在有了上千小时的开源数据,做能真正操作CAD的GUI Agent有了更扎实的基础。 当工业软件的操作轨迹开始被大规模开源时,Agent进入专业设计工具的速度会加快。 你觉得CAD会是下一个被Agent深度攻克的专业软件领域吗? 地址:

59,284 görüntüleme • 5 gün önce •via X (Twitter)

0 Yorum

Yorum bulunmuyor

Orijinal gönderinin yorumları burada görünecek

Benzer Videolar

有人靠金融市场模拟,在链上赚了 $400,000 而且用到的整套工具,都是 GitHub 开源 能看到的钱包在这,自己点开看: 他们做的不是 crypto 原生叙事 而是拿 Russell 2000、Dow Jones、SPX、Apple、Google 这些传统金融标的来做 Polymarket 交易 问题也很现实: 这些数据平时都在大型中心化交易所里。 你怎么拿? 拿到之后又怎么处理,才能真的变成可交易模型? 这套公开出来的技术栈,大概是这样: 1)Financial Datasets MCP Server 给任意 ticker、任意时间周期提供价格数据解析。 核心卖点就是:免费真实数据。 GitHub: 2)MiroThinker 一个偏深度研究和预测的 agent。 据说在 BrowseComp benchmark 上做到 88.2。 特点是: 长周期推理 先验证再下结论 步骤级 + 全局级校验 单任务最多可调用 300 次工具 它的作用不是直接下单。 而是先通过 MCP Server 拉数据, 把研究、清洗、验证这些环节跑完, 最后整理成可以直接用于模拟的数据集。 GitHub: 3)MiroFish simulation system 把前面准备好的数据丢进去, 再设定模拟参数, 就可以开始跑价格行为模拟。 本质上,它卖的不是一个指标。 而是一种更接近“矩阵视角”的东西: 价格在不同条件下会怎么动 哪些路径更常见 哪些定价其实偏离了历史结构 整个流程串起来就是: 拉传统金融历史数据 → 用 agent 做研究和数据整理 → 把数据送进模拟系统 → 再拿结果去打 Polymarket 上的相关市场 这种玩法最值得看的,不是“开源”两个字 而是它说明了一件事: Polymarket 上很多看起来像事件交易的东西,背后其实已经在被人用传统金融数据 + agent 研究 + simulation当成量化问题来做。 你觉得这种 edge 的核心,更像是数据获取能力,agent 研究能力,还是最后那层 simulation 对市场行为的还原能力?

0x_Miko

23,786 görüntüleme • 5 ay önce

Distil-Whisper:让语音识别的速度提高 5.8 倍,参数减少 51%,准确度保持在 99%。 Whisper 在语音识别方面表现卓著,但是它有一个明显的缺点:训练出来的小模型支持的语言比较少,而大模型推理速度又很慢。如果你有海量的数据需要处理,或者对实时性要求略高,那使用 Whisper 可能会让你比较头疼。 你可以使用工程手段来加速推理,例如将语音分片后并发处理然后合并结果,但这里涉及到本地计算资源瓶颈的问题,以及合并分片时容错处理的问题,工程复杂度比较高。 《Distil-Whisper: Robust Knowledge Distillation via Large-Scale Pseudo Labelling 》, Whisper 的 Large-v2 model 生成了一系列的 soft targets(也就是概率分布),然后复制 Whisper 网络的第一层和最后一层解码器,最后生成了一个更小、更快效果更好的蒸馏模型 Distil-Whisper。论文数据写的是:速度提高了 5.8 倍,参数减少了 51%,准确度保持在 99%。 这个模型的效果之所以不错,主要还是得益于训练数据的完备,它结合了九个公开可用的语音识别数据集,合并后包含 21170 小时的语音数据,涵盖超过 18260 名说话者和 10 个不同的领域;自从 Whisper 大力出奇迹(它从互联网爬取了 68w 小时的数据,未公开)以后,相信后续语音领域的论文都会配置更庞大的数据集。 Distil-Whisper 目前开源在 Hugging Face 上,模型地址: Demo: Demo 会把模型下载到本地,然后通过 WebGPU 直接在网页上跑起来,测试了下效果,还是挺不错的。 目前仅支持英文,如果想让它支持中文,需要使用同样海量的中文语料数据,重新做一次知识蒸馏,但我觉得即便是这样做,效果也不一定好,因为 Whisper 本身对中文、韩语等支持就不太优秀,这个信息可以从 Whisper 的论文中找到数据支撑。 下面这个视频是 Whisper 和 Distil-Whisper 的对比效果:

Barret李靖

124,227 görüntüleme • 2 yıl önce

炒美股的兄弟们有福气了。龙哥找了一个开源软件,胜过彭博。 彭博终端一年订阅费够买辆二手车,FinceptTerminal零元。 这不是玩笑。彭博那玩意儿起步价两万美金一年,专业版往二十万走。普通散户、刚起步的量化团队、小型投资机构,基本被这个门槛挡在外面。 FinceptTerminal 干的事就一个:把这堵收费墙拆了。 2.7万星,纯 C++ 写,说明不是花架子。打开终端,股票、期货、外汇、宏观数据全在一个界面里,不用切来切去。行情实时刷新,技术分析工具直接能用,想跑量化模型也行,不是那种只能看 K 线的半成品。 几个实在的亮点:。 数据覆盖广。美股、欧股、亚太市场,外汇和大宗商品都进来了,宏观指标也能拉。不是只盯一个市场的玩具,是真的能当工作台用。 交互式探索。看数据不是死盯屏幕等刷新,可以自己下钻,点开某个行业、某只股票、某段时间,层层扒下去,找到你想看的那个数字。 开源免费。代码全在 GitHub 上,想改就改,想集成进自己的系统也行。彭博打死不让你碰它的数据接口,这个反过来。 举个场景。你想研究美股科技板块最近一周的资金流向,打开 FinceptTerminal,调出行业列表,点进科技板块,叠加宏观指标和个股资金数据,一套下来不用切软件、不用导 CSV、不用手动算比例。 安装也不麻烦,GitHub 上有详细说明,Linux 和 macOS 都支持。 金融圈一直有个怪现象:干活的人用的工具最贵,最需要数据的人反而买不起数据。这种开源项目能跑出来,说明大家真的受够了。 不是要替代彭博,专业机构该买还是买。但对于还在摸索阶段、想认真研究市场、但预算有限的人来说,这玩意儿就是真香的答案。 有兴趣的去 GitHub 翻代码就知道了。

空投龙 | |上Gate玩事件合约

11,852 görüntüleme • 2 ay önce

#工程师工具 今天给申请到了 ChatGPT Plugin 的权限,想聊聊体验和如何申请。 💡使用体验有些震惊到我,试想后面成熟了,YY 下是不是后面用户操作习惯就是一个大的输入框入口了,什么交互体验、用户设计、写前端全部被一个输入框和协议展示给一把梭替代了,直接回归本源,用最朴素的方式最快最完美来实现用户需求,甚至强大的上下文功能会比纯工具类查询更加方便。 😂 那到时候我们软件行业应该会发生些有趣的变化,应用开发没有所谓的前端、交互了,甚至 Api 的开发都可以你给到 AI 数据自动帮你生成了,到时候数据变得反而更重要。 🏂 试用 Plugin 过程,发现有累计几十个插件可以被使用,涉及工具、旅游、生活、游戏、学习等场景,不过太多是国外开发,也可以自己按照 Manifest 开发定制发布插件,每次最多使用3个插件,当前速度比 GPT4 还慢一点,有时候数据没有查到,他会换一种方式继续查询。 🤖 让 Expedia 帮我安排去东京的行程,会自动帮忙安排好机票、酒店、游玩、租车等服务,甚至出现了商品卡片,点击直接将参数带到官网一键预定,同时这里也具备交互以及上下文记忆的功能,相比自己去搜索要方便不少。 🔮 此外玩了一个文字类的游戏,类似于成长那种,能够让你一步一步选择要做的事情,并计算成长值啥的,适合喜欢养成类游戏的同学,不过这一块也有一定想象空间,好比上次给大伙推荐的那个电报机器人 Samantha 😂 我参考的此文档快速申请到的 Plugin 😂 此文档快速申请 GPT-4 Api

Tw93

159,098 görüntüleme • 3 yıl önce