Video yükleniyor...

Video Yüklenemedi

Ana Sayfaya Dön

15 张数据图帮你了解 DeepSeek Harness 昨天 DeepSeek Harness 发布,于是就想着让 Codex 分析一下,找到了一个很好的角度,就是从一些数据上向大家介绍这个产品。 确实也发现了一些很有意思的东西: 插件系统与 Koishi 高度相似: 他们主打的插件系统与 Koishi 的插件平台相似度高达 75%。大概率是整个平台都挪过来了,不知道是不是他们的核心开发者入职了。 大量使用 AI 开发: Codex 命名的主干 PR 达到了 21.2%,分支信息中提到 Codex 的比例有 28.2%。 猜测他们肯定用了 Claude Code 开发,只是删掉了一些 Claude 的痕迹。 参考了大量外部 Agent 项目: 提到最多的外部项目是 Pi,第二多的是 Codex,之后是 Claude Code。甚至直接引用了一些 Pi 的 TypeScript 文件。 高效的代码产出: 整个产品在...

16,428 görüntüleme • 1 ay önce •via X (Twitter)

0 Yorum

Yorum bulunmuyor

Orijinal gönderinin yorumları burada görünecek

Benzer Videolar

deepseek-harness重磅开源,采用了一切皆插件的架构,也就是中国版的openclaw,体验了下可以称之为私有化的workbuddy。 场景侧冲击:有了deepseek-harness之后,企业域的私有化code、cowork基本用这个就可以了,直接会冲击workbuddy之类的市场。 之前DeepSeek Harness内测招募,本质是一次开源 Agent 生态大摸底,把全球 Agent 基础设施的家底扫了一遍后,预计后续版本应该会在开放生态上做一些事情。 dsh看点不在"又一个 Claude Code",有3个看点: 1️⃣ 一切皆插件 模型、工具、skill、会话、沙箱、存储、主循环、调度,连 UI 都是插件,配置里全都可换,不动源码。四种运行模式里最有意思的是 Minimal——只留一个 bash 和一个文件编辑器,摆明了是给模型做裸机 benchmark 的。 2️⃣ 每一次运行都可回放 系统提示、推理过程、工具调用与结果、子 agent 调度、所有 context 注入,全部进 append-only 的 session log,resume / fork / search / replay 都跑在同一条事件流上。 3️⃣ 最狠的是内核 dsh 跑在 Cordis 上,它把插件系统拆成两个正交维度:时间可组合性:卸载一个组件时副作用能完整回滚(每个 context 变换都带一个逆,运行时来追踪);空间可组合性:依赖可声明、且 context 一变就反向通知组件。还给了一套动态组合的演算,证明这个性质能从单个组件传导到整个系统。 总的来说,这次deepseek-harness最大的特点是极致的可替换性,也就是用最小的基础来承载,然后其他都是可插拔的插头。 #DeepSeek #harness #Cordis #编程范式 #北大 #开源

AIGCLINK

39,274 görüntüleme • 1 ay önce

OpenAI 的大神 Andrej Karpathy 前几天在他的 YouTube 频道讲了一堂课,系统的介绍了大语言模型,内容深入浅出,非常赞,抽空将它翻译成了双语,由于内容较长,我将分批上传,以下是第一部分精校后的双语视频,字幕文稿如下: Intro: Large Language Model (LLM) talk 大家好。最近,我进行了一场关于大语言模型的 30 分钟入门讲座。遗憾的是,这次讲座没有被录制下来,但许多人在讲座后找到我,他们告诉我非常喜欢那次讲座。因此,我决定重新录制并上传到 YouTube,那么,让我们开始吧,为大家带来“忙碌人士的大语言模型入门”系列,主讲人 Scott。好的,那我们开始吧。 LLM Inference 首先,什么是大语言模型 (Large Language Model) 呢?其实,一个大语言模型就是由两个文件组成的。在这个假设的目录中会有两个文件。 以 Llama 2 70B 模型为例,这是一个由 Meta AI 发布的大语言模型。这是 Llama 系列语言模型的第二代,也是该系列中参数最多的模型,达到了 700 亿。LAMA2 系列包括了多个不同规模的模型,70 亿,130 亿,340 亿,700 亿是最大的一个。 现在很多人喜欢这个模型,因为它可能是目前公开权重最强大的模型。Meta 发布了这款模型的权重、架构和相关论文,所以任何人都可以很轻松地使用这个模型。这与其他一些你可能熟悉的语言模型不同,例如,如果你正在使用 ChatGPT 或类似的东西,其架构并未公开,是 OpenAI 的产权,你只能通过网页界面使用,但你实际上没有访问那个模型的权限。 在这种情况下,Llama 2 70B 模型实际上就是你电脑上的两个文件:一个是存储参数的文件,另一个是运行这些参数的代码。这些参数是神经网络(即语言模型)的权重或参数。我们稍后会详细解释。因为这是一个拥有 700 亿参数的模型,每个参数占用两个字节,因此参数文件的大小为 140 GB,之所以是两个字节,是因为这是 float 16 类型的数据。 除了这些参数,还有一大堆神经网络的参数。你还需要一些能运行神经网络的代码,这些代码被包含在我们所说的运行文件中。这个运行文件可以是 C 语言或 Python,或任何其他编程语言编写的。它可以用任何语言编写,但 C 语言是一种非常简单的语言,只是举个例子。只需大约 500 行 C 语言代码,无需任何其他依赖,就能构建起神经网络架构,并且主要依靠一些参数来运行模型。所以只需要这两个文件。 你只需带上这两个文件和你的 MacBook,就拥有了一个完整的工具包。你不需要连接互联网或其他任何设备。你可以拿着这两个文件,编译你的 C 语言代码。你将得到一个可针对参数运行并与语言模型交互的二进制文件。 比如,你可以让它写一首关于 Scale AI 公司的诗,语言模型就会开始生成文本。在这种情况下,它会按照指示为你创作一首关于 Scale AI 的诗。之所以选用 Scale AI 作为例子,你会在整个演讲中看到,是因为我最初在 Scale AI 举办的活动上介绍过这个话题,所以演讲中会多次提到它,以便内容更具体。这就是我们如何运行模型的方式。只需要两个文件和一台 MacBook。 我在这里稍微有点作弊,因为这并不是在运行一个有 700 亿参数的模型,而是在运行一个有 70 亿参数的模型。一个有 700 亿参数的模型运行速度大约会慢 10 倍。但我想给你们展示一下文本生成的过程,让你们了解它是什么样子。所以运行模型并不需要很多东西。这是一个非常小的程序包,但是当我们需要获取那些参数时,计算的复杂性就真正显现出来了。 那么,这些参数从何而来,我们如何获得它们?因为无论 run.c 文件中的内容是什么,神经网络的架构和前向传播都是算法上明确且公开的。

宝玉

1,125,029 görüntüleme • 2 yıl önce

OpenAI刚刚开源的这个东西,感觉要把程序员的工作方式给整个改写了。 现在大家都在卷模型写代码有多强,但其实真正的瓶颈早就不是生成了。 一个人每天最多同时有效监督3-5个编码Agent,再多就会注意力崩溃,生产力直接归零。 有了Symphony,直接把这个上限干到了几十个。 它把你的Linear、GitHub Issues直接变成了永远在线的Agent调度器。 你开一个任务,它自动启动一个独立隔离的Codex Agent。 自己写代码,自己跑测试,自己做交叉Review,damn! 全部搞定之后,会给你提交一个完整的证据包。 CI全绿,安全和性能专项审查通过,改了UI就自动录好操作视频。 所有验证全过了,才会出现在你的Human Review队列里。 以后人类的角色可能会被彻底颠覆了。 以前你是监工,盯着Agent一步一步写代码,上下文切到吐。 现在你是老板,只需要看最终的结果。 满意就点合并,不满意就去仓库里补规则补文档补Guardrails。 记住兄弟们,永远不要手把手指挥Agent,永远不要替它干活。 这可不是啥实验室概念,OpenAI自己已经这么干了。 三个工程师,五个月,写了一百万行代码,0行人工写的。 产品已经有几百个内部用户,每天都在迭代。 我觉得他们最厉害的不是模型,是他们把整个仓库变成了Agent能看懂能自主工作的乐园。 现在很多人都搞错了Agent时代的核心竞争力。未来不是谁的模型更聪明,而是看谁能设计出让Agent可靠自主工作的环境。 我觉得未来最好的工程师,再也不是写代码最快的人,而是那些最会写规则,最会设计反馈回路,最会给Agent搭舞台的人。 现在Symphony已经开源了,它甚至不是一个成品。 是一个17k token的完整SPEC。 你把这个SPEC喂给任何一个编码Agent,十分钟就能生成你自己定制版的Symphony。 GitHub地址评论区自取👇

AYi

63,210 görüntüleme • 5 ay önce

写给 CZ 🔶 BNB 和 Yi He 的请求信 我写这段话的身份来自HODL Hodl 和邦联 Commonwealth 社区成员,也许二位知道王大有 王小有 这个人,也许不知道,我想客观介绍一下他和他的项目,无论是否能够回应和答应社区的请求,我真诚的希望二位可以看完我这段话。 HODL是一个构建在BNB Chain上以几乎全空投的形式流通的代币,上半年的时候,王大有以一个Memecoin成功者的身份回到BNB Chain创建了HODL,他在社交媒体送给了无数人空投,或几千块钱,或几万块钱,从这一点来思考,他是否是一个值得我们去了解的人? 邦联是同一生态下的产品,我们的代币叫做“4”,我们的故事是为了致敬CZ,我们更是希望更多的人继承CZ的精神,在Crypto做一个真正的Builder,不可否认,这个名字最初的诞生可能有讨好币安的成分,但我们真正的精神传承来自于CZ的言行,王大有邀请我加入建设社区之时,我思考过,犹豫过,纠结过,最终是他向我讲述的愿景打动了我,我愿意做一个Builder,在自己的层面去做到这件事情。 也许王大有这个人所展现出来的性格是复杂的,但在我眼里他是单纯的,在PVP日益严重的今天,又有几个人愿意在一个生态和社区耕耘200天呢。 有人说他坏,但是他实实在在帮助了很多困难的社区成员。 有人说他赚了很多钱,但是他真真切切在高位做了所有想退出人的流动性。 有人说他唯利是图,但是他确确实实退还了Mint最初“法”的百万美金。 他想赚钱,但是他更希望社区成员一起赚钱,他是一个中二的人,也是一个理想化的人,他会为了一个不知真假的故事付出真金白银,他也会为了一个不明所以的约定拿出自己所有的收入。 作为一个项目方,他是失败的,作为一个建设者,他在我眼里无比成功。 是的,他已经混到要抵押自己的房子来把项目做下去了,他是一个很傻逼的项目方,但是,他拥有很多和他愿意一起走下去的社区成员,他是一个很成功的建设者,这毫无疑问。 我不知道币安会注目哪些产品和社区,但我觉得一个在BNB Chain上拥有如此愿景和故事的生态,应该被关注到,我知道币安想要发展BNB生态,我不知道如何算一个应该被扶持的项目,我只是觉得一个优秀的建设者和一群满腔热血的社区成员不应该被无视。 CZ先生你应该知道,作为一个建设者在行业风向扭曲的时候,长期耕耘一个项目有多困难,一姐你应该也清楚,一个人顶着一片天空的感觉有多难受,所以你们都是优秀的、划时代的加密领袖。 我代表HODL和邦联社区感谢二位,即使可能我们依然得不到任何回应,但二位仍是我们心中加密社区最优秀的建设者和灵魂领袖,致敬你们,谢谢。

0xMoon

33,804 görüntüleme • 1 yıl önce