Video wird geladen...

Video konnte nicht geladen werden

Zur Startseite

OpenAI推出GPT-6 Astra模型,称之为世界上最智能且最对齐的模型,在FrontierMath Tier 4、ARC-AGI 3 和 TerminalBench-4.0 上处于最先进水平。 目前Astra仅向有限的组织推出,几天内向所有ChatGPT Plus、Pro、Business和Enterprise用户开放。

21,430 Aufrufe • vor 17 Stunden •via X (Twitter)

0 Kommentare

Keine Kommentare verfügbar

Kommentare vom Original-Post werden hier angezeigt

Ähnliche Videos

“我们内部已经有 Gemini 3 水平的模型,并且有信心很快发布,之后还会有更强的型号!” OpenAI 首席研究负责人 Mark Chen 在 Core Memory 的播客上透露。Sam 的职责之一就是“放大紧迫感”,他自己的角色也类似,会刻意强调竞争压力让整个组织保持高压前进,所以大家才会看到那封内部的“红色警戒”备忘录🚨 前两天和 OpenAI 的同学吃饭还提到他们内部确实都在体验 Gemini 3。因为但单看公开基准测试不足以判断真实差距,让足够多的研究员在真实任务中摸一摸,再形成集体判断。 Mark 说自己有一个“私藏的数学难题”(“42 问题”),专门用来测试不同模型的推理能力 —— 包括最新的“思考模型”。到目前为止,所有模型都只能接近最优解,还没有完全攻克它,这对他来说是一件“好事”:说明还有空间可以继续前进。 在 SWE‑bench 这类软件工程基准上,Google 模型的表现虽然不错,但在“用多少数据/算力达成一定效果”这件事上,还有明显的优化空间,而 OpenAI 在这方面的算法储备非常强,这是他们下一轮反击的一个核心筹码! 过去两年。OpenAI 其实把大量资源都投向推理模型,预训练和后训练的“肌肉”有所退化;最近半年,在组织层面重新把焦点拉回预训练。Mark 明确反对“Scaling 已死”的说法,他认为在预训练和数据塑形上还有巨大空间; 现在要做的是更精细的“数据塑形”和“合成数据”,通过更聪明的预训练策略,让模型从“模仿人类写作/代码”的模式,转向真正学会更高层次的抽象✨

indigo

72,313 Aufrufe • vor 9 Monaten

"Agentic Software Engineer (A-SWE)” - OpenAI 的 CFO Sarah Friar 在高盛最近的一次活动采访中透露,除了 Deep Research 和 Operator 这两个 Agents 之外,OpenAI 很快将推出全新的软件工程师 Agent,一个全自动化的开发者,而不仅仅是辅助写代码!现在连 CFO 都比 Sam Altman 的爆料多😅 Sarah 将 OpenAI 迈向 AGI 的过程分为五步: 1. Chatbot 阶段:如 ChatGPT 最初提供的“实时回答”、文本生成等; 2. Reasoning 阶段:GPT 系列在 2024 年强调“推理能力”。例如 O 系列模型可进行“链式思考”(Chain-of-Thought),在回答复杂问题时能像人一样审视前后文并迭代修改; 3. Agents(智能体):2025 年被称为“Agent 元年”。OpenAI 目前已推出和即将推出三款“智能体”产品: - Deep Research:可自主执行深入调研,自动总结并生成专业报告; - Operator:可充当线上“任务代理”,帮助预订机票、酒店、餐厅等; - A-SWE(Agentic Software Engineer):可以自行完成软件开发、QA、Bug 测试和文档撰写,相当于一个“自动化开发者”。 4. Innovation(创新阶段):模型开始不仅仅依赖人类已有知识,还能提出全新见解,催生原创的学术或技术发现; 5. Agentic Organizations(智能体组织):AI 可以承担更多组织级别的决策与运营任务,深度渗透至经济社会的各个层面。

indigo

28,615 Aufrufe • vor 1 Jahr