工作日早上 7 点读 AI,周日早上 8 点读周报订阅邮件

METAL LAB

OpenAI奥特曼放话:阿斯特拉年底达到AGI级别

在《时代》专访中,奥特曼与高管团队对阿斯特拉的AGI级能力信心十足,但何为AGI的定义依然争议不断

이미지: METAL LAB 생성

摘要

  • 萨姆·奥特曼表示,按照他自己给出的定义,到2026年底公司内部系统将具备AGI级能力,首席研究官马克·陈称"已经走完了80%的路"
  • 首席科学家雅各布·帕乔基透露,下一代模型阿斯特拉只要拿到一篇研究论文,就能完成相当于人类研究者一周的工作量,还能把实验想法直接写成代码并汇报结果
  • OpenAI也在同步解决盈利难题:合并Codex与ChatGPT的"The Merge"项目、桌面/口袋/穿戴三类硬件设备,以及在ChatGPT中扩大广告投放
발언 주체
샘 올트먼(오픈AI CEO), TIME 인터뷰
시점 자신
2026년 연말까지 내부 AGI급 시스템 확보, 아직 '완전 도달은 아님'
마크 첸(최고연구책임자)
AGI까지 '80%의 길을 왔다'고 언급
그렉 브록만(공동창업자)
이 시기를 훗날 AGI 출현 순간으로 회고할 것이라 발언
아스트라 능력
야콥 파초키(수석과학자): 연구 논문 한 편을 사람 연구자 약 1주일 분량으로 처리
기기 계획
탁상용·주머니용·착용형 3종, 첫 제품은 퍽 모양·음성 대화형, 내년 초 출시 예상
수익화
챗GPT 소비자 이용자 92%가 무료 이용(CFO 사라 프라이어), 광고·스폰서드 에이전트 확대 테스트 중
취재 방식
알렉스 히스 기자가 20명 넘는 임직원·투자자·경쟁사 관계자를 2주 넘게 인터뷰

奥特曼:"阿斯特拉年底就能触及AGI"

OpenAI首席执行官萨姆·奥特曼表示,按照他自己对通用人工智能(AGI)——一种能完成几乎所有人类智力劳动的假想AI——所下的定义,公司内部系统今年之内就能达到这一水准。他虽然强调"还没有完全实现",但在时间点上说得很明确。首席研究官马克·陈表示,通往AGI的路已经"走完了80%",联合创始人格雷格·布罗克曼则说,未来回头看,现在这段时期会被视为AGI真正出现的时刻。

种子形状的阿斯特拉沿虚线箭头朝着虚线圆圈标出的"AGI定义"边界延伸,标签写着"80%"。与此同时,从阿斯特拉出发的另一条虚线箭头指向一个断开的圆形"安全管控",标注为"风险信号",显示出能力在增长,而定义与安全保障都尚未补齐。

这些说法出自《时代》杂志记者亚历克斯·希思历时两周多、采访20多位OpenAI高管、员工、投资人及竞争对手相关人士后完成的深度报道。

阿斯特拉能顶替研究者一周的工作量

这份信心的核心在于阿斯特拉——OpenAI去年预告的那一系列自动化AI研究实习生模型。近期本刊在《OpenAI新模型阿斯特拉,警告存在致命网络能力》(/2026/8/openai-astra-critical-cyber-capabilities)一文中报道过,该模型在内部安全评估中已逼近"致命"级网络能力的临界值。而这一次,同一种能力露出了另一面。

首席科学家雅各布·帕乔基告诉《时代》,阿斯特拉已经通过了公司内部的评测标准。只要给出一个实验想法,它就能按照OpenAI的代码库规范自行编写代码、运行实验并汇报结果;给它一篇研究论文,它能完成人类研究者需要一周才能完成的工作。此外,阿斯特拉还具备长时间独立处理任务的"持续型智能体"能力。

据《时代》报道,奥特曼在一次面向客户的演示中说,这将是"模型首次真正意义上发明出全新事物"的案例。这正是他所说的"像AGI"的那个临界点。

"80%"这个数字背后,定义仍然存在分歧

这类表态的背后,其实是一场赌注:AI自我改进的"递归式自我提升"或许已经开始。部分研究者认为这种能力还遥不可及,另一些人则说已经看到了早期迹象。语言模型本身能否独立做出新发现并加以泛化,这一点也仍有争议——而这通常被视为AGI的基本条件之一。

问题在于,"AGI"这个词本身并没有一个精确的定义。OpenAI在其公司章程中将AGI定义为"在大多数具有经济价值的劳动中全面超越人类的高度自主系统",这完全是从经济产出的角度出发的解读。但也有反对意见认为,真正的AGI需要对世界有扎实的理解,大语言模型只是拼图的一块。归根结底,奥特曼所谓"年底实现AGI"的说法,只有在接受他自己那套定义的前提下才能成立。

硬件、智能体、广告——盈利难题也要一并解决

除了这些雄心勃勃的目标,OpenAI还得面对一个更现实的问题:钱从哪来。公司给出的答案是把产品线收拢集中。核心是名为"The Merge"的内部项目,目的是把编程智能体Codex和ChatGPT合而为一,其成果就是ChatGPT Work——不再只是回答问题,而是直接把事情办完。负责这一项目的蒂博·索蒂奥告诉《时代》,团队"已经接近"推出一款具备"持续性和常驻运行能力"的产品。

据奥特曼透露,OpenAI还在筹备桌面型、口袋型、穿戴型三类硬件设备。第一款产品是一个类似冰球造型的设备,能够感知周围环境并进行语音对话,《时代》报道称预计明年初上市。奥特曼还补充说,公司"肯定"也会做人形机器人。

盈利方面的实验也在同步推进。ChatGPT内的广告因早期测试效果不错正在扩大投放量;据首席财务官萨拉·弗莱尔透露,ChatGPT消费者用户中有92%并不付费订阅。公司还在测试一种"赞助型智能体"模式,点击广告后用户会被带入由品牌方运营的AI体验之中。

编辑视角

奥特曼"年底实现AGI"这番话,不必照单全收。别忘了,就在几个月前,同一家公司还就同一个模型阿斯特拉内部发出过预警,称其已逼近"致命"级网络能力的临界值——眼下这份信心,一半是营销话术,一半是真实的担忧。研究实习生级别的自动化,与网络安全风险级别的自主性,其实是同一种能力的两张面孔。这也意味着,能力提升的速度,已经跑在了安全管控跟进速度的前面。

回想过去几年在实际工作中使用GPT系列的经历,每次新模型发布,公司都会说"这次不一样",但真正能感受到的变化,往往还是局限在编程、摘要、搜索这些狭窄领域。这一次OpenAI强调的,是要把这种能力扩展到研究自动化上。如果真如帕乔基所说,一篇论文能替代一周的人力劳动,那这就不只是聊天机器人的又一次升级,而是要改变整个研发组织的运作方式。

对国内企业来说,有两点值得关注。第一,如果像ChatGPT Work这样的常驻型智能体真的落地,现在这种一个团队多人共用一个聊天机器人订阅的方式,很可能很快就会转向按任务计费。第二,广告和赞助型智能体的实验,其实是一个信号:在无付费用户占绝大多数(92%)的情况下,ChatGPT的盈利结构正在向内容平台靠拢。做品牌营销的团队,从现在起就应该密切关注这一趋势。

接下来几周需要重点确认的是:阿斯特拉的正式发布时间,以及安全评估结果是否有所放宽。如果能力发布与安全重新评估同期公布,奥特曼的信心就有了依据;如果只有能力发布先行,那这次"80%"的说法,恐怕只会停留在融资话术的层面。

评论