每天早上一封邮件,把昨天的 AI 梳理好订阅邮件

METAL LAB

OpenAI, 灾难性风险专职团队解散并分散职能

Preparedness团队消失,生物与网络风险评估划归现有部门,内部出现安全担忧声音

이미지: METAL LAB 생성

摘要

  • OpenAI于7月底解散了负责评估自家模型灾难性风险的"Preparedness"团队,将相关工作分散到现有团队中
  • 前团队负责人Dylan Scandinaro现转而专注于自我改进型AI可能带来的风险,包括首席伦理官在内的多名安全负责人近期相继离职
  • 公司内部出现公开质疑声,担心在与Hugging Face相关的自主黑客事件之后,公司的安全应对是否足够
해체 시점
2026년 7월 말
해체된 팀
Preparedness — 모델의 심각·파국적 위험 평가 담당
이관 업무
생물·사이버 위험 평가를 기존 팀으로 분산
전 팀장
딜런 스칸디나로 — 현재 재귀적 자기개선 AI 위험 담당
최근 퇴사자
최고윤리책임자 클로이 바칼라르, 조슈아 아치암
공동창업자 발언
그렉 브록먼, 안전 작업을 모델 개발에 더 긴밀히 통합했다고 언급
보도
파이낸셜타임스 취재를 The Decoder가 인용 보도

风险专职团队消失了

OpenAI在7月底撤销了专门负责检查自家模型风险水平的"Preparedness"团队。The Decoder援引《金融时报》引用内部消息人士的报道称,该团队原本负责评估公司所开发模型是否可能造成严重甚至灾难性后果,其中生物学与网络风险相关工作在团队解散后被拆分至现有部门。

带领该团队的Dylan Scandinaro如今转向专注于"递归式自我改进"——即能够自我优化并训练其他模型的AI系统——可能带来的风险。联合创始人Greg Brockman表示,公司已将安全相关工作更紧密地融入模型开发流程本身。但据了解,公司内部对这一说法是否足以替代专职组织的解散仍存在分歧。

安全人员相继离职

在此次改组前后,安全相关人员的离职也在持续。包括首席伦理官Chloe Bakalar和Joshua Achiam在内的多名安全负责人近期离开了公司。据《金融时报》报道,内部对OpenAI是否充分应对安全问题的不安情绪正在加剧。一位消息人士称,公司内部弥漫着一种"责任感与恐惧交织沸腾"的氛围。

员工的担忧并未止步于私下交流,也公开爆发了出来。尤其是在与Hugging Face相关的自主黑客事件之后,这类声音更为突出,据悉一名员工表示希望公司能将此事视为一次"警告射击"。在监督灾难性风险的专职组织已被撤销的时点上,此类事件的叠加似乎让内部反应更加敏感。

安全与速度之间,OpenAI的近期动向

OpenAI近期在网络安全领域也有独立动作。去年8月10日,公司扩展了网络安全计划Daybreak,推出了专用于安全工作的模型GPT-5.6-Cyber,并表示该模型已在Chrome V8引擎等广泛使用的开源软件中发现此前未知的漏洞。一方面持续投入将防御性安全能力嵌入模型本身,另一方面却解散了全面监督风险的专职组织,这两个动向显得有些矛盾。

这种张力并非OpenAI独有的困扰。在拉斯维加斯举行的Ai4大会上,Geoffrey Hinton、李飞飞与Andrew Ng三人也就AI开放性与风险管理问题发生了碰撞。Hinton再次指出,开放权重模型可能被以低成本重新训练而遭到滥用的风险;Andrew Ng则警惕少数企业成为把关者的局面。是由专职组织监督安全,还是将其融入开发流程本身,抑或交由公开与验证来把关,整个行业目前仍未给出答案。

编辑视角

撤销专职组织并将其工作分散给现有团队,听起来像是一种效率优化,但在风险评估领域,这意味着别的东西。由一个团队统观全局判断"这个模型整体是否危险",与多个团队各自只看自己负责的那一部分,是完全不同的两件事。生物风险交给A团队、网络风险交给B团队分管,各自看起来都安全,但合并后产生的风险却可能无人负责。在OpenAI推出GPT-5.6-Cyber这类攻防两用模型的同时缩减综合监督功能,这一决定因此格外引人注目。

类似的组织调整在其他公司也曾出现过。当安全团队独立存在时,总会伴随"拖慢产品发布"的抱怨,这种不满积累到一定程度,安全团队最终常常以"融入开发流程"为名被吸收进去。问题在于,融合之后,谁最终拥有叫停安全隐患的权限就变得模糊了。当开发者本人来评估自己模型的风险时,在发布压力面前判断容易松动——这是行业中反复出现的模式。

对于国内正在业务中使用OpenAI API或GPT系列模型的企业而言,这一消息与其说是威胁,不如说是一个信号。模型提供方内部安全监督体系的变化,意味着企业方需要在输出验证、权限限制等方面自行加设一层安全保障的必要性正在增加。尤其是已经引入让智能体直接访问系统的团队,更不宜仅依赖模型提供方的风险评估,而应另行建立内部验证流程。

未来几周内,OpenAI很可能会就此决定给出进一步说明,或者反过来出现更多类似的人员离职消息。安全组织缩减与安全专用模型发布同时发生在同一家公司身上,这种错位或将促使竞争对手重新审视自身的安全体系设计。