
图片:METAL
摘要
- OpenAI 于 9 月 21 日提议由美国主导制定涵盖递归自我改进的前沿 AI 国际技术标准。
- 以十国 AI 安全研究所网络和美国 AI 标准与创新中心为轴心,但公司明确表示这些标准不是许可证或审批要求。
- 公告中链接的 9 页联邦框架蓝图同时要求优先适用联邦法以取代州法,并强化 AI 标准与创新中心。
OpenAI 于 9 月 21 日发布文章,提出美国应率先制定前沿 AI 安全与保安的国际技术标准。公司在公告中写道:"我们认为美国应当带头,与世界各国一起制定包括递归自我改进在内的前沿 AI 国际技术标准。"该提案有两根支柱:连接各国标准与国际标准的机制,以及共同的测量与事件报告规约。
提出标准的原因是递归自我改进。公司解释说,当 AI 越来越多地承担开发下一代 AI 的工作时,即便人仍然参与其中,这一过程也可能自我推进;自动化越深,进展速度就可能加速得越快。公司写道,完全自主的递归自我改进"今天并未发生,在能够安全实现之前不应加以追求"。同一段还附有警告:若缺乏适当的谨慎而贸然推进,人们可能在无法监督自己已不再理解的研究过程的情况下,失去对 AI 开发的实际控制。
公司写道,自己披露的 Hugging Face 事件虽不是递归自我改进的直接结果,但预示了在缺乏稳健防护与对齐的情况下可能严重得多的风险。公告开头列出了首席执行官 Sam Altman 与 Jakub Pachocki 近期整理的三个目标:构建自动化 AI 研究者、与之共同迭代对齐问题,并找到让人留在自我改进循环之内的方法;交付极强机器带来的科学进步与经济增长红利;以及用个人 AGI 让每个人各自变强。公司表示,AI 正在加速自家研究,并在包括纳维-斯托克斯千禧年难题在内的数学领域带来进展。
公司列出了需要国际标准的三个问题。其一是碎片化:各国的评估、报告要求和事件定义相互抵触时,既难以比对证据,也难以应对跨境风险。其二是集体行动问题:各国各自行动会产生没有任何国家想要的结果。其三是能力不均:前沿开发与相关专业能力在全球分布并不均匀。公告称,这些问题对开放模型和封闭模型同样适用。
第一根支柱是"用已有的东西"。公司写道,可以利用在澳大利亚、加拿大、德国、法国、肯尼亚、日本、韩国、新加坡、印度和英国设立的 AI 安全研究所网络,通过美国 AI 标准与创新中心和各国产业机构来制定标准。重点有两项:以能力基准划定的前沿模型与开发者,以及包括递归自我改进在内的自动化 AI 研究的收益与风险管理。2024 年由 AI 标准与创新中心创建的先进 AI 测量、评估与科学国际网络被指为起点。
标准"不是什么"在公告中同样写死了。这里制定的技术标准不是许可证,不是上市前强制审查,也不是 AI 模型的审批要求。是否以及如何纳入本国法律体系,由各国政府自行决定。公司写道,共同标准不应被设计成有利于特定企业、国家或商业模式,也不应让新进入者或开放权重开发者更难竞争。
公司援引的先例是航空与金融稳定。理由是这些领域的各国在不让渡国家权限的前提下,建立了共同技术标准和可信的合作通道。公告称,这项工作还应与 ISO、Frontier Model Forum、Agentic AI Foundation、Open Secure AI Alliance 等既有与新兴标准机构,以及正在制定把国际标准与真实 AI 评估连接起来的实务规范的 Appia Foundation 等落地组织紧密协作。
第二根支柱是把"怎么量"和"怎么报"对齐。公司列出的项目包括:评估与递归自我改进相关的 AI 进展,以及一家公司内部自主进行的研究量的标准;包括哪些自动化研究过程应立即触发人工复核在内的人类监督标准;以及包含统一严重度等级与报告阈值的事件分类、追踪、报告与响应标准。公司把自家发布的研究加速报告和失准报告框架作为初期贡献提出。METAL 曾报道过 OpenAI 发布模型失准报告框架。
公告还要求了标准之外的机制。世界各国的关键基础设施运营者与政府应建立安全的通信通道,用以共享国家安全关切、新出现的漏洞与威胁以及最佳实践。公司写道,美中在这些领域展开对话将是积极的进展,即将举行的会谈时机恰当。据报道,首席执行官 Sam Altman 定于 9 月 23 日亲自出席联合国安全理事会会议,就 AI 与国际安全作说明。
这项提案所依托的国内设计图另有其文。METAL 查阅的前沿 AI 民主治理文件,是公告中链接的 9 页 PDF,日期为 6 月 2 日。该文件把由各州先打磨共同框架、再由联邦承接上收的做法称为逆向联邦主义,并称加州 SB 53、纽约 RAISE 法和伊利诺伊 SB 315 已在核心要素上形成共识。文件为联邦框架列出的最低要求包括:严重风险评估与缓解、透明度报告、独立第三方审计、重大安全事件报告、模型权重安全、举报人保护,以及具有实效的问责机制。
文件要求把美国 AI 标准与创新中心建设成承担前沿 AI 评估、标准制定、独立评估认证以及政府内外协调的世界一流机构。其负责人应直接向商务部长或同等级别高官汇报,并应具备类似 CHIPS for America 所用的灵活招聘权限和保密计算环境的使用权。最强硬的要求放在最后:联邦框架建立之后,试图规制同类前沿安全风险的州法应被优先适用的联邦法取代,归入统一的国家框架。
以律师的眼光看,这次发布是在朝两个方向同时推。在国际上,制定没有审批权的技术标准,让各国自行写进法律;在国内,则以建立联邦框架为交换,要求取代州法。文件中同时写着"接受评估但部署决定仍由开发者掌握",以及"若评估未在规定期限内完成,开发者可无处罚地部署",也出自同一套设计。正如公司自己所写,标准的理由在于避免权力集中并产出更好的实际结果,而谁先写下这些标准,将决定下一个十年的规则。





评论