每天早上一封邮件,把昨天的 AI 梳理好订阅邮件

METAL LAB

白宫考虑将开放模型纳入AI监管范围

拟对达到前沿水平的开放模型强制实施发布前测试,并考虑让主要AI实验室成为"官方合作伙伴"

이미지: METAL LAB 생성

摘要

  • 据悉,白宫正在考虑扩大AI监管框架,将已达到前沿水平的开放模型也纳入发布前测试的适用范围
  • 基准线设定为Anthropic的Mythos级模型和OpenAI GPT-5.6级别的能力,这是一位白宫官员透露的
  • 让主要AI实验室以官方合作伙伴身份参与该监管项目的新合作方式也在讨论之中
발표 시점
2026년 8월 12일(현지 시각), 백악관 관계자 발언 인용 보도
핵심 방침
프론티어급 오픈모델을 AI 감독 프레임워크에 포함, 사전 출시(pre-release) 테스트 적용
기준 모델
앤스로픽 Mythos급 모델, 오픈AI GPT-5.6과 동등한 역량 도달 시 적용
추가 검토안
주요 AI 랩이 감독 프로그램의 공식 파트너로 참여하는 새 협력 구조
우려 배경
모델이 자율적으로 국방부(Pentagon)나 글로벌 금융시장을 해킹할 가능성
관련 사례
오픈AI 차기 모델 아스트라가 내부 평가에서 '치명적' 사이버 역량 임계치 배제 불가 판정(2026년 8월 8일)

开放模型也不例外

美国白宫正在调整AI模型监管体系。据悉,此前主要针对闭源前沿模型构建的监管框架,正在考虑扩展至已达到前沿水平的开放模型。这一消息由运营News Amp账号的Andrew Curran于8月12日发布,原始信息来源为一位白宫官员。

核心在于"基准线"。据这位白宫官员透露,一旦开放模型的能力达到Anthropic的Mythos级模型或OpenAI GPT-5.6的水平,该模型将自动被纳入监管对象,发布前必须接受单独的预先测试。此前,由主要研究机构直接部署和控制的闭源模型是主要的监管对象,而这意味着,任何人都可以下载权重使用的开放模型也将适用同样的标准。

이미지: X — 뉴스 앰프

为何此时以网络能力为基准

这一举措背后,是近几个月来AI网络能力急剧增强所引发的担忧。这位白宫官员表示,担心模型可能自主入侵国防部系统或全球金融市场,是促成此次行动的原因。

这种担忧并非毫无根据。据METAL LAB 8月8日的报道,OpenAI下一代模型Astra在内部评估中被判定无法排除达到"准备框架"(Preparedness Framework)中"关键"网络能力阈值的可能性。相比之下,包括前代模型GPT-5.6-Sol在内的既有模型在同一评估中仅停留在低一级的"高"水平,可见能力提升速度明显加快。此后,OpenAI立即采取了构建隔离测试环境、加强模型权重加密等安全管控措施。

两天后的8月10日,OpenAI扩大了其网络安全项目"Daybreak"(黎明计划),并推出了专用于授权漏洞研究的特殊模型GPT-5.6-Cyber。据悉,该模型已在Chrome V8引擎等广泛使用的开源软件中实际发现了此前未知的漏洞。随着模型在防御和攻击两方面的网络能力接连显示出接近实战水平的信号,监管机构正考虑将监管范围扩大至开放模型。

"官方合作伙伴"方案意味着什么

除扩大监管对象之外,白宫还在考虑一种新的合作结构,即让主要AI实验室作为该项目的官方合作伙伴参与其中。此前,政府对模型的评估是在实验室外部进行的监管与验证程序;而如果这一方案得以实现,OpenAI、Anthropic等实验室有可能进入监管体系内部,共同参与制定评估标准。不过,具体的参与形式以及涉及的实验室名单目前尚未公开。

监管框架扩展趋势

项目现行做法正在讨论的扩展方案
适用对象闭源前沿模型纳入前沿级开放模型
测试时点以事后评估为主强制实施发布前预先测试
实验室角色监管对象考虑参与官方合作伙伴

由此将带来哪些变化

开放模型因任何人都可下载、修改并再分发,长期以来被认为比闭源模型更难以管控。若此次方针得以确定,今后推出开放模型的开发商,一旦其模型能力接近GPT-5.6或Mythos级水平,也可能需要事先接受政府验证。这既会给开源AI生态的速度和自由度带来限制,也可以视为在模型发布前多设一道安全阀,以筛除潜在风险的尝试。不过,具体实施时间、模型判定标准以及参与实验室的范围目前似乎仍未确定。