
图片:METAL
摘要
- 有报道称,Anthropic、OpenAI和谷歌自7月起一直在讨论成立行业主导的AI标准机构。
- 戴密斯·哈萨比斯于7月14日公开提出仿照证券业自律监管机构模式的前沿AI标准机构构想。
- 萨蒂亚·纳德拉于9月13日表示欢迎放慢节奏之举,并将把MAI模型行为准则交付公开征求意见。
AI公司们一直在私下讨论如何自己搭建一个用来评判自己的机构。据援引多位消息人士的报道,Anthropic、OpenAI和谷歌今年7月以来持续举行工作组会议,探讨成立行业主导的AI标准机构。讨论中的框架是,由这些公司自己制定用来评估自家模型的安全标准。这几个月里,监管争论在外部闹得最凶,恰好也是这些会议在内部悄悄举行的几个月。
会议是闭门进行的,但同月公开了一份设计方案。谷歌DeepMind首席执行官戴密斯·哈萨比斯于7月14日亲自公布了前沿AI标准机构的构想。他参照的模板是美国证券业的自律监管机构:由行业出资,却在联邦监管下独立运作,以自律组织而非政府机构的形式存在。
METAL查阅的这份提案文件的核心是发布前的预先审查。方案分三个阶段:公司在推出模型前30天先提交给该机构审查,起初自愿参与,一旦证明有效就固化为进入美国市场的必备条件。到最后阶段,该机构会自行设计一套不对外公开的测试题目,以防公司针对已知的基准进行模型调优。
提案中还写明了要测试的科目。网络安全漏洞、生物威胁可能性,以及智能体的自主行为被列为与国家安全相关的评估领域。哈萨比斯还提出,要测试模型是否试图绕过安全防护、是否表现出欺骗倾向,并要求为AI生成内容加水印、输出可解释的推理过程。哪些模型能通过这道门槛,由该机构掌握的能力门槛标准决定,而不是由公司名号决定。
关于该机构的权限范围,哈萨比斯本人划出了界限。他写道,该标准机构将"负责制定评估规程,并与合适的联邦机构及美国国家实验室合作,在与国家安全相关的领域开展测试"。这意味着它是一个制定技术标准的组织,而非监管机构,最终裁决权仍留在政府手中。他还附加了条件:董事会中须有独立技术专家和开源阵营代表。
对于为何是现在这个问题,他也预先给出了答案。哈萨比斯的诊断是:"我们目前正陷入一场极其激烈、层层交织的商业与地缘政治竞赛之中。"这是被困在竞赛里的选手们聚在一起要造一个裁判的场景,而裁判的薪水却由选手来出。哈萨比斯也没有回避这一点,他写道,要吸引技术人才、支撑大规模测试,资金必须相当可观。
周末期间,这一构想从闭门会议室里迈出了一步。微软首席执行官萨蒂亚·纳德拉9月13日表示,欢迎为把对齐做扎实而审慎放慢节奏,并称将在次日公布适用于微软自家MAI模型的行为准则,征求公众意见。他写道:"任何迈向超级智能的尝试,都必须扎根于这样一个核心原则——如果我们打造的AI不能帮助人类、不处于人类控制之下,那就不值得去追求。"他还写道,治理不应被少数主体掌控,而应在生态系统、各国政府和学术界之间拥有广泛的代表性。
这三家公司的讨论在监管争论中处于什么位置,只有把它和本周其他事件放在一起看才看得清楚。METAL此前报道,Anthropic首席执行官达里奥·阿莫迪发表文章,呼吁放慢前沿开发的速度,并让外部评估者进驻公司内部。纳德拉所欢迎的那种审慎放缓,正是这一提议。公开声明与闭门工作会议指向的是同一个方向。
自愿机制究竟能撑多久,已经受过一次检验。METAL此前报道,Anthropic并未将9月1日发布的Claude Mythos 5.1提交给英国AI安全研究所做发布前评估。只要把模型交给评估机构仍是自愿的,不交的选项就始终并存。这正是哈萨比斯把三阶段设计的最后一步设为强制的原因。
共同放慢速度这件事本身在法律上是否安全,也仍是悬而未决的问题。METAL此前报道,OpenAI已要求国会就与竞争对手联合放慢开发速度是否构成合谋作出裁定。一个共同制定安全标准的机构,正好站在这个问题的正中央,因为竞争对手一旦就同一标准达成一致,这个标准就会成为其他想进入市场的公司的门槛。
专家们指出的风险正是这一点。Cascade Insights联合创始人肖恩·坎贝尔警告说,这样的机构可能滑向监管俘获;Suzu Labs首席执行官迈克尔·贝尔则质疑,再造一个新的官僚机构是否真的是最佳方案。信息技术与创新基金会的米歇尔·洛佩兹·马尔多纳多建议,与其新建机构,不如充实现有标准机构的能力。选手自己搭建裁判台时引发的疑虑,从来都是同一种。
眼下明确的是顺序。国会表示不会出面,白宫表示没有理由放慢速度,而这个空白从7月起一直由各公司自己填补。哈萨比斯的设计方案已经公开,纳德拉的行为准则已交付征求意见,三家公司的工作组会议尚未拿出结果。AI行业的规则眼下是在会议室里写就的,而不是在国会里。





评论