Astra
OpenAI正在开发、尚未发布的模型,其网络安全能力可能达到"关键"风险等级,促使公司加强安全审查。
简单来说
Astra是OpenAI正在开发、但尚未对外发布的AI模型。目前它处于内部测试阶段,团队正在同时评估它的能力和风险,为正式发布做准备。
这有点像新药在正式上市前的临床试验中表现出比预期更强的效果,于是需要重新做副作用检查。据评估,Astra在自主编写和执行代码、以及发现安全系统漏洞的能力上,比之前的模型有了显著提升。但正因为这种能力太强,人们担心如果被恶意利用,可能会对真实的计算机系统造成严重损害。
因此,在风险等级尚未最终确定的情况下,OpenAI已提前加强了安全防护措施。也就是说,Astra并不是一个"已被认定为危险"的模型,而是一个"因为可能危险而被更加谨慎对待"的模型。
在报道中是这样出现的
报道中提到"Astra的网络能力不能排除达到'关键'临界值"。这里容易被误解的一点是,这一说法并不意味着Astra已经发生了实际事故或泄露事件。OpenAI已明确表示,Astra仍是一个尚未发布、仍在进行基准测试和评估的模型,并且与同期曝出的Hugging Face安全事件无关。
