METAL for iPhone

AI 新闻, 现在用 App 阅读。

下载 METAL, 每天发现最新 AI 报道。

在 App Store 下载

iPhone 应用 · 免费下载

也可在 iPhone 的 App Store 中搜索 METAL AI Magazine。

METAL

Anthropic 推出网络安全使命与 OSS Scanner

Anthropic 启动了将关键基础设施与开源软件防御结合在一起的 Anthropic Cyber Mission,并发布 OSS Scanner,用其最强模型免费扫描开源项目。报告不经人工审核直接发出,在上线前验证中,97 个严重和高危发现中有 85 个达到披露标准。

Anthropic 推出网络安全使命与 OSS Scanner

图片:METAL

摘要

  • Anthropic 于 10 月 8 日启动 Anthropic Cyber Mission,将关键基础设施防御计划(CIDP)与面向开源项目的免费扫描服务 OSS Scanner 结合在一起。
  • Anthropic 在六个月内发现了 2.9 万多个候选漏洞,但人工审核的只有约 6000 个,因此将把模型生成的报告不经人工审核直接发送给选择加入的维护者。
  • 验证中,97 个严重和高危发现里有 85 个(88%)达到披露标准,误报仅 1 个;wolfSSL 表示收到的 74 份报告中有 72 份有效,其中 5 个成为 CVE。

Anthropic 于当地时间 10 月 8 日启动了 Anthropic Cyber Mission,这是一项将关键基础设施与开源软件防御结合起来的长期计划。首批两个方向分别是关键基础设施防御计划(CIDP)和 OSS Scanner。前者为保护电网、供水系统和交通网络背后运营技术(OT)的安全公司配备前沿模型和驻场工程师;后者用公司最强的模型为开源项目提供免费的定期扫描。OSS Scanner 的报告按模型写出的原样发给维护者,不经人工审核。Anthropic 表示,预计真阳性率将超过 90%。

起点是一堆尚未处理的漏洞。据 Anthropic 前沿红队介绍,公司在过去六个月里用最新模型扫描全球重要软件,发现了 2.9 万多个候选漏洞,但人工审核和分类的只有约 6000 个。红队写道:"我们在人工验证这些发现的能力上仍然存在瓶颈。"收到首批报告的维护者越来越多地要求连同补丁建议一起获取所有未经验证的报告,迄今已发送的此类报告接近 5000 份。OSS Scanner 把这种请求变成了一项常设服务。

这一判断的依据是模型能力。据红队介绍,在学术漏洞发现基准 CyberGym 上,语言模型发现漏洞的比例从去年年初的不到 20% 跃升至今年的 85% 以上。红队表示,开源维护者收到的 AI 报告也因此从大多是垃圾内容变成了高质量的漏洞报告。报告由包括 Claude Mythos 在内的最强模型生成。这项服务受到谷歌开源模糊测试服务 OSS-Fuzz 的启发,与公司面向企业的付费产品 Claude Security 不同,全部费用由 Anthropic 承担。

准确度事先做了测量。负责审核 Anthropic 协调漏洞披露(CVD)结果的专业渗透测试人员核查了早期版本在 48 个项目中发现的 97 个严重和高危漏洞,其中 85 个(88%)达到 CVD 披露标准。其余 12 个中,11 个是真实漏洞,但与已知问题或同一次扫描的其他发现重复,误报仅 1 个。过去几周与数十个项目进行的试运行发出了数百份漏洞报告,其中多个漏洞可以串联成无需认证的远程代码执行攻击。

试用参与者给出了具体评价。嵌入式加密库 wolfSSL 的 Todd Ouska 表示:"我们收到的 74 份报告中,除两份外全部有效,其中 5 个成为 CVE。"他还说:"我们希望收到更多。"OpenSSL Corporation 的 Anton Arapov 说:"大约 18 个月前的早期 AI 报告糟糕透顶。"而"我们从 Anthropic 收到的报告,包括模型原始输出在内,和人写的一样好,有时甚至更好"。PostgreSQL 的 Noah Misch 表示,部分报告附带的修复几乎可以直接使用,而快速通道让项目在正式发布前就处理了最新问题。

每份报告包含可独立运行的复现代码、漏洞说明、在可能的情况下追溯漏洞何时进入代码历史的二分查找结果,以及候选补丁。据 Metal 查阅的 OSS Scanner 说明文档,扫描智能体只在完全断开互联网的加固沙箱中运行。维护者只需向 GitHub 仓库 anthropics/oss-scanner 提交添加 project.yaml 配置文件的拉取请求即可申请,必填项包括仓库地址、主要联系人,以及能离线构建项目的 Dockerfile。资格标准与 OSS-Fuzz 相同,即"对基础设施和用户安全具有关键影响",并逐案审核。

披露规则与以往不同。根据说明文档,未经验证的报告不设 90 天披露期之类的期限。理由是,Anthropic 自己都没有仔细阅读的结果,不便再附加期限强加给维护者。如果之后经过人工验证,可在通知维护者之日起 90 天后按 CVD 政策披露。维护者在配置文件中加入 disabled: true 这一行即可暂停接收。试运行期间,一些维护者指出严重程度被夸大,或扫描器误解了项目的威胁模型,Anthropic 表示将根据维护者反馈改进系统。

关键基础设施方面的创始合作伙伴有 11 家:埃森哲、博思艾伦、CrowdStrike、德勤、Dragos、日立、Insane Cyber、Nozomi Networks、Palo Alto Networks、普华永道和罗克韦尔自动化。名单涵盖咨询公司、安全厂商和设备制造商。据报道,博思艾伦商业网络部门总裁 Andrew Turner 称运营技术是"自主 AI 攻击的下一个前沿"。同一报道指出,此次发布没有说明合作伙伴是否免费使用模型、算力费用由谁承担等商业条款。

Metal 曾报道 Anthropic 用 Mythos 5 运行 Claude Security 扫描,也报道过 Anthropic 对 GLM-5.3 网络能力的分析。Anthropic 表示,本周早些时候已将 Project Glasswing 并入扩大后的网络验证计划(Cyber Verification Program)。据报道,Glasswing 自 4 月起向经过审核的机构开放 Mythos。6 月启动的面向州和地方政府的网络防御计划,目前为美国一半以上的州提供模型和技术支持。维持 OSS Scanner 免费的资金来自 8 月设立的防御者优势基金(0xDAF)。Anthropic 还资助了 Python 软件基金会、Apache 软件基金会,以及 Linux 基金会旗下的 Alpha-Omega 和 OpenSSF。

据 Metal 核实,Anthropic 官方 X 账号的启动帖文在不到一天内获得约 13.8 万次浏览和 1500 多个点赞。从律师的角度看,这一设计的核心在于转移了责任所在。以取消人工审核为代价,它不设披露期限,并让维护者通过一个拉取请求自行决定加入和退出。这实际上意味着只接收能够承担误报成本的项目。Anthropic 预测两年内 AI 将有利于防御一方,但也表示,眼下利用漏洞的成本已经下降,而验证和修复仍依赖人力,进展缓慢。在运营技术领域,补丁必须等到能安全应用于运行中的设备时才能部署,个别情况下可能需要等上几十年。

评论