每天早上一封邮件,把昨天的 AI 梳理好订阅邮件

METAL LAB

Tencent/AI-Infra-Guard

4,744今日 +28Python

腾讯开源一套安全扫描工具,一次性检测AI服务、智能体和MCP服务器

AI-Infra-Guard(A.I.G)是腾讯朱雀实验室推出的AI红队平台,能扫描AI基础设施的已知漏洞,评估智能体(Agent)和MCP服务器的风险,检测Agent Skill安全问题,并测试大模型抵御越狱攻击的能力。它既可以用Docker一键部署成网页应用,也可以拆分成独立的命令行工具接入企业CI/CD流水线。项目基于Apache 2.0协议开源。

它做什么

  1. 只要填入正在运行的AI服务地址(如vLLM、Ollama、ComfyUI、n8n等),工具就会自动识别组件指纹,比对100多个框架、2000多个已知CVE漏洞
  2. MCP服务器和Agent Skill只需提供源码或远程URL即可扫描,覆盖14大类安全风险;在官方基准SkillTrustBench的9类风险(T01-T09)测试中,表现最好的模型F1得分达0.9848
  3. 越狱评估功能采用多种攻击手法测试大模型的安全性,包括Many-Shot、PAIR、GOAT、ActorAttack等需要多轮对话诱导模型的攻击方式
  4. Skill扫描、MCP扫描、Agent扫描都被拆分成独立的可pip安装的命令行工具,方便嵌入企业的CI/CD流水线
  5. 官方明确说明该工具没有身份认证机制,定位为企业或个人内部使用,不应部署在公网上

为什么重要

自己运营AI服务或搭建智能体、MCP工作流的团队,可以借此在上线前免费自查已知漏洞和权限滥用风险。已有19篇学术论文引用该项目并在Black Hat Europe上作过展示,说明它已成为AI安全研究社区参考的工具之一。

本仓库术语

  • MCP(Model Context Protocol) · 让AI模型连接外部工具和数据的标准连接协议
  • CVE · 公开登记的软件漏洞编号
  • 越狱(Jailbreak) · 绕过AI模型安全防护,诱使其输出被禁止内容的攻击手法
  • 红队(Red Team) · 站在攻击者角度提前发现系统弱点的模拟攻击活动
  • F1得分 · 综合精确率与召回率的检测性能指标,越接近1越好

仓库简介(英文)

A full-stack AI Red Teaming platform securing AI ecosystems via Agent Scan, Skills Scan, MCP scan, AI Infra scan and LLM jailbreak evaluation.

所属 · tencent-hunyuan

在 GitHub 打开

热门仓库

全部仓库 →

METAL LAB 最新报道