Tencent/AI-Infra-Guard
腾讯开源一套安全扫描工具,一次性检测AI服务、智能体和MCP服务器
AI-Infra-Guard(A.I.G)是腾讯朱雀实验室推出的AI红队平台,能扫描AI基础设施的已知漏洞,评估智能体(Agent)和MCP服务器的风险,检测Agent Skill安全问题,并测试大模型抵御越狱攻击的能力。它既可以用Docker一键部署成网页应用,也可以拆分成独立的命令行工具接入企业CI/CD流水线。项目基于Apache 2.0协议开源。
它做什么
- 只要填入正在运行的AI服务地址(如vLLM、Ollama、ComfyUI、n8n等),工具就会自动识别组件指纹,比对100多个框架、2000多个已知CVE漏洞
- MCP服务器和Agent Skill只需提供源码或远程URL即可扫描,覆盖14大类安全风险;在官方基准SkillTrustBench的9类风险(T01-T09)测试中,表现最好的模型F1得分达0.9848
- 越狱评估功能采用多种攻击手法测试大模型的安全性,包括Many-Shot、PAIR、GOAT、ActorAttack等需要多轮对话诱导模型的攻击方式
- Skill扫描、MCP扫描、Agent扫描都被拆分成独立的可pip安装的命令行工具,方便嵌入企业的CI/CD流水线
- 官方明确说明该工具没有身份认证机制,定位为企业或个人内部使用,不应部署在公网上
为什么重要
自己运营AI服务或搭建智能体、MCP工作流的团队,可以借此在上线前免费自查已知漏洞和权限滥用风险。已有19篇学术论文引用该项目并在Black Hat Europe上作过展示,说明它已成为AI安全研究社区参考的工具之一。
本仓库术语
- MCP(Model Context Protocol) · 让AI模型连接外部工具和数据的标准连接协议
- CVE · 公开登记的软件漏洞编号
- 越狱(Jailbreak) · 绕过AI模型安全防护,诱使其输出被禁止内容的攻击手法
- 红队(Red Team) · 站在攻击者角度提前发现系统弱点的模拟攻击活动
- F1得分 · 综合精确率与召回率的检测性能指标,越接近1越好
仓库简介(英文)
A full-stack AI Red Teaming platform securing AI ecosystems via Agent Scan, Skills Scan, MCP scan, AI Infra scan and LLM jailbreak evaluation.
在 GitHub 打开热门仓库
- cathrynlavery/diagram-design让AI编程工具画出杂志排版质感图表,而不是千篇一律的圆角方框
- public-apis/public-apis一份由社区维护的免费API大全仓库
- semantica-agi/semantica一个让AI智能体的决策可追溯、可审计的开源图谱基础设施
- cactus-compute/needle一个14MB的AI模型,让手机和可穿戴设备无需联网就能调用工具
- unslothai/unsloth一款让你在自己电脑上运行和训练AI模型的桌面应用,无需写代码
- macro-inc/macro把邮件、聊天、文档、任务和CRM互相链接、共享同一份AI团队记忆的一体化办公平台
- harry0703/MoneyPrinterTurbo只需一个主题或关键词,就能自动生成配好文案、素材、字幕和音乐的完整短视频的开源工具
- basecamp/omarchyDHH打造的、开箱即用且风格统一的Linux发行版