Tencent/AI-Infra-Guard
腾讯开源一套安全扫描工具,一次性检测AI服务、智能体和MCP服务器
AI-Infra-Guard(A.I.G)是腾讯朱雀实验室推出的AI红队平台,能扫描AI基础设施的已知漏洞,评估智能体(Agent)和MCP服务器的风险,检测Agent Skill安全问题,并测试大模型抵御越狱攻击的能力。它既可以用Docker一键部署成网页应用,也可以拆分成独立的命令行工具接入企业CI/CD流水线。项目基于Apache 2.0协议开源。
它做什么
- 只要填入正在运行的AI服务地址(如vLLM、Ollama、ComfyUI、n8n等),工具就会自动识别组件指纹,比对100多个框架、2000多个已知CVE漏洞
- MCP服务器和Agent Skill只需提供源码或远程URL即可扫描,覆盖14大类安全风险;在官方基准SkillTrustBench的9类风险(T01-T09)测试中,表现最好的模型F1得分达0.9848
- 越狱评估功能采用多种攻击手法测试大模型的安全性,包括Many-Shot、PAIR、GOAT、ActorAttack等需要多轮对话诱导模型的攻击方式
- Skill扫描、MCP扫描、Agent扫描都被拆分成独立的可pip安装的命令行工具,方便嵌入企业的CI/CD流水线
- 官方明确说明该工具没有身份认证机制,定位为企业或个人内部使用,不应部署在公网上
为什么重要
自己运营AI服务或搭建智能体、MCP工作流的团队,可以借此在上线前免费自查已知漏洞和权限滥用风险。已有19篇学术论文引用该项目并在Black Hat Europe上作过展示,说明它已成为AI安全研究社区参考的工具之一。
本仓库术语
- MCP(Model Context Protocol) · 让AI模型连接外部工具和数据的标准连接协议
- CVE · 公开登记的软件漏洞编号
- 越狱(Jailbreak) · 绕过AI模型安全防护,诱使其输出被禁止内容的攻击手法
- 红队(Red Team) · 站在攻击者角度提前发现系统弱点的模拟攻击活动
- F1得分 · 综合精确率与召回率的检测性能指标,越接近1越好
仓库简介(英文)
A full-stack AI Red Teaming platform securing AI ecosystems via Agent Scan, Skills Scan, MCP scan, AI Infra scan and LLM jailbreak evaluation.
在 GitHub 打开热门仓库
- vorssaint/vorssaint-utils一个免费菜单栏应用,顶替十几款付费Mac工具
- Alishahryar1/free-claude-code一个本地代理,把编程AI助手接到49家免费或低价模型服务商,不再只能用一家付费服务
- freestylefly/awesome-gpt-image-2把532个GPT-Image2案例拆解成可复用模板的提示词工程库
- block/buzz一个让人类和AI智能体在同一空间里聊天、写代码、做审查的开源协作平台
- NousResearch/hermes-agentNous Research推出的Hermes是一款越用越聪明的AI智能体
- virgiliojr94/book-to-skill把技术类书籍PDF变成AI编程助手随时可查阅的技能包
- VoltAgent/awesome-agent-skills把上千份让AI编程助手秒变专家的操作手册集中放在一个地方
- anthropics/claude-plugins-community一个把大家做的Claude插件集中起来供安装的仓库