컴백부터 K-뷰티까지 — K-컬쳐의 모든 것을 메일로 받아보세요메일로 받아보기

METAL MEDIA

Tencent/AI-Infra-Guard

4,744오늘 +28Python

텐센트가 AI 서비스와 에이전트, MCP 서버를 한꺼번에 뜯어보는 보안 점검 도구를 공개했다

AI-Infra-Guard(A.I.G)는 텐센트 주작연구소(Zhuque Lab)가 만든 AI 레드팀 플랫폼으로, AI 인프라의 알려진 취약점부터 에이전트·MCP 서버·에이전트 스킬의 위험, LLM 탈옥(jailbreak) 취약성까지 한 번에 점검한다. Docker로 웹 UI를 띄우거나 CLI 도구를 개별 설치해 CI/CD에 연동할 수 있다. 오픈소스이며 Apache 2.0 라이선스로 배포된다.

무엇을 하는 레포인가

  1. vLLM, Ollama, ComfyUI, n8n 같은 실행 중인 AI 서비스의 주소를 입력하면 100개 이상의 프레임워크와 2000개 이상의 알려진 CVE 취약점을 지문 인식 방식으로 대조해 알려준다
  2. MCP 서버와 에이전트 스킬(Agent Skills)은 소스코드나 원격 URL만으로 14개 대분류 보안 위험을 점검하며, 자체 벤치마크인 SkillTrustBench 기준 9개 위험 유형(T01~T09)에서 최고 성능 모델은 F1 점수 0.9848을 기록했다
  3. Many-Shot, PAIR, GOAT, ActorAttack 등 여러 차례 대화를 주고받으며 모델을 속이는 멀티턴 탈옥 공격을 포함해 LLM의 안전성을 평가하는 기능도 제공한다
  4. pip 설치형 스킬 스캐너, MCP 스캐너, 에이전트 스캐너를 독립 CLI로 분리해 기업의 CI/CD 파이프라인에 끼워 넣을 수 있게 했다
  5. 도구 자체에 인증 기능이 없어 개발사는 사내 전용으로 쓰고 외부에 공개된 네트워크에는 배포하지 말라고 명시하고 있다

왜 중요한가

AI 서비스를 직접 운영하거나 에이전트·MCP 기반 워크플로를 구축하는 개발팀이라면, 배포 전에 알려진 취약점과 권한 남용 위험을 스스로 점검할 수 있는 무료 도구를 얻게 된다. 학술 인용 19건과 블랙햇 유럽 발표 이력은 이 도구가 실제 보안 연구 커뮤니티에서 참고 기준으로 쓰이고 있음을 보여준다.

이 레포의 용어

  • MCP(Model Context Protocol) · AI 모델이 외부 도구·데이터에 연결하도록 만든 표준 커넥터 프로토콜
  • CVE · 공개적으로 등록된 소프트웨어 취약점 식별 번호
  • 탈옥(Jailbreak) · 안전장치를 우회해 AI 모델이 금지된 답변을 하도록 유도하는 공격
  • 레드팀(Red Team) · 공격자 입장에서 시스템의 약점을 미리 찾아내는 모의 공격 활동
  • F1 점수 · 정밀도와 재현율을 함께 반영한 탐지 성능 지표, 1에 가까울수록 좋음

레포 원문 소개 (영문)

A full-stack AI Red Teaming platform securing AI ecosystems via Agent Scan, Skills Scan, MCP scan, AI Infra scan and LLM jailbreak evaluation.

소속 · tencent-hunyuan

GitHub에서 보기

주목받는 레포

레포 전체 보기 →

METAL MEDIA 최신 기사