安全工具丨一站式AI红队安全测试平台,集成Agent安全扫描、AI工具技能扫描、AI基础设施漏洞扫描与大模型安全体检(越狱评估)等能力

admin 2026-07-19 04:32:26 网络安全文章 来源:ZONE.CI 全球网 0 阅读模式

文章总结: 腾讯朱雀实验室开源了一站式AI红队安全测试平台A.I.G,集成AI基础设施漏洞扫描、MCP与Agent技能风险检测、Agent工作流安全扫描、OpenClaw安全体检和大模型越狱评估五大模块。该平台支持Web界面与命令行双模式,可识别100+种AI组件和1900+个CVE漏洞,旨在帮助企业系统性自查AI安全风险,但需注意其无鉴权机制,仅限内网部署。 综合评分: 87 文章分类: 安全工具,红队,AI安全,漏洞扫描,渗透测试


cover_image

安全工具丨一站式 AI 红队安全测试平台,集成Agent安全扫描、AI工具技能扫描、AI基础设施漏洞扫描与大模型安全体检(越狱评估)等能力

原创

蓝星安全 蓝星安全

蓝星安全

2026年7月17日 06:00 浙江

在小说阅读器读本章

去阅读

点击上方蓝星安全关注我

免责声明:本公众号分享的任何资料仅限用于安全学习,严禁用于其他用途,请严格遵守中华人民共和国法律法规,对因不遵守国家法律法规而产生的任何后果,均由个人自行承担,本公众号不承担任何责任!

获取资料,请扫码下方二维码加入知识星球

         AI技术正以前所未有的速度融入千行百业,但大模型漏洞、数据泄露、供应链投毒等安全威胁也随之而来。就在不久前,月下载量近亿的知名大模型网关工具LiteLLM遭遇供应链投毒事件,波及范围极广,被业界称为“软件恐怖事件”。面对日益复杂的AI安全挑战,企业和开发者该如何系统性自查风险?

近日,腾讯朱雀实验室开源的一站式AI红队安全测试平台——A.I.G(AI-Infra-Guard),正是为了解决这一痛点而生。它集成了基础设施漏洞扫描、MCP与Agent技能风险检测、大模型越狱评估等多项能力,目标是成为业界领先的AI红队工具平台。


一、简介:什么是A.I.G?

     A.I.G(AI-Infra-Guard)是由腾讯安全平台部朱雀实验室(Tencent Zhuque Lab)主导开发的一款高效、轻量、易用的AI基础设施安全评估工具。朱雀实验室自2019年成立以来,专注于AI安全领域的实战攻防与前沿研究,曾多次协助英伟达、谷歌、微软等厂商及OpenClaw、Linux等开源社区修复高危漏洞,并获官方致谢。

该项目定位为企业内部使用的AI红队测试平台,提供Web界面与命令行双操作模式,支持Docker一键部署,开箱即用。需要特别提醒的是,由于目前暂无鉴权认证机制,请勿在公网环境中部署使用

二、核心能力:五大安全扫描模块

A.I.G的核心能力构建了一整套AI安全风险自查体系,覆盖从基础设施到应用层的多个维度。

2.1. AI基础设施漏洞扫描(AI Infra Vulnerability Scan)

这是A.I.G的基础能力,通过精准的Web指纹识别技术,检测AI训练、部署与应用构建中使用的各类开源框架组件(如Ollama、ComfyUI、vLLM、Triton Inference Server等)。

核心数据

  • 支持组件:精准识别100+种AI开源Web组件。
  • 漏洞覆盖:涵盖1900+个已知CVE漏洞。
  • 扫描方式:只需填写目标服务的网络地址(如http://127.0.0.1:8000),即可自动识别组件版本并匹配漏洞库。

2.2. MCP Server & Agent Skills 扫描

随着AI Agent生态的兴起,MCP(模型上下文协议)Server和Agent Skills成为新的攻击面。A.I.G对此提供了专项检测能力。

检测深度

  • 风险类别:可检测14大类安全风险,包括工具投毒、凭证窃取、命令注入、越权访问等。
  • 扫描方式:支持上传源代码压缩包或填入GitHub仓库地址进行检测,无需实际运行实例,安全无侵入。
  • 技能审计:独立的aig-skill-scan工具可集成到CI/CD流水线,其对SkillTrustBench数据集的扫描F1值超过0.97,误报率低至1.2%。

2.3. Agent Scan(AI Agent工作流安全扫描)

专为评估运行在Dify、Coze等各类平台上的AI Agent工作流安全性而设计。它能够评估智能体在执行任务过程中可能出现的“失控”风险,例如工具滥用、权限边界绕过等。

2.4. ClawScan(OpenClaw安全体检)

支持一键评估OpenClaw生态的安全风险,可全面检测不安全配置、Skill风险、CVE漏洞以及隐私泄露等问题。

2.5. 大模型安全体检(越狱评估/Jailbreak Evaluation)

该功能用于评估大模型自身的安全护栏有效性。

评估机制

  • 数据集:内置精选的越狱攻击算法与评测数据集。
  • 评估维度:自动化评估模型在面对恶意、对抗或诱导类提示词时的安全性。
  • 结果输出:可导出Badcase用于安全对齐与护栏加固,并支持跨模型的横向对比。

三、立即获取

https://github.com/Tencent/AI-Infra-Guard


免责声明:

本文所载程序、技术方法仅面向合法合规的安全研究与教学场景,旨在提升网络安全防护能力,具有明确的技术研究属性。

任何单位或个人未经授权,将本文内容用于攻击、破坏等非法用途的,由此引发的全部法律责任、民事赔偿及连带责任,均由行为人独立承担,本站不承担任何连带责任。

本站内容均为技术交流与知识分享目的发布,若存在版权侵权或其他异议,请通过邮件联系处理,具体联系方式可点击页面上方的联系我

本文转载自:蓝星安全 蓝星安全 蓝星安全《安全工具丨一站式 AI 红队安全测试平台,集成Agent安全扫描、AI工具技能扫描、AI基础设施漏洞扫描与大模型安全体检(越狱评估)等能力》

评论:0   参与:  0