文章总结: 火山引擎发布智能体安全能力图谱,梳理10大能力维度与60项核心技术要素,覆盖合规准入、资产供应链安全、内容安全、安全测评、AI安全网关、身份认证、权限控制、运行时监控、可观测性及模型推理安全。提出L1基础防护、L2精细化管控、L3持续运营三阶段建设路径,为企业提供从基础防护到体系化治理再到可持续运营的完整框架。 综合评分: 87 文章分类: 安全建设,解决方案,AI安全,安全运营,技术标准
行业首发|智能体安全能力图谱发布:企业可落地的建设路径
火山引擎AI安全 火山引擎AI安全
字节跳动技术团队
2026年8月25日 18:00 北京
在小说阅读器读本章
去阅读
当前企业智能体部署已呈现规模化落地阶段,多元化、异构化的智能体已深度融入企业核心生产业务系统和办公开发场景。
在很大程度重塑了企业现有的 IT 架构,导致安全风险激增,给传统安全防护体系带来了极大冲击与挑战。这就要求企业重新思考,构建适配 AI 时代的安全防护和治理体系框架。
基于字节内部 AI 安全治理最佳实践,火山引擎发布《智能体安全能力图谱》,系统性梳理了智能体安全建设的 10 大能力维度、60 项核心技术要素。管理范围包括:WorkFlow 类智能体、办公类智能体、AI Coding 类智能体。
扫描图中二维码,获取高清图及详细能力介绍
1. 智能体合规准入:在智能体设计及规划阶段安全就要介入,基于智能体岗位职责、行为权限、使用场景等做好分类分级,构建符合智能体岗位职责的安全基准线,并形成可嵌入的安全描述文件,为后续安全管控做好准入准备。
2. 智能体资产与供应链安全:上线前则需构建智能体及其核心组件清单(AI-BOM),并对资产进行细粒度盘点,帮助企业管理员“看清智能体资产”。针对资产供应链风险扫描开展定期巡检,从源头管控供应链安全风险。
3. 内容安全合规:聚焦智能体输入输出内容安全检测,结合监管合规要求、实时拦截有害内容,并针对不同行业属性、提供红线敏感话题深度管控。针对 AI 生成内容深度鉴伪打标签,保障安全合规。
4. 常态化安全测评与加固:通过“合规测评”、“红队测评”实现安全左移,构建智能体安全上线准入要求,并提供整改加固建议,进一步降低准入带来的安全风险。同时可结合企业准入注册流程,构建常态化安全测评与加固。
5. AI 安全网关:企业规模化推广智能体落地时,AI 安全网关承载了企业智能体及其核心资产调用、流量与路由管控的统一管控面。通过实现智能体统一接入、敏感数据识别与脱敏、数据跨境管控、模型路由、资源耗尽防护和成本治理等关键能力,降低企业算力消耗的同时实现出入口全面防护。
6. 身份与认证管理:构建智能体非人类身份体系,赋予每个智能体及其组件唯一身份标识并与人类用户身份进行链接,通过可信身份令牌验证智能体身份,叠加委托链与意图声明用于跨服务的全链路身份传播,使其可在全生命周期过程和每个任务的委托链条中体现人类用户的授权同意,并被纳入统一的访问控制和审计追溯范围。提供智能体通过技能功能访问后端资源的凭据托管能力,避免将敏感凭据直接写入工具代码或配置文件。
7.权限与访问控制:以用户、智能体为主体,其他智能体、知识库、技能工具等为客体对象配置权限规则,并在运行态对用户->总控智能体->子智能体->知识库、插件、工具集的委托链全过程各个节点的权限进行权限控制;基于业务需求实时构建权限申请和审批流,在任务执行过程中赋予用户所需的权限;基于智能体可接受行为准则和用户上下文进行动态权限管理,对于高风险且偏离正常业务逻辑的行为进行阻断或强制HITL人机协同。
8. 运行时安全监控与防护:智能体运行时全链路检测防护,针对特有安全风险如工具滥用、越权、记忆投毒、注入攻击等,提供实时检测拦截能力。并针对不同业务场景,提供灵活自定义能力,实现不同行业不同场景下的精准检防护。
9. 安全可观测性与运营管理:通过较长时间的智能体动作全量日志记录、可观测行为审计、智能体事件行为分析、以及自动化处置响应等,可将风险发现与响应能力沉淀为常态化运营体系。如建立智能体 UEBA(基于智能体用户行为构建)、AEBA(基于智能体行为构建)基准,帮助企业最终实现动态化场景运营并沉淀。
10. 模型与推理安全:实现模型推理的机密计算防护能力,以芯片级信任为根基,依托端到端全链路加密,远程证明,完备的可追溯审计能力,帮助企业以轻量化投入,实现等同于私有化部署的高等级安全防护。
企业构建智能体安全管理体系建议
基于企业智能体建设所处阶段,以及安全需求程度,大致分成 3 个阶段:L1-智能体基础安全AI防护、L2-智能体精细化管控、L3-智能体安全持续运营,为企业提供一条从“基础防护”走向“体系化治理”到“可持续运营”的完整防护路径。
L1|智能体基础 AI 安全防护:先解决“能否安全上线”
企业现状:企业刚刚部署智能体平台,已有少量智能体应用,企业有基础的 AI 安全和数据安全合规要求。
智能体安全建设需求,实现智能体基础安全 AI 防护;该阶段覆盖四个维度:1 智能体合规准入,2 智能体资产与供应链安全,3 内容安全合规,4 常态化安全测评与加固。
L1 的目标,是为每一个进入企业环境的智能体建立统一、可执行的安全基线。
L2|智能体精细化管控:再解决“运行过程是否可控”
企业现状:企业已经开始推广 WorkFlow 类智能体、办公和开发类智能体,企业用户可以通过模型网关自由选择内外部模型,企业有商业敏感数据,对于 AI 安全合规有较高要求。
智能体安全建设需求,实现智能体精细化安全管控;该阶段覆盖四个维度:5 AI 安全网关,6 身份与认证管理,7 权限与访问控制,8 运行时安全监控与防护
L2 的目标,围绕统一入口、可信身份、细粒度授权与运行时拦截,建立覆盖每一次调用和执行的控制体系,确保智能体走向“体系化治理”。
L3|智能体安全持续运营:最终解决“规模化后能否持续运营机密可信”
企业现状:企业智能体建设和应用比较成熟,WorkFlow 类智能体已经全面融合到企业各业务系统,办公和开发类智能体已经全员普及;行业头部,属于关基业务的企业,对于 AI 安全合规,数据安全有非常要求。
智能体安全建设需求,实现智能体安全持续运营;该阶段覆盖两个维度:9 安全可观测性与运营管理,10 模型与推理安全。
L3 的目标,是让企业不仅能够全面发现和处置风险,还能基于全链路数据持续验证安全状态、优化策略实现可持续运营,并做到模型推理过程的机密可信。
火山引擎本次发布的《智能体安全能力图谱》,希望为企业提供一套可建设、可运营、可持续演进的 AI 时代安全治理框架,构建企业员工与智能体的一体化安全管理体系,助力企业实现 AI 智能体的可信、可控、可管。
诚挚的邀请各位专家加入火山 AI 安全技术交流群,一起交流探讨智能体安全能力建设和企业实践。
扫码入群
下载高清图谱及完整能力介绍
目前「AI安全交流群1」无法扫码入群,可添加下方管理员微信加入群1
免责声明:
本文所载程序、技术方法仅面向合法合规的安全研究与教学场景,旨在提升网络安全防护能力,具有明确的技术研究属性。
任何单位或个人未经授权,将本文内容用于攻击、破坏等非法用途的,由此引发的全部法律责任、民事赔偿及连带责任,均由行为人独立承担,本站不承担任何连带责任。
本站内容均为技术交流与知识分享目的发布,若存在版权侵权或其他异议,请通过邮件联系处理,具体联系方式可点击页面上方的联系我。
本文转载自:字节跳动技术团队 火山引擎AI安全 火山引擎AI安全《行业首发|智能体安全能力图谱发布:企业可落地的建设路径》
版权声明
本站仅做备份收录,仅供研究与教学参考之用。
读者将信息用于其他用途的,全部法律及连带责任由读者自行承担,本站不承担任何责任。










评论