Agent 风险检测与防护
在 Agent 大规模部署的场景下,提示词注入、越狱攻击、混淆走私和隐私泄露等安全威胁日益凸显。云安全中心 Agent 安全中心提供基线检测、漏洞扫描等多种检测与防护手段,帮助快速识别并拦截 Agent 安全风险。
前提条件
已将 AI 资产接入 Agent 安全中心。
检测方式选型建议
不同检测方式适用于不同场景,建议根据实际需求选择:
对比项 | 系统定时自动检测 | 手动检测 |
适用场景 | 日常安全巡检,持续监控资产风险状态。 | 配置变更后立即验证风险状态。 |
检测方式 | 自动 | 手动 |
触发方式 | 每天一次自动执行 | 手动触发 |
结果存储 | 同步到Agent 风险列表 | 同步到Agent 风险列表。 |
费用 | 限时免费(公测阶段) | 限时免费(公测阶段) |
检测 Agent 风险
检测说明
检测耗时:具体时间取决于资产复杂度。
系统影响:检测过程为只读分析,不会影响线上业务运行。
结果有效期:检测结果反映检测时刻的风险状态,建议在配置变更后重新检测。
系统定时自动检测
接入Agent 安全中心后,系统每天自动对已接入的 AI 资产进行风险检测。
扫描时间和频率:每天自动执行一次。
扫描范围:已接入的全部 AI 资产。
扫描结果:可在Agent 风险的风险事件列表中查看及处理。
手动检测
手动检测操作步骤如下:
访问云安全中心控制台-Agent安全中心-Agent概览,在页面左侧顶部,选择需防护资产所在的区域:中国内地或非中国内地。
在接入平台区域,单击右上角的资产同步。
系统将同步平台的AI Agent、模型服务、工具集、数据集、应用配置等相关数据,同时进行风险检测。
说明资产同步可能需要一定的时间,请耐心等待。
启用实时防御
Agent 安全中心提供实时防御功能,为 AI 平台上的 Agent 提供运行时防护,确保其稳定运行。详细步骤,请参见安装防御插件。
查看和处理风险事件
访问云安全中心控制台-Agent安全中心-Agent风险,在页面左侧顶部,选择需防护资产所在的区域:中国内地或非中国内地。
在风险事件页面,单击目标事件操作列的处理。
在风险事件处理详情页,查看风险详情。评估风险后,可选择以下处理方式:
人工处理:根据详情页的推荐处置方案或加固建议,在 Agent 应用的代码或配置中进行修复。
忽略:若当前风险为可控风险无需处理,单击下方忽略按钮。忽略后,该风险事件将不再出现在待处理列表中,但下次检测时如果仍存在该风险,将再次生成风险事件。
重新扫描:需验证人工处理风险的结果或需对当前 AI 资产重新进行风险检测时,可单击下方重新扫描按钮。
重要仅适用于来源为Agent 安全中心的风险,检测需要一定时间,可在控制台查看进度。
重新扫描会对当前风险事件关联的 AI 资产进行全面检测,不仅验证当前风险是否已修复,还会检查该资产是否存在其他风险。
计费说明
公测期间,系统定时自动检测和手动检测功能限时免费。
2026 年 8 月 25 日起,Agent 安全中心提供的防御插件将开始正式商用计费。更多内容,请参见【产品变更】实时防御能力计费公告。