什么是NAPal
NAPal(Network AI Pal)是阿里云面向企业客户推出的云上网络智能运维服务。NAPal 定位为您的云上数字网工,具备网络专家级知识储备,可定时触发、可7×24 小时在线自主响应,帮助企业客户从"人工响应"走向"AI 驱动的智能运维"。
NAPal 覆盖 VPC、EIP、SLB(ALB/CLB/NLB)、CEN、EC、NAT、VPN、GA、PVL 等阿里云网络全产品线,通过丰富的垂类网络专家经验技能库和智能编排能力,帮助企业客户在上云选型、资源管理、配置操作、流量洞察、诊断分析、告警响应等网络全生命周期场景中实现降本增效。
NAPal : So you can nap. —— 让 AI 替您守护网络,您可以安心休息。
核心价值
将阿里云网络海量运维数据与专家经验封装为可交互的智能服务,显著降低客户理解与排查网络问题的成本,缩短网络故障MTTR(平均修复时间)时长。
NAPal 的核心价值:
网络专家经验沉淀:内置大量网络运维专家的知识与最佳实践,覆盖官网文档、SA 解决方案、最佳实践和复杂网络场景的排查 SOP,支持快速闭环。
全量网络数据底座:首次将阿里云网络工程师级网络运维数据、探测数据和专家排查经验SOP内置于NAPal Agent内对客户开放,统一接入了阿里云网络最全网络数据底座,覆盖网络配置信息、监控指标、活动日志、链路探测数据等。
网络全运维周期覆盖:从上云选型、资源盘点、配置管理到流量洞察、故障定位、架构巡检,覆盖网络运维的完整链路。
继承RAM权限管理:基础阿里云账号RAM权限管控策略,通过阿里云标准Open API MCP组件访问云服务。
产品架构

数据底座
NAPal 汇聚了六类核心数据作为分析基础:
数据类别 | 说明 |
网络配置信息 | 路由表、安全组、VPC/VSwitch 等全量网络配置 |
网络监控指标 | 网络实例级监控指标数据 |
网络日志信息 | 四层 Flowlog 活动日志、七层 ALB/GA 访问日志 |
链路探测数据 | 阿里云自建探测集群数据,覆盖云内流量路径及访问公网运营商的全球链路 |
网络底座数据 | 阿里云网络工程师级底座链路诊断与运维数据,通过向模型注入专家知识,借助AI解读首次开放 |
网络专家知识库 | 覆盖网络产品Q&A、网络解决方案、组网最佳实践等 |
Agent Runtime 层
NAPal 基于千问模型系列,自研适配云上网络运维场景驱动的 Agent Runtime底座,核心能力包括:Multi-Agent 协作编排、ReAct 思考-行动循环、Sandbox 隔离执行环境、长程上下文管理、专家经验知识库与技能库、MCP 与自研脚本工具集等。
用户接入层
NAPal 支持三种接入方式,满足不同场景需求:
接入方式 | 说明 |
控制台即时对话(ChatBox) | 在阿里云控制台内嵌对话式交互,支持即时问答与埋点驱动 |
IM 频道 | 接入钉钉、飞书、企业微信、Webhook URL等主流 IM 频道,可通过机器人接收分析报告和告警推送 |
Open API | 提供基于标准A2A协议的 OpenAPI ,支持用户将 NAPal 能力集成到自有 Agent 或运维系统中 |
工作模式层
NAPal 支持三种工作模式:
工作模式 | 说明 |
对话触发 | 用户在控制台或 IM 频道中通过自然语言即时调用 Skill,完成查询、诊断、分析等任务 |
定时任务 | 支持周期性自动执行巡检、资源盘点、报告生成等任务,定时触发无需人工干预 |
事件触发式响应 | 对接云监控告警,网络相关告警自动驱动 Agent 进行根因分析(RCA),实现无人值守 |
功能特性
NAPal 通过六大能力板块构建网络全生命周期智能运维体系。能力分为两大方向:
方向一:帮用户用好网络
从上云选型到资源盘点,帮助用户快速启动云上网络。
AI 产品咨询
解决上云第一步的组网选型问题。基于阿里云产品文档、最佳实践和 SA 解决方案,提供网络产品选型推荐、组网架构建议和费用测算,帮助客户快速完成上云规划。
典型场景:
新业务上云的组网方案推荐
跨地域/跨可用区网络架构设计咨询
网络产品选型对比与费用预估
AI 资源管理
管理和盘点云上网络资源。支持多维度资源搜索与可视化、闲置资源识别与清理建议、配额用量监控与预警、资源利用率分析与成本优化建议。
典型场景:
全网资源自动盘点,识别低水位和闲置资源以实现降本
跨地域资源分布统计与可视化
配额瓶颈预警与配额提升建议
方向二:让 Agent 感知并守护网络
看得见网络、看得懂流量、定位问题。
AI 流量洞察
基于 Flowlog 和七层访问日志实现细粒度流量分析。支持最细到 vport 粒度的流量洞察报告、异常流量检测与溯源、公网访问来源运营商分析、云上互访公网识别、微突发增长量分析等能力。
典型场景:
VPC/TR/NAT/VPN/ALB/NLB 等多场景的 Flowlog 流量洞察
公网暴露面分析与安全审计
运营商质量洞察与链路异常检测
微突发流量增长量分析,按流级别五元组计算增长量与增长率,精准定位突发源头
Top IP 分析,区分常态流量与突发趋势
AI 诊断分析
在网络层面定位问题影响面,提供根因分析与修复建议。覆盖 NIS 实例诊断、路径连通性分析、基础性能查询及分析、监控指标解读等能力。
典型场景:
VBR 丢包检测与限速丢包 RCA
物理端口收发光异常诊断
端到端路径连通性分析与故障定位
混合云场景下输入任意两个 IP(云下 IDC 与云上 ECS),展示沿途路径并检测拥塞、丢包等问题
任务中心
NAPal 提供任务中心服务,支持配置定时任务和事件RCA任务进行网络故障自主响应,实现无人值守的网络智能运维:
定时任务
NIS提供定时巡检任务模板框架,支持选择产品类型、巡检Skill和资源巡检范围,从资源盘点、配额管理、健康检查、稳定性分析、网络质量到流量洞察,定时触发覆盖账号下所有网络实例,生成综合巡检报告并支持推送至 IM 频道。
六大巡检视角:
巡检视角 | 能力说明 |
资源盘点 | 自动盘点网络资源使用情况,识别闲置资源、利用率分析和浪费检测,跨地域资源分布统计 |
配额管理 | 配额用量扫描,识别配额瓶颈,提供配额提升建议和预警,多账号配额汇总分析 |
健康检查 | 实例健康状态扫描,后端服务器健康检测,端口连通性验证,健康检查失败根因定位 |
稳定性分析 | 分析网络高可用情况,识别单点故障、冗余不足、容灾风险等稳定性隐患,多可用区冗余评估 |
网络质量根因分析 | 结合实例级网络链路探测、运营商质量探测、跨域 PingMesh,提供网络质量根因分析 |
流量洞察报告 | 结合 Flowlog 和七层访问日志,提供最细到 vport 粒度的流量洞察报告,异常流量检测与溯源 |
事件 RCA 任务
对接云监控告警,自动编排拓扑影响面分析、资源健康诊断、异常流量定位等 Skill 进行根因分析,输出根因分析报告并推送至 IM 频道,实现网络告警的无人值守。
自动分析流程:
用户订阅告警 ——将云监控告警推送至 NAPal
NAPal自动响应告警 —— NAPal 根据告警自动匹配内置的告警处理SOP
关联拓扑影响面分析 —— 分析告警影响的网络拓扑范围和依赖资源(如 EIP → NAT → LB 的影响链路)
关联资源健康诊断 —— 对受影响资源执行健康检查和稳定性评估
异常流量定位分析 —— 基于 Flowlog 和七层日志定位异常流量模式和攻击行为
输出根因分析报告 —— 生成事件根因分析报告,推送至 IM 频道(钉钉/飞书/企微)
技能中心
NAPal将持续发布网络运维专家技能, 覆盖阿里云网络核心产品线,您可以持续关注NAPal技能中心的更新,即时了解NAPal的能力矩阵动态。
接入方式
控制台 ChatBox
在阿里云网络控制台内嵌对话式交互界面,用户可通过自然语言即时调用 NAPal ,支持即时问答、资源查询、故障排查等。
IM 频道
已打通主流企业 IM 平台,支持通过机器人调用 NAPal ,接收巡检报告和告警RCA根因报告推送:
钉钉:通过钉钉机器人推送
飞书:通过飞书机器人推送
企业微信:通过企业微信机器人推送
IM 频道支持分 Agent 管理信息流,可按团队或业务线设置不同的推送群组。
Open API
提供标准 OpenAPI 协议调用接口,支持客户将 NAPal 能力集成到自有 Agent、运维平台或自动化工作流中。
若仅需原始数据分析结果,可通过标准 API 直接获取(无 AI 参与)
若需智能分析结论,则通过 Agent 调用 AI 能力,基于底层数据生成洞察
使用场景
场景一:日常问题对话
用户在控制台或 IM 频道中通过自然语言即时查询资源信息或进行故障排查辅助,多数查询任务可在分钟级完成。
示例:
"帮我查一下 VPC-123 下有多少个 ENI"
"这个 EIP 最近一小时的流量趋势是怎样的"
"帮我分析一下 NAT 网关 nat-456 为什么丢包"
场景二:定期智能巡检
配置定时任务,Agent 周期性执行全网资源巡检,覆盖六大巡检视角(资源盘点、配额管理、健康检查、稳定性分析、网络质量根因分析、流量洞察报告),生成综合巡检报告并推送至 IM 频道。
示例:
每周一上午 9:00 自动执行全网资源盘点和健康度扫描
识别低水位、闲置资源以实现降本
提前提示扩容需求,预防告警触发
定期评估架构健康度与稳定性,识别单点故障和容灾风险
场景三:无人值守事件响应
Agent 内置至云监控,网络相关告警自动驱动 Agent 进行根因分析。从告警到根因的全自动分析链路,分析报告可反推至云监控按原有联系人组接收,也可通过 IM 机器人推送至指定群组。
示例:
共享带宽被打爆后,自动定位打爆 IP 或五元组,并给出闭环建议
专线物理端口故障后,自动分析影响面并定位根因
NAT 网关公网带宽打满后,通过 Top 业务来源定位根因
定价说明
当前NAPal处于产品公测期,支持免费试用; NAPal商业版将采用预付费月度版本订阅,基础版本费包含AI Credit额度和基础会话并发量,支持叠加AI容量包提升Credit额度和会话并发量。
月度版本订阅
包含基础 Credit 额度,起步会话并发量 5 个,满足中小规模日常运维需求。
AI 容量包(叠加)
当基础版本容量不足时,可购买 AI 容量包进行扩容。每个 AI 容量包额外提供 +8 会话并发量,同时包含额外的 Credit 额度。
AI 容量包的价值:
更多的 Credit 额度,支撑更高频次的分析调用
更多的成员在线,支撑多团队成员同时使用
更高频的定时任务,支撑更密集的巡检周期
更多的告警并发响应量,支撑大规模告警场景
计费说明
商品项 | 包含 | 费用(元/月) | 有效期 |
月度版本订阅包 | 5000 Credit,会话并发量 5 个 | 8000 | 自然月 |
AI 容量包 | 每叠加一个AI容量包,将获得以下:
| 10000 | 自然月 |
常见问题
NAPal 支持哪些网络产品?
NAPal 覆盖阿里云网络全产品线,包括 VPC、EIP、负载均衡系列产品(ALB/CLB/NLB)、CEN、EC、NAT、VPN、GA、PVL 等核心网络产品。
NAPal 的响应速度如何?
大多数查询与分析任务可在分钟级完成(平均响应时长约3分钟内),不承诺秒级响应。
如何将 NAPal 接入现有的运维体系?
NAPal 提供标准 OpenAPI 协议调用接口,可集成到客户自有 Agent 或运维系统中。同时已打通钉钉、飞书、企业微信、Webhook等主流 IM 频道,可通过机器人接收分析报告推送。
NAPal 是否支持自定义 Skill?
目前暂未支持,后续将开放自定义 Skill 功能,允许客户在预置 SOP 基础上叠加自身运维逻辑,构建专属的网络运维 Agent。
巡检报告如何推送?
巡检报告支持推送至 IM 频道(钉钉/飞书/企微),可按团队或业务线设置不同的推送群组,实现分 Agent 管理信息流。
事件 RCA 分析如何与云监控联动?
NAPal Agent 已内置至云监控,用户订阅网络相关告警接入NAPal Agent后,一旦告警触发,云监控将自动推送至 NAPal,Agent 自动执行影响面分析、健康诊断和根因定位,分析报告可反推至云监控按原有联系人组接收。