中国信通院2025年AI运维构建智能化运维新范式研究报告25页_4mb
报告摘要
中国信息通信研究院(以下简称“研究院”)作为国家高端专业智库和产业创新发展平台,长期致力于智能运维领域标准制定与产业生态建设。其历史可追溯至1957年,现承担工信部电信研究院职能,积极参与国际组织如ITU、ISO、IEEE等标准工作,牵头发布119项国际标准,推动全球标准化进程。研究院在2019年联合80余家行业企业,构建AIOps标准体系,涵盖智能运维通用能力、系统工具技术要求及可观测性能力等维度,已有超50项标准通过评估,覆盖金融、通信、互联网等多个领域。
AIOps(人工智能运维)技术演进可分为四个阶段:传统运维依赖人工操作,效率低下;自动化运维引入工具减少重复任务,将故障恢复时间从小时级压缩至分钟级;小模型运维时代(2015-2023)依托机器学习实现局部场景的异常检测与根因分析,但存在场景碎片化、规则依赖等问题;当前大模型运维时代(2023-2033)通过多模态大模型和数字孪生技术,实现全域感知与自主决策,支持端到端诊断、预测性维护和毫秒级响应。《国家人工智能产业综合标准化体系建设指南(2024版)》等政策推动AIOps技术深化应用,助力数字经济与实体经济融合。
研究院提出的SOMM(AI驱动的运维保障体系)从智能运维、精细化运维、稳定性保障、数据能力四大领域构建框架,涵盖AIOps、FinOps、SRE等子系统,企业用云治理能力成熟度评估及云成本管理等场景。在技术能力分级中,L1-L5对应从初始智能化到高度智能化运维,逐步强化感知、分析、决策、执行及知识更新能力。例如,L1以人工为主,L5实现全系统智能化。
国际层面,研究院牵头制定ITU-T Y3550《基于AI的云服务开发与运营要求》标准,结合ITU-T Y3525框架,针对智能运维场景提出能力要求与用例,规范AI在研发、运营各阶段的应用。国内标准评估显示,中国工商银行等企业已通过AIOps通用能力评估,中移动、联通等企业完成可观测性能力测试。
运维智能体(AIAgent)作为大模型技术落地的核心载体,通过感知、决策、执行等模块实现多场景赋能,如异常检测、故障诊断、修复及智能问答。其标准框架由研究院联合80余家企业制定,涵盖基座能力、智能体功能、数据安全要求,推动跨平台协同与规模化应用。
针对智算运维需求,研究院提出《智算运维能力成熟度模型》,从AI模型层、智算平台、基础软件层、算力基础设施等维度构建标准体系,解决算力利用率低、故障管理复杂、监控精度不足、资源错配等问题。模型分为1-5级,涵盖算力基础设施运维、异构算力适配、弹性资源调度、集群稳定性保障等场景,并强调跨层级协同、数据互通及智能化升级。
整体而言,研究院通过标准制定与技术研究,推动AIOps和智算运维向高成熟度发展,助力行业降低沉没成本,提升系统稳定性与运维效率。当前AIAgent市场预计于2025年爆发增长,2028年达近20亿美元,需进一步完善协同化、标准化能力以应对大模型训练需求。
试读结束,高清完整版pdf/doc/ppt,请点下载