2025中国人工智能安全全景报告
报告摘要
2025年中国AI安全报告总结
国内政策深化与标准建设
-
政治指导:
中央政治局首次专题学习人工智能安全,强调“安全可控、自主可控”的底线思维,将AI安全提升至国家战略层面。第三十次中央全会提出建立跨部门监督体系,覆盖技术失控、数据滥用、生物安全等风险。 -
立法进程:
权威AI安全立法尚未启动,但行业协会提出3.0版《人工智能示范法》,包含安全豁免权与举报机制设计。国家标准爆炸式增长,2025年发布量追平前三年总和,覆盖从生成内容标识到高危系统评估的全链条规范。 -
标准驱动:
11部门联合制定AI安全标准体系,国防科工局牵头核安全风险管控框架。北京设立“AI安全超级对齐实验室”,上海发布多模态安全测试平台,地方政府通过深圳数据要素市场试点等政策落地。
技术安全研究爆发式增长
-
研究量扩张:
2024-2025年AI安全论文产出激增2.3倍,月均26篇。31家研究组聚焦对齐/可解释性/逃逸风险等前沿问题,其中40%团队迁出海外或转入算法透明化研究。 -
技术突破点:
- 对齐机制:清华大学团队开发“Aligner”框架,中山大学提出自迭代监督方法;
- 机械可解释性:上海交大实现AI模型神经元级行为追踪;
- 威慑测试:京津冀联合实验室完成首次大模型军事化场景压力测试。
-
工具链构建:
SHLAB的OpenCompass 2.0平台集成40类测试工具,中国电标院开发AI伦理审计系统,腾讯RealAI推出模型漏洞扫描协议,形成从注册评估到持续监视的完整工具生态。
国际协作基础构建
-
南南合作:
提出“AI扫地机器人”等南南合作项目,在非洲部署50个本地化训练中心,联合发布中非数字治理北京宣言。 -
标准输出:
中国-上海人工智能安全中心发布首个发展中国家版AI安全评估规范,参与制定ISO/IEC 42001大模型管理体系。 -
风险对话:
五国人工智能安全教育论坛在清华设立,欧盟-中国学者共同开发生物工程风险识别工具,英方报告引用中国专家提出的“三阶安全风险梯度”框架。
治理生态多元演进
-
企业自律:
17家头部企业签署安全能力清单,涵盖数据脱敏/红队测试/应急响应等35项措施,百度/阿里等纳入开源贡献度考核指标。 -
评估服务:
信通院构建AI健康度指数工具链,第三方机构完成30%大模型安全预估,麒麟软件参与军事AI系统漏洞监测系统开发。 -
专家共识:
中科院牵头成立AI安全元宇宙研究组,提出“不可撤销安全基准”概念,控制派学者指出当前监管重点偏向犯罪用途,需加强社会算法偏见治理。
全球治理前瞻与挑战
-
专利布局:
全球AI安全专利交易中,中国企业占比达18%,但核心原创性风险预警算法仍集中欧美。 -
监管差异:
中国标准与欧盟《人工智能法案》存在六类冲突:包括对高危系统的界定差异、透明度要求不同、对开源模型监管尺度不同。 -
能力差距:
在精准风险评估模型构建及跨国有害内容追责机制等领域,相较于美国NIST标准体系仍有明显差距。
试读结束,高清完整版pdf/doc/ppt,请点下载