AI_安全_信任和责任_(AI_STR)_认证_10页_3mb
报告摘要
AI-STR认证总结
什么是AI STR认证
AI STR认证(人工智能安全、可信与责任认证)是由世界数字技术院(WDTA)基于其AI STR系列国际标准推出的全球性认证项目。该认证不仅涵盖技术层面的安全评估,还涉及伦理和法律合规性,旨在为AI应用的开发者和使用者提供全面的安全与合规保障,推动AI技术的安全、可靠与负责任应用。
AI STR标准
WDTA在2024年4月的联合国科技大会AI边会上发布了两项重要国际标准:
-
WDTA AI-STR-01《生成式人工智能应用安全测试标准》
- 为生成式AI应用的安全性测试和验证提供框架。
- 覆盖基础模型选择、嵌入与向量数据库、提示执行、代理行为、微调、响应处理及运行时安全等8个方向。
-
WDTA AI-31K-02《大语言模型安全测试方法》
- 提出大语言模型的安全风险分类、攻击分类分级及测试方法。
- 首次定义四种攻击强度分类(L1-L4),并提供严格的评估指标和测试程序。
-
WDTA AL-STR-03《大模型供应链安全要求》
- 概述大语言模型供应链的安全保护框架。
- 针对开发与运维管理过程中的供应链风险提出具体要求,提供典型案例指导供需双方进行安全风险评估与管理。
认证对象与范围
评估对象
- 生成式AI应用:包括办公、营销、设计、虚拟人、开发、人力、客服、财税等场景。
- 大语言模型(LLM):包括文本生成模型、对话生成模型、多模态模型、语义理解与分析模型及行业特定大语言模型。
评估范围
- 生成式AI应用安全测试:涵盖模型选择、数据使用、提示构建、推理执行、响应处理、运行时安全等。
- 大语言模型安全测试:重点关注训练过程安全性、推理阶段防护能力、数据隐私保护及对抗性攻击应对能力。
认证流程
- 受理申请:委托单位向测评机构提交《AI STR测评认证申请书》。
- 签署合同:委托单位与测评机构签订合作协议,并提交相关材料。
- 开展测评:测评机构根据测评计划进行测试,委托单位根据测评结果进行整改。
- 颁发证书:测评机构向委托单位发放认证证书。
认证价值
- 降低风险:通过系统化安全评估,识别并缓解AI应用中的潜在风险。
- 满足合规:帮助企业符合各类法规和合规要求,减少法律与财务风险。
- 促进创新:指导企业采用最佳实践,推动AI技术的安全可靠创新。
- 增强信任:通过第三方认证,提升用户对AI应用的信任度。
- 提升安全性和可靠性:识别并修复模型漏洞,减少对抗性攻击风险。
- 降低运营风险:减少因模型安全问题引发的经济损失与品牌损害。
- 推动责任使用:引导企业在设计与部署AI系统时考虑社会影响与伦理问题。
- 持续改进:定期进行安全测试和更新,确保AI模型适应新威胁。
认证证书
- 证书由:WDTA及测评机构联合颁发。
- 有效期:3年。
- 监督检查:每3年进行一次监督检查,更新证书。
- 查询地址:https://wdtacademy.org/
认证机构
- 世界数字技术院(WDTA):注册于日内瓦的国际非政府组织,致力于数字技术的规范建立、创新引领、人才培养与国际合作,支持联合国的可持续发展目标。
测评合作伙伴
- 国家金融科技测评中心:负责金融科技领域的安全测评。
- 蚂蚁集团:提供AI技术相关的安全评估与支持。
- 腾讯云:参与AI应用安全测试与验证工作。
展开完整摘要
试读结束,高清完整版pdf/doc/ppt,请点下载