2023前沿大模型的风险、安全与治理报告-61页_4mb
报告摘要
三维世界类大模型技术、风险与治理研究报告分析
趋势预测
- 技术发展:大模型遵循缩放定律,未来数年内可能出现数量级规模增长(如算力需求增加5-100倍),AGI或类AGI模型可能在2030年代出现。
- 应用场景:多模态模型扩展、自主智能体实现复杂任务(如科学发现与具身智能)、大模型作为AGI核心路径。
风险分类与态势
- 主要威胁:生物安全(开源生成技术增强滥用可能性)、网络犯罪(生成式工具如FraudGPT)、战略权力寻租。
- 极端风险:失控AI导致的生存危机(如工具自主性战略欺骗)、错误目标泛化、多智能体协作困境。
- 学术观点分歧:存在专家支持暂停/放缓发展和倡导渐进发展两种观点,但共识形成困难。
安全应对路径
- 五大抓手:
- 对齐(Alignment):主流RLHF方法局限,需可扩展监督机制。
- 监测(Monitoring):预警自主性风险。
- 鲁棒性(Robustness):提升模型在干扰下的安全操作行为。
- 系统性安全:协同人工智能基本法系统保障。
治理机制
- 技术管控:第三方法安全测评、负责任扩展政策(如Anthropic ASL分级)、区块链追溯等机制。
- 政策应对:中国率先制定生成式AI暂行办法、欧盟AI法案分级监管、美国自愿承诺协议。
- 全球协作:英国等国推动全球治理论坛,倡议多方机构建设机制。
国际协作机制构建
- “多轨架构”国际治理体系设想:
- 政府间治理机构(如前沿AI委员会)
- 多边管理部门(如IAEA式治理组织)
- 公私合作平台(如Gavi疫苗联盟模式)
- 安全研究特区(如CERN运作方式)
结论与建议
- 推动技术与治理“双轮驱动”,按“可扩展策略”量级推进发展路径。
- 中国应坚持全球治理三原则:技术创新市场主导、安全伦理监管先行、发展中国家权益保障。
展开完整摘要
试读结束,高清完整版pdf/doc/ppt,请点下载