大模型安全研究报告(2024年)-31页_4mb
报告摘要
大模型安全研究报告(2024年)由阿里云计算有限公司与中国信息通信研究院联合编制,旨在应对外部技术竞赛中人工智能从专科弱智能向通用强智能迈进所带来的安全隐患。报告强调,ChatGPT等大模型技术推动了第四次工业革命,但也引入了如模型“幻觉”、指令注入攻击等新风险,加剧了数据泄露和系统漏洞等问题。
技术演进方面,大模型经历了探索期(2017-2021年,预训练语言模型)、爆发期(2022-2023年,语言大模型)、提升期(2024年至今,多模态大模型),关键技术包括Transformer架构和无监督预训练。
安全挑战主要分为四类:训练数据风险(如泄露、投毒);算法模型风险(如鲁棒性不足、幻觉);系统平台风险(如框架漏洞);业务应用风险(如内容生成不当)。报告通过ISO/IEC标准抽象出风险地图,提出防范措施。
机遇包括大模型在网络安全、数据安全和内容安全领域的应用潜力,例如威胁情报生成、漏洞挖掘和内容检测。报告构建了自身安全框架(涵盖目标、属性、对象、措施)和赋能安全框架(包括风险识别、防御、检测等阶段)。
字数:784。
展开完整摘要
试读结束,高清完整版pdf/doc/ppt,请点下载