金杜:2023大模型合规白皮书_81页_1mb
报告摘要
大模型合规白皮书(2023)总结
一、大模型发展历程
-
技术演进路线
- 早期阶段(1956-2005):符号逻辑模型探索,专家系统雏形。
- 快速成长阶段(2006-2019):深度学习兴起,Transformer架构突破。
- 全面爆发阶段(2020至今):预训练大模型成熟,GPT等模型引领产业变革。
-
技术创新特征
- 超大规模参数训练、多模态支持、少样本学习能力;
- 数据依赖性强、黑盒特性、偏见风险与泛化不足的早期局限;
- 现阶段通过架构优化、数据增强等技术显著提升性能。
二、全球监管现状
(一)主要国家实践
-
欧盟
- 《人工智能法案》:风险分层监管(不可接受风险/高风险/有限风险/最小风险);
- 强制要求高风险模型进行CE认证、透明度披露与人工监督。
-
美国
- 分散式州级立法(如伊利诺伊州、加州相关法案);
- 联邦层面推进(NIST框架、AI权利法案草案、ASSESSAI法案);
- 注重算法公平性、数据隐私与开源合规。
-
英国
- 通过《在线安全法案》规范生成内容;
- 重视算法伦理审查与技术开发者责任认定。
(二)中国监管体系
-
法律框架:
- 纵向监管(网络安全法、数据安全法等)与横向监管(生成式AI暂行办法)并行;
- 提出“负面清单+科技伦理审查”机制。
-
重点监管领域:
- 数据跨境传输(如个人信息出境标准合同)、算法备案、内容安全;
- 对生成式AI服务提供者与技术支持方区别义务。
三、合规要素与责任划分
(一)主要主体责任
| 角色 | 核心义务 |
|---|---|
| 服务提供方 | 内容审核、用户权益保护、算法备案 |
| 技术支持方 | 数据合规、模型训练透明度、知识产权管理 |
| 用户 | 输入数据责任、使用约束义务 |
(二)关键合规维度
-
数据合规:
- 来源合法性、去标识化处理、跨境传输审查;
- 合理使用争议(如版权规避、训练数据侵权风险)。
-
内容与算法:
- 禁止歧视、公平机制、模型透明度;
- AIGC版权归属争议与“著作权盾”解决方案。
-
知识产权与竞争法:
- 避免剽窃开源代码、防止共谋行为;
- 开源许可冲突与商业模式设计。
四、未来展望与发展建议
(一)核心趋势
- 合规框架一体化:全球标准趋同但区域差异持续存在;
- 技术伦理深度融合:强调社会价值导向、文化适应性;
- 行业差异化监管:医疗、金融等高风险领域强化评估制度。
(二)企业与政府建议
| 推动力量 | 关键行动 |
|---|---|
| 政府 | 完善“横向+纵向”监管体系,制定行业伦理标准 |
| 企业 | 建立科技伦理委员会、强化模型可解释性 |
| 社会组织 | 倡导多方对话、推动国际互认合规框架 |
附录:合规义务一览表
| 阶段 | 要素 | 典型义务 |
|---|---|---|
| 备案与资质 | 算法备案 | 10个工作日内完成技术文档报备(欧盟/中国适用) |
| 数据训练 | 数据质量 | 训练数据来源合法、去噪处理、标注规则制定 |
| 内容生成 | AIGC标识 | 必要时披露生成内容,防止深度伪造滥用 |
| 伦理治理 | 偏见防范 | 开发反歧视机制,进行公平性测试 |
展开完整摘要
试读结束,高清完整版pdf/doc/ppt,请点下载