2023大模型伦理原则与实践白皮书-日日新思无邪-商汤_33页_1mb
报告摘要
商汤大模型伦理原则与实践白皮书总结如下:
-
核心理念
报告强调以人类普适价值观为驱动,实现AI伦理的“三维对齐”:人机对齐(AI目标与人类意图一致)、人人对齐(跨越文化差异形成全球统一价值观)、人环境对齐(科技发展需兼顾生态保护)。联合国《我们的共同议程》提出全球数字契约,涵盖数字连接、人权保护、内容可靠性等领域,计划于2024年形成初步共识。 -
商汤概况
商汤科技是中国领先的人工智能企业,以“坚持原创,让AI引领人类进步”为使命,致力于打造普惠型AI平台。公司技术覆盖感知智能、决策智能、内容生成及增强等领域,并构建SenseCore大装置降低AI生产成本,推动技术工业化。业务涵盖智慧商业、智慧城市、智能生活、智能汽车四大板块,已在多地设立分支机构,海外市场扩展至东南亚等地区。 -
生成式AI的范式变革
2022年生成式AI(如ChatGPT)推动行业进入“AI20阶段”,相比“AI10阶段”的封闭场景与单一模态,AI20阶段具有以下特征:
- 任务类型转向开放场景
- 数据处理模式实现多模态融合
- 模型类型由判别式转向生成式
- 生产范式从“手工作坊”升级为“基础模型+微调”
此变革引发风险范式转变,包括风险边界扩大、模型滥用可能性增加、系统安全与伦理挑战加剧。
- 治理原则与实践
针对生成式AI的现实风险(如幻觉、数据投毒、版权争议等),报告提出六项治理原则:
- 数据质量与隐私安全:通过数据清洗、合规审查、加密技术等保障数据合法性与准确性。
- 虚假信息与不良内容防控:构建内容过滤工具,结合深度学习与人工审核,确保生成内容合规性。
- 版权与知识产权保护:采用数字水印技术确认生成内容权属,建立许可机制。
- 系统安全与鲁棒性:提升模型安全性与可靠性,通过鲁棒性训练、AI防火墙等技术实现防护。
- 可解释性与透明度:优化算法设计,提供模型训练日志与用户反馈机制,增强信任。
- 道德伦理与公平性:制定伦理准则,通过偏见评估、公平性学习等消除算法歧视。
商汤“SenseNova”大模型体系已通过多维度测试,展现较强风险应对能力,相关技术处于邀约测试阶段。
- 治理基础设施
商汤推出“SenseTrust”工具体系,覆盖AI全生命周期治理:
- 数据治理:提供脱敏、祛毒、合规审查工具,并开发数据沙箱支持隐私计算,实现数据可用不可见。
- 模型治理:构建模型体检平台,评估对抗安全、后门风险、公平性等,通过鲁棒性训练与AI防火墙提升安全性。
- 应用治理:开发三位一体的深伪检测解决方案,融合多模态信息识别伪造内容,检测精度达99%以上,并支持版权保护与内容溯源。
- 治理发展倡议
报告呼吁避免生成式AI治理陷入“失控竞赛”,提出四项倡议:
- 聚焦现实风险:明确政策底线,规范数据隐私、知识产权等要求。
- 加大技术投入:研发新型算法与治理工具,提升AI安全与伦理属性。
- 推动国际合作:协调全球监管框架,降低跨境治理成本,支持发展中国家能力提升。
- 强化全社会参与:普及AI知识,加强媒体监督,提升公众风险意识与治理能力。
报告由商汤科技智能产业研究院及上海交通大学计算法学与AI伦理研究中心联合发布,旨在推动负责任、可评估的AI技术发展,服务全球科技伦理治理需求。
展开完整摘要
试读结束,高清完整版pdf/doc/ppt,请点下载