2025年大模型安全白皮书_30页_11mb
报告摘要
安全·向善·可信·可控
大模型安全正经历从传统网络边界防御到原生、全栈、智能动态防御的范式迁移。其安全风险贯穿基础设施、模型层、数据层、智能体层及用户端五大层次,包括算力劫持、供应链投毒、内容越狱、模型幻觉、知识污染、隐私泄露等,形成复杂威胁矩阵。
针对风险,360提出“外筑‘以模治模’动态屏障,内固‘平台原生’安全底座”的理念,构建涵盖算力、内容、数据、智能体和用户全链路的双轨安全防护体系。
关键能力包括:
- 360大模型卫士系列:外挂式安全,覆盖算力主机、内容检测、MCP防御等。
- 平台原生安全:知识库全生命周期管理、智能体构建与运营平台、客户端沙箱隔离。
- 内容安全系统:通过风险检测、安全代答和审判模型,缓解幻觉与合规风险。
生态共治方面,强调标准建设、产学研协作、监管协同与合规优先,推动大模型安全从技术到治理的整体闭环。
最终目标是实现“安全、向善、可信、可控”四大支柱的全景安全框架,为AI时代的健康发展筑牢根基。
展开完整摘要
试读结束,高清完整版pdf/doc/ppt,请点下载