2018年深度学习技术选型白皮书_37页-1mb
报告摘要
深度学习技术选型白皮书总结
核心内容概述
本白皮书由中国人工智能产业发展联盟发布,旨在为企业在深度学习技术选型过程中提供指导和参考。白皮书围绕深度学习训练框架、推断框架及技术生态工具集三大维度,系统梳理了当前深度学习技术体系的应用现状、选型指标及发展趋势,同时列举了多个产业优秀使用案例,为开发者和企业提供了实用的技术参考。
主要观点
深度学习框架是人工智能产业化落地的核心
- 深度学习框架通过封装算法、调用数据及使用计算资源,成为人工智能技术体系中的关键组成部分。
- 当前主流开源框架包括 TensorFlow、Caffe/Caffe2、PaddlePaddle、MXNet、Keras、PyTorch 等,它们在不同场景下各有优势。
- 企业可根据自身业务需求选择合适的框架,如 TensorFlow 适合大规模应用,PaddlePaddle 在中文支持及工业场景表现优异,Caffe 适合计算机视觉领域。
深度学习框架分类
- 云端训练框架:适用于海量数据训练,要求高算力和稳定性,支持分布式计算。
- 云端推断框架:注重模型优化和并发处理能力,支持多种部署方式。
- 端侧推断框架:针对终端设备,需兼顾性能、能耗及硬件适配性,如 TensorFlow Lite、Core ML、Paddle-mobile、NCNN、Caffe2go、TensorRT 等。
深度学习技术生态工具集
- 包括模型编译中间件、数据及模型表示格式、可视化工具、模型算法资源库、模型压缩优化工具等。
- 编译中间件(如 CUDA、Intel Inference Engine、NNVM/TVM)可提升模型在不同硬件平台上的适配性与性能。
- 数据表示格式(如 ONNX、NNEF)有助于模型跨框架迁移。
- 可视化工具(如 TensorBoard、VisualDL)提升了模型训练和调优的效率。
- 模型压缩优化工具(如 PocketFlow)可显著减少模型体积,提升推理效率。
关键信息
训练框架选型指标
- 生态建设:支持多种语言、丰富的文档及教程、活跃的开发者社区。
- 易用性:模型复用性、高级语言支持、自定义扩展能力、跨平台部署、模型库支持。
- 性能:模型运行表现、并发性、稳定性、特征规模处理能力、硬件加速支持。
- 支持架构:对 CPU、GPU、FPGA 等硬件的支持情况。
- 安全性:模型加密、系统安全稳定性。
推断框架选型指标
- 易用性:模型加载与转换、支持的平台、通用模型表示。
- 性能:推断速度、启动时间、系统资源占用、功耗。
- 底层优化:对不同硬件的支持(如 GPU、FPGA)、指令集优化。
- 安全稳定性:模型加密、框架稳定性。
产业优秀使用案例
- TensorFlow:用于构建大规模训练系统及智慧城市交通系统,显著提升交通效率与碳排放控制能力。
- Keras:在智能化运维中表现突出,极大缩短模型开发时间。
- PaddlePaddle:在多种业务部署中展示出灵活性与高性能,适用于图像识别、广告推荐等场景。
- Caffe:在目标检测领域表现优异,支持多种模型格式转换及优化。
趋势展望
- 安全性问题:需加强数据安全处理机制。
- 资源共享问题:封装后的资源需实现更高效的共享机制。
- 数据前处理:现有框架对工业数据前处理支持不足。
- 运算效率问题:需提升分布式训练的线性加速比。
- 定制化需求:工业场景对定制化框架支持要求较高。
- 工程化特性缺失:当前框架在测调、训练、可视化、推断预测等功能方面存在不足。
- 中间表示层标准缺失:各硬件厂商的中间表示层未形成统一标准,影响模型迁移与部署效率。
合作机构
本白皮书由以下单位共同起草或支持:
- 中国信息通信研究院
- 中兴通讯股份有限公司
- 华为技术有限公司
- 杭州海康威视数字技术股份有限公司
- 北京百度网讯科技有限公司
- 中国移动通信有限公司
- 中移物联网有限公司
- 中国电信股份有限公司
- 中国联合网络通信有限公司
- 航天云网科技发展有限责任公司
- 小米科技有限责任公司
- 中国航天科工集团第三研究院第三总体设计部
展开完整摘要
试读结束,高清完整版pdf/doc/ppt,请点下载