2017-36Kr:计算机视觉行业研究报告_41页_3mb
报告摘要
计算机视觉行业研究报告总结
核心内容
计算机视觉是人工智能的重要组成部分,旨在让机器模拟人类视觉系统,实现物体识别、形状与方位确认、以及运动判断等功能。它与语音识别、语言识别共同构成了人工智能的感知智能,为机器提供“看”和“认知”的能力,使其能够完成复杂的任务和决策。
主要观点
-
行业驱动因素:计算机视觉的发展依赖于数据量、运算力和算法技术三大要素。
- 数据量:2000年后,随着互联网、社交媒体和移动设备的发展,数据量急剧增加,为深度学习算法提供了丰富的训练素材。
- 运算力:GPU的出现极大提升了数据处理速度,使深度学习成为可能。随着AI-PU等专用芯片的发展,运算效率将进一步提升。
- 算法技术:深度学习算法极大提高了视觉识别的准确率,从70%提升至95%以上。相比传统神经网络,深度学习具有更强的自学习能力,能适应更复杂的场景。
-
政策法规支持:各国政府积极出台政策支持人工智能发展,特别是在安防、交通和金融领域。中国自2015年起陆续发布多项政策,推动计算机视觉技术的应用。
-
投资热度:全球和中国对计算机视觉的投资热度持续上升。2016年Q1数据显示,计算机视觉领域公司数量约为180家,融资额约16亿美元。
-
市场规模:2015年,中国人脸识别市场约70亿元,视频监控市场约200亿元。随着技术的发展,市场潜力巨大。
关键信息
技术流程
计算机视觉识别通常包含三个步骤:目标检测、目标识别、行为识别。
- 目标检测:从背景中提取感兴趣的目标,解决“去背景”的问题。
- 目标识别:判断目标是什么,涉及图像信息提取和分析。
- 行为识别:识别目标在视频中的行为,解决“干什么”的问题。
应用场景
-
生物特征识别:
- 技术较为成熟,主要应用于身份鉴定。
- 指纹识别普及率最高,但市场份额呈下降趋势。
- 人脸识别因非接触性、非强制性和高并发性,成为主流。
-
光学字符识别(OCR):
- 技术成熟,但照片中多字符文本识别仍是难点。
- 主要应用于证件识别、单据识别等场景,提升信息录入效率。
-
物体与场景识别:
- 技术仍处于早期阶段,多数公司专注于数据标注。
- 应用于军事、医疗、工业、消费生活等多个领域。
-
视频对象提取与分析:
- 基于动态图像识别,需处理光线、遮挡等干扰。
- 应用于监控系统、行为识别和电商营销等领域。
产业链
计算机视觉产业链分为三部分:
- 基础支撑层:包括芯片(CPU、GPU)和初级算法提供商(如Google、Microsoft)。
- 技术提供层:包括图像识别平台(如Face++)和嵌入式视觉软件。
- 场景应用层:包括门禁、监视、搜索引擎、视频分析等具体应用系统和终端产品。
商业模式
- 软件服务:提供在线API、离线SDK、私有云服务等,主要面向ToB和ToB-to-C市场。
- 软硬件一体解决方案:通过硬件与软件结合,满足特定应用场景需求,具有更高的技术壁垒和商业化潜力。
行业竞争
- 工业巨头:如海康威视、美的集团,具有全产业链布局和强渠道能力。
- 互联网巨头:如Google、Facebook、百度,拥有顶尖技术团队和大量数据资源。
- 创业公司:如旷视科技、商汤科技、依图科技等,专注于特定领域,如人脸识别、车辆识别、医疗影像识别等。
技术趋势
- 智能前端化:随着对实时响应的需求增加,智能前端化成为趋势,提升识别速度和处理能力。
- 深度学习应用:深度学习技术在计算机视觉中的应用持续深化,推动技术进步和商业化落地。
- 芯片发展:低功耗、高性能的AI-PU等专用芯片将成为计算机视觉领域的重要支撑。
行业思考
- 软硬件一体更具竞争力:仅靠软件难以满足复杂应用场景的需求,软硬件结合能提供更高效、更精准的解决方案。
- 应用场景探索:尽管人脸识别已成主流,但机器人视觉、无人机视觉等新兴领域仍待深入探索。
- 商业化挑战:创业公司需加快技术商业化,提升市场竞争力,以应对激烈的行业竞争。
展开完整摘要
试读结束,高清完整版pdf/doc/ppt,请点下载