2021-08-26-阿里巴巴-阿里视觉AI开放之路_从公共云走向端云协同_31页_17mb
报告摘要
阿里视觉AI开放之路总结
核心内容
阿里视觉AI开放平台致力于实现“让天下没有难用的AI”,通过平台化和开放化的方式,将先进的视觉AI技术提供给更多开发者和用户。平台从公共云走向端云协同,构建了覆盖视觉基本面的多样化、多粒度、标准化的能力体系,支持从文字识别、图像理解到视频处理、3D视觉等多个领域。
主要观点
- 平台化目标:提供全面、专业、易用、低成本的视觉AI能力,降低技术门槛,提升使用效率。
- 供需矛盾解决:通过提供全生命周期的能力体验和使用流程,以及工具优化,缩短供给与需求之间的差距。
- 端云协同框架:发布OpenSDK,实现端侧与云端的协同,提升AI应用的实时性、效率和隐私保护。
关键信息
平台特性
- 开放:支持多种平台和设备,包括Android、iOS、RK/海思系列等。
- 普惠:提供定额免费和高性价比的商用能力,满足中小用户和企业的需求。
- 生态:构建中长尾AI用户和开发者的机会之地,推动AI技术的广泛应用。
能力分类
- 能力大类:包括文字识别、内容审核、图像理解、分割抠图、视觉生产、视频理解、视觉搜索、3D视觉、行业视觉能力等。
- API能力:超过200个API,支持多种应用场景,如视频会议虚拟背景、老片修复、机器修图等。
- SDK能力:提供本地部署和云API调用的解决方案,支持多端兼容。
OpenSDK 1.0
- 技术架构:包括端侧任务框架、端侧训练框架、工作台与基础设施等模块。
- 核心特征:支持30FPS实时处理、1080p高清视频增强、低功耗长续航、云端一体适配等。
- 能力示例:
- 分割:支持大图实时处理,覆盖低端设备。
- 增强:包括通用超分、人像修复、智能调色、顺滑插帧等。
- AI体育:基于关键点和人体姿态估计,实现体育动作自动计数和姿态匹配打分。
应用场景
- 机器修图:全自动、高品质、智能化、低成本,适用于面部/身体液化、肤质优化等。
- 智能存储:支持大规模数据处理,实现TB级数据的准实时处理。
- 体育动作计数:支持15种常见健身动作,准确度超过95%,适用于乐动力、健身镜等场景。
- 姿态匹配打分:支持高精度识别和鲁棒性处理,适用于动作纠正等场景。
平台演进
- 1.0版本:上线vision.aliyun.com,提供基础能力中心。
- 2.0版本:官网升级,部分能力商业化,开发者体验中心和数据评测中心上线。
- 3.0版本:官网重构,能力中心优化,SDK能力上线,场景实验室和行业能力中心上线。
未来展望
- AI平台演进:持续优化平台能力,提升用户体验,推动AI技术的普及和应用。
- AI生态构建:打造AI流量入口和开发者阵地,支持中长尾用户和企业的发展。
- AI机制创新:探索市场驱动的AI研发和使用模式,推动在线高效的AI能力进化。
总结
阿里视觉AI开放平台通过不断演进和优化,实现了从公共云到端云协同的转变,提供了全面、易用、低成本的视觉AI能力。平台不仅支持多种应用场景,还通过OpenSDK等技术手段,提升了AI应用的实时性、效率和隐私保护。未来,平台将继续推动AI技术的普及和应用,构建更完善的AI生态。
展开完整摘要
试读结束,高清完整版pdf/doc/ppt,请点下载