云识图亮相VALSE 2017年度研讨会
4月21日~4月23日,由厦门大学承办的2017年度视觉与学习青年学者研讨会在美丽的鹭岛厦门成功举办。本次研讨会期间,北京云识图信息技术有限公司(简称云识图)在大会上作了“云识图的AI之路”的宣讲报告,重点介绍了该公司基于深度学习的人工智能认知平台Lava++,并在会场展示了多项垂直应用领域中的核心技术。

云识图是一家专注图像认知与视频理解的人工智能科技公司,于2014年1月在北京中关村成立,在上海设有子公司。云识图成立三年以来,潜心人工智能核心技术的研发。但直到本次亮相VALSE 2017研讨会,才向大众以及视觉领域的专家学者、青年学生揭开了自己人工智能技术体系的神秘面纱。
人工智能认知平台Lava++
据介绍,云识图依托高性能计算环境,基于深度学习和大数据处理技术,研发了计算机视觉中的目标检测、物体分类、图片检索及目标跟踪等基础算法,并在此基础上构建了具备完全自主知识产权的人工智能认知平台Lava++。该平台不仅能够解决垂直应用领域中万种目标的大规模识别需求,也可以快速解决客户定制化识别需求。
目前LAVA++平台特色包括:完整的认知框架、并行分布式构架、多种认知模型的定制化组合以及分层流水线机制。Lava++平台完全符合人类认知过程。采用并行分布式架构的Lava++平台可以支持高性能计算资源的按需扩充。分层流水线机制,能够充分发挥平台计算资源的训练效率,保障多个训练任务的同步执行。

云识图的创始人兼CTO,袁国栋博士告诉记者。“成立三年来,基于Lava++平台,云识图在多个垂直应用领域开展了持续的基础研发,并且在以下领域取得不错的成绩。
平面物体识别:
具体识别门类包括葡萄酒酒标识别、汽车车型识别以及服饰识别等。在百万规模平面物体识别的准确率可达96%,响应时间可以做到2秒内;
刚性三维物体识别:
针对市场上常见的3000多款汽车的车型进行有效识别。虽然汽车是动态移动的,而且在不同的光线下颜色变化较大,但当时在实际应用测试部署阶段,识别准确率达到98.5%,随着系统不断的自学习,识别的准确率还有提升空间。
柔性三维物体等识别需求:
响应时间在1秒内;针对上衣、裙装、下装和包包等服饰类识别,单属性标签的准确率超过90%,在 实际应用在千万类别的检索库上,取得单次响应时间在2秒内的成绩。
袁国栋博士接着介绍,为了更好的优化Lava++实际工作的可靠性,让Lava++多种认知模型的定制化组合、分层流水线机制得到实际运营,并且在实际商业应用场景中组合多种认知模型以满足用户真实需求。
云识图联合知名啤酒品牌科罗娜 ,将Lava++应用在科罗娜啤酒的营销推广活动当中。科罗娜需要借助人工智能定制化系统,识别用户拍摄上传的图片中是否包含科罗娜酒瓶和logo,而且要准确识别出酒瓶的数量,以及图片中人物的数量、性别、年龄甚至表情。
“我们的工程师使用Lava++平台迅速将人脸检测模型、识别模型、性别与表情模型以及啤酒瓶和Logo的检测与多个识别模型, 有效的组合在一起实现快速部署。”在实际的运行过程中,Lava++出色表现让用户非常满意。袁博士表示:“此次与科罗娜的合作不仅让团队对平台的商业化运营充满信心,而且也开启了云识图商业化探索之路”。
云识图现已正式开启LAVA++人工智能平台商业化的探索
云识图在多项垂直应用领域中积累了大量核心技术,目前已实现在互联网图像识别、安防等领域的广泛应用和落地部署。

早在2015年3月云识图孵化出一个面向葡萄酒爱好者,让他们挑选葡萄酒更简单的APP应用,用户只需扫一扫红酒的正面酒标,即可秒得这款红酒的信息详情如:原产地、酒庄信息、国外当地的价格、用户评论等。我们团队将此APP命名为“拍酒”,Appstore上线至今已经获得200多万葡萄酒粉丝的青睐。每天有大量用户使用“拍酒APP”来购买喜欢的红酒,不经意之间,“拍酒”引领了葡萄酒类APP应用的新潮流。
在Lava++智能认知平台之上,云识图开发了面向高清监控视频的新一代Corsface人脸识别系统。与传统安防行业中图片级的静态人脸比对技术不同,云识图的动态人脸识别技术在万人规模下,识别准确率可达99.85%。该技术已在公安、广电等多个行业中被广泛采用。“这种被动的无感知的动态人脸识别系统,可以在用户经过摄像头时,不需要刻意去看摄像头的镜头,提升用户尊严。这在安检、门禁、身份验证等诸多应用领域带来革命性的变化。”
据悉,云识图在创立之初即获得业内知名投资机构数千万人民币的天使轮融资。公司创始团队来自清华大学计算机系,核心技术团队由来自国内、外著名高校和知名研究机构的模式识别、机器学习和视频处理等领域的科学家构成。目前,云识图团队正致力于通过图像认知和视频理解技术,解决人们生活当中的实际问题,让人工智能能够真正地服务于生活,给更多人带去舒适和便利。