1. 多模态内容检索系统,利用文字,语音,图片等特征,高效检索所需内容,能够实时处理及应用,主要涉及技术为:人脸检测与识别,语音识别及音频指纹检索, 图片多特征检索(以图搜图),高性能索引,图片分类与识别,视频分类,并行优化,深度学习等
2. 特效及美颜:研发的视频特效,美颜,立体声特效,音频特效(变速,变调等),效果新颖突出,有利支持了非线性编译系统,秀场等客户端软件;
3. 移动端算法:准确率高,实时效果好;模型压缩,代码及模型占用体积小,占用资源少;方便移动端应用
4. 图片助手:高精度的图片分类技术,视频识别技术,有效管理设备上大量的照片及视频,方便查找
5. 缺陷检测:高效检测工业产品表面缺陷,例如钢铁,为流水线决策提供依据,节省人力,提高产品线效率
6. 监控系统: 通过检测识别技术,记录考勤,监控识别学生行为;识别公交车客流量
7. 文字识别:识别答题卡,并给出结果;识别检测各类票据,卡片,方便存储与记录;识别电子版笔记,转化为文字
8.场景识别,视频行为识别,车辆车牌等目标检测,日常物体检测与跟踪,logo识别
9.ffmpeg高效快速解码,gpu及cuda技术开发