主要基于现在主流的语言文本大模型进行微调用于人脸欺诈检测,chatgpt的基础CLIP模型的使用和部署,目前已经成功部署到产品上,和相关银行有合作
基于深度学习目标定位到穿戴式导盲系统 基于yolov3目标检测网络搭建轻量化网络部署到可穿戴设备TX-2上,实现便携导盲系统,功能包括场景识别,场景描述,语音播报,智能识物等功能,有一篇论文和两个专利授权
我们正在建设的视频篡改检测数据库(Video Forgery Detection Database, VFDD)相关工作.针对视频篡改以及篡改检测方法的技术特点,VFDD库在设计时充分考虑了不同的视频场景及拍摄条件,所采用的拍摄设备也多样,目前已经包括不同型号的数码摄像机、监控摄