融合声纹平台
项目背景:微服务+容器化部署项目,基于k8s私有化部署的公安专网内部平台,提供音频文件上传,搜索,声纹识别,告警,多算法引擎比对鉴别等功能
负责音频声纹注册模块的设计和开发,使用cgo封装底层AI算法接口,基于分发成功的数据实现声纹生成逻辑
负责重构数据分发模块的设计和开发,使用了rabbitmq实现了分发失败延时重分发,成功日处理20万导入音频,失败记录追踪
负责向量搜索模块的设计和开发,使用elasticsearch向量搜索特性实现平台的多条件筛选声纹的功能
技术栈:react,go,gin,grpc,openapi,rabbitmq,mongo,elasticsearch
智能语音平台
项目背景:单体化+容器化部署项目,基于k8s私有化部署的公安专网内部平台,对导入音频的说话人声自动分离,实现以音搜音和ASR转写
负责以音搜音模块的设计和开发,使用temporal工作流引擎处理以音搜音过程中的的前置处理,封装调用已有的语种识别,性别别识别,自然语言处理,声纹生成api接口等,实现以音频搜索音频
技术栈:react, go,gin,openapi,temporal,mysql,elasticsearch