AI智能语音识别标注系统。系统开发初衷是为了提高音转字模型的准确率。
系统功能包括:上传音频。模型转译文本。对文本进行改正并提交。经过检验人员校验后通过最后提交。系统将最后结果传输给转译模型进行训练。
系统使用springboot mvc框架开发,个别模块以微服务实现。
采用分布式集群架构,nginx实现负载均衡。
数据库主从读写分离,并通过keepalive实现高可用。
数据过亿的表进行分区处理。并通过临时表或归档来降低实时业务表压力。
系统任务通过消息中间件rabbitmq队列化。
高并发任务领取与重复数据的访问,通过redis进行优化。
后台离线任务使用线程池多线程执行。
接收音频文件后基于python应用傅里叶对音频降噪。
系统日志使用es存储。