1. 端侧实时语音识别:负责算法设计与软件开发,完成模型训练、ONNX优化、C++解码及设备部署。在项目测试条件下,信噪比-5~15dB时识别准确率超过95%,响应延迟低于200ms。
2. 高分辨率图像生成与训练优化:参与可控图像生成算法研发,完成生成流程实现、效果验证及训练性能优化。通过并行计算与显存优化,显存占用降低约30%,训练吞吐提升至原来的1.3~1.5倍。
3. 大模型推理质量优化:设计推理阶段的自适应输出分布调整方案,无需更新模型参数,改善数学推理与文本生成表现,完成算法实现及多组基准对比验证。