项目一:行业语音识别模型微调与优化
基于 PyTorch、FunASR、Paraformer 开展行业语音识别模型适配,负责语音数据预处理、训练集构建、模型微调及识别效果评估,探索 Encoder 冻结与 LoRA 参数高效微调方案,结合领域热词及文本后处理优化专业术语识别效果。
项目二:大语言模型推理部署与性能优化
基于 Qwen、vLLM、Ollama、Docker 搭建大模型推理服务,负责量化模型选型、GPU 显存配置、推理接口封装及性能测试,支持 OpenAI 兼容 API 调用与私有化部署。
项目三:RAG 智能检索与大模型文本分析
基于 Qwen、BGE-M3、Milvus、FastAPI 构建智能文本分析系统,负责文本向量化、语义检索、问题聚类及大模型结构化输出,实现多文档知识检索与内容一致性分析。