独立完成架构设计、前后端开发与语音服务改造,交付可私有化部署的实时语音对话系统:
· 打通「麦克风→ASR→大模型→TTS→播放」全链路,端到端实测通过,单句合成 2.8~4.1 秒。 ·引擎可插拔:本地模型共存,缺依赖自动跳过、服务照常启动。 ·接口改为 /asr/{provider}、/tts/{provider} 路径路由,加引擎只改配置。 · 配置环境变量化,一份配置适配本机/服务器/容器;提供 Docker 一键启动与自检命令。 · 清理重复实现净减 129 行,修复 3 类启动与连接故障。