浮尘-的案例列表

作者:浮尘- · 共 2 个案例

智能体管理平台

【私有化实时语音对话系统】全栈开发 一套完全私有化部署的实时语音对话系统,把「语音 → 文字 → 大模型 → 语音」整条链路打通,秒级响应、数据不出内网。 技术栈:Vue 3 + TypeScript + Element Plus;Java 21 + Spring Boot 3 + MyBatis-Plus + MySQL + Redis;Python + FastAPI,接入流式 ASR、多音色 TTS 与 VAD,自研 Opus 编解码。 我独立负责架构设计、前后端开发与语音服务改造。引擎做成可插拔:多种 ASR / TTS / VAD 共存,缺依赖自动跳过、服务照常启动

大模型本地部署和微调

本作品完成开源大模型本地部署与 LoRA 微调全流程。基于 Qwen 基座模型,搭建 Linux 环境,利用 FlashAttention 加速推理,采用 QLoRA 参数高效微调,使用私有领域数据集训练,完成模型量化、接口封装与 Web 交互服务。整套方案离线运行,数据不外流,适配单卡 GPU,可快速定制专属领域大模型,适合企业私有化问答场景。

案例判断参考

程序员兼职平台怎么选 程序员平台对比怎么看 企业找程序员外包避坑

浮尘-的案例列表

智能体管理平台

【私有化实时语音对话系统】全栈开发 一套完全私有化部署的实时语音对话系统,把「语音 → 文字 → 大模型 → 语音」整条链路打通,秒级响应、数据不出内网。 技术栈:Vue 3 + TypeScript + Element Plus;Java 21 + Spring Boot 3 + MyBatis-Plus + MySQL + Redis;Python + FastAPI,接入流式 ASR、多音色 TTS 与 VAD,自研 Opus 编解码。 我独立负责架构设计、前后端开发与语音服务改造。引擎做成可插拔:多种 ASR / TTS / VAD 共存,缺依赖自动跳过、服务照常启动...

大模型本地部署和微调

本作品完成开源大模型本地部署与 LoRA 微调全流程。基于 Qwen 基座模型,搭建 Linux 环境,利用 FlashAttention 加速推理,采用 QLoRA 参数高效微调,使用私有领域数据集训练,完成模型量化、接口封装与 Web 交互服务。整套方案离线运行,数据不外流,适配单卡 GPU,可快速定制专属领域大模型,适合企业私有化问答场景。...

案例判断参考

程序员兼职平台怎么选 程序员平台对比怎么看 企业找程序员外包避坑
查看简历
微信沟通 客服 看中这位工程师了?客服帮你 1 小时对接沟通 → ×