项目简介:自动识别视频语音 → 翻译成目标语言 → 生成字幕并直接烧录进视频的本地网页工具。
职责:
搭建完整处理流水线:ffmpeg 提取音轨 → faster-whisper 带时间戳听写 → LLM 翻译 → 生成 `.srt` → ffmpeg 烧录字幕,全流程进度上报 + 可取消
翻译质量优化**:整段字幕带时间戳一次性喂给 LLM(上下文喂法),而非逐句翻译;支持自动提取术语表
长视频分块翻译架构:每块 ≤120 行,术语表一趟 + 相邻块末尾 2 行上下文传递,单块失败保留原文并累计告警
字幕后处理:按目标语言阅读时长自动拆分长行、合并短行(CJK 按字符、西文按单词),修正时间轴错位
多档 Whisper 模型本地化(small / medium / large-v3),识别 16 种语言
部署:Windows 本地 + 云电脑,frp 隧道 + Nginx 公网穿透,nssm 服务自启
需求方专属客服,免费梳理匹配
添加客服微信,免费为您安排与该工程师直接沟通
长按二维码添加客服微信
如当前档期不合,也可免费为您推荐相似案例作者