包含如下功能: 1. 转换视频文件格式 2. 提取音频信息 3. 识别说话人声音,并分割音频 4. 定义音频段落分割与合并策略,并相应合并 5. 音频识别为文字 6. 根据提取的时间信息,对应显示在相应的视频画面上
1. 研究实例分割领域的最新进展和候选模型 2. 研究Kaggle社区论坛中分享的模型代码,复现训练结果 3. 从多个模型代码中,选择可能更适用该场景的模型代码 4. 修改模型和参数,调试,确认提升效果
包含如下功能: 1. 转换视频文件格式 2. 提取音频信息 3. 识别说话人声音,并分割音频 4. 定义音频段落分割与合并策略,并相应合并 5. 音频识别为文字 6. 根据提取的时间信息,对应显示在相应的视频画面上...
1. 研究实例分割领域的最新进展和候选模型 2. 研究Kaggle社区论坛中分享的模型代码,复现训练结果 3. 从多个模型代码中,选择可能更适用该场景的模型代码 4. 修改模型和参数,调试,确认提升效果...
添加客服微信,免费为您安排与该工程师直接沟通
长按二维码添加客服微信
如该工程师当前档期不合,也可免费为您推荐相似候选人