设计视频文本多模态预训练模型。使用亿级视频文本数据进行3预训练,在视频检索、视频字幕生成等多个任务多个学术数据集上达到当时的最高性能。预训练模型应用于腾讯短视频相关业务(QQ看点,微信),分类与搜索准确率获得提升。
程序的主要功能是把低分辨率、模糊的图片和视频提高分辨率与去模糊 设计模型,PyTorch训练,用CUDA C++进行模型重构,生成图像质量与其它商用软件处于相当的水平,但处理速度大幅优化,极其适用于大量视频的批量修复、去模糊、提升分辨率等 方案已加入GitHub 6K+星的开源项目中
设计视频文本多模态预训练模型。使用亿级视频文本数据进行3预训练,在视频检索、视频字幕生成等多个任务多个学术数据集上达到当时的最高性能。预训练模型应用于腾讯短视频相关业务(QQ看点,微信),分类与搜索准确率获得提升。...
程序的主要功能是把低分辨率、模糊的图片和视频提高分辨率与去模糊 设计模型,PyTorch训练,用CUDA C++进行模型重构,生成图像质量与其它商用软件处于相当的水平,但处理速度大幅优化,极其适用于大量视频的批量修复、去模糊、提升分辨率等 方案已加入GitHub 6K+星的开源项目中...
添加客服微信,免费为您安排与该工程师直接沟通
长按二维码添加客服微信
如该工程师当前档期不合,也可免费为您推荐相似候选人