弱监督视觉定位

人工智能 其他 案例ID:225530
Know yourself
1 年经验· 腾讯
微信扫码沟通,客服可协助直接对接工程师;如当前档期不合,也可继续推荐相似案例作者。

案例介绍

任务目标:弱监督视觉落地旨在仅有图像-文本对而没有目标物体位置标注的条件下,定位到与自然语言查询最相关的目标物体。
1. 通过多模态预训练模型为物体框生成伪查询,并利用伪查询与真实查询之间的单模态相似度为样本生成更高质量的伪标签
2. 引入外部多模态大模型抑制噪声对模型训练的影响
3. 在公共的5个数据集上均取得了SOTA的表现

弱监督视觉定位

人工智能 · 其他 案例ID:225530
联系该工程师
微信扫码,建群沟通
作者: Know yourself - 1年经验- 腾讯

案例介绍

任务目标:弱监督视觉落地旨在仅有图像-文本对而没有目标物体位置标注的条件下,定位到与自然语言查询最相关的目标物体。
1. 通过多模态预训练模型为物体框生成伪查询,并利用伪查询与真实查询之间的单模态相似度为样本生成更高质量的伪标签
2. 引入外部多模态大模型抑制噪声对模型训练的影响
3. 在公共的5个数据集上均取得了SOTA的表现

相似案例推荐

  • UI设计

    UI设计

    从早期的平面设计到如今的界面设计,我见证了互联网产品从简单到

  • 立体视觉

    立体视觉

    这个项目是一个完整的3D点云处理系统,涵盖了从图像采集到点云

  • Clipto

    Clipto

    内容: 本产品提供Ai转录功能,youtube下载,可以帮

  • IDC设备管理系统

    IDC设备管理系统

    对IDC设备进行统一数字化管理,涉及IDC机房、机柜、设备等

  • AI智能中枢底座与行业化模型应用平台

    AI智能中枢底座与行业化模型应用平台

    AI私有化智能中枢底座: 数据集成与治理: 提供安全可控的

  • 爬虫

    爬虫

    该项目通过 Selenium 和 BeautifulSoup

发布任务

企业点击发布任务,工程师会在任务下报名,招聘专员也会在 1 小时内与您联系确认。

1小时精推人才

需求方专属客服,免费梳理匹配

需求方客服微信二维码
扫码加微信 · 客服人工对接
更多案例
微信沟通 客服 看中这位工程师了?客服帮你 1 小时对接沟通 → ×