
RefCOCOg:用于指称表达理解的常用数据集
5星
- 浏览量: 0
- 大小:None
- 文件类型:ZIP
简介:
简介:RefCOCOg是一款广泛应用于指称表达理解和视觉语言任务的数据集,基于COCO图片库,包含丰富的图像描述和对象标注信息。
在数据集的标注方式上:
RefCOCOg使用非交互式方法进行标注;即先选定区域让参与者描述,再请另一批人根据这些描述选择对应的图像区域。
而RefCOCO及RefCOCO+则采用双人游戏(Refer it game)的方式。
在数据集的划分方式上:
RefCOCO和RefCOCO+分为训练、验证、测试A和测试B四个部分,其中测试A包含多个人物的图片;测试B则包括多个非人物物体。同一张图像中的对象-描述对要么全部属于训练集合,要么完全位于验证或测试集中。
相比之下,RefCOCOg的数据集被划分为训练、验证及测试三类,并且是基于对象来进行划分的,这意味着同一个图中不同对象-描述组合可能分别出现在不同的数据子集中。
在图像选择标准上:
对于RefCOCO来说,其图像需要包含同一类别下的多个物体。
而在RefCOCO+中,则进一步限制了表达式不能含有绝对位置(例如“左边”)的词汇。
至于RefCOCOg,它要求每张图片必须有2到4个同种类别的对象,并且这些对象在图中的覆盖面积需达到至少5%。
全部评论 (0)
还没有任何评论哟~


