
Conceptual-Captions数据集:用于训练和评估图像字幕系统的(图像URL,字幕)对集合
5星
- 浏览量: 0
- 大小:None
- 文件类型:None
简介:
Conceptual-Captions数据集是由一系列(图像URL, 字幕)对组成,旨在为图像字幕系统提供训练与评估的资源。
概念字幕数据集是由图像URL与字幕配对组成的数据集合,旨在训练及评估机器学习的图像描述系统。自动图像字幕的任务是生成能够准确反映图片视觉内容的自然语言(通常是句子)。迄今为止,最常用于此任务的资源包括一个包含大约120,000张图片和5种不同标题注释的数据集。而Google发布的“概念字幕”数据集则包含了超过300万张图像及其相应的自然语言描述。
相较于MS-COCO中精选出的图片,Conceptual Captions中的图像及原始描述是从网络上收集而来,因此它们代表了更加多样化的内容和风格。这些原初描述信息直接来源于与网页图片关联的Alt-text HTML属性。我们设计了一套自动流程来提取、筛选并转换候选的图/字幕对,以确保最终生成的字幕在清洁度、信息量、流畅性及可学习性之间达到最佳平衡。
更多关于此数据集的具体细节可以参考相关文献或资料。
全部评论 (0)
还没有任何评论哟~


