280万样本！谷歌开放史上最大分割掩码数据集，开启新一轮挑战赛

2019 年 5 月 10 日 极市平台

加入极市专业CV交流群，与6000+来自腾讯，华为，百度，北大，清华，中科院等名企名校视觉开发者互动交流！更有机会与李开复老师等大牛群内互动！

同时提供每月大咖直播分享、真实项目需求对接、干货资讯汇总，行业技术交流。点击文末“阅读原文”立刻申请入群~

乾明发自凹非寺
量子位报道 | 公众号 QbitAI

谷歌的图像数据集Open Images又升级了！

这次，他们在注释集中加入分割掩码（segmentation masks），样本规模达到280万，横跨350个类别。

谷歌说，这些掩码覆盖的对象类别和数量，比其他任何数据集都要多。

根据Google AI博客消息，这一版本的数据集被命名为Open Images V5，现在已经对外开放。

同时，谷歌也宣布将在ICCV 2019上开启第二届挑战赛Open Images Challenge。与之前相比，这次挑战赛增加了新的实例分割（Instance Segmentation）赛道。

谷歌表示，提供大型和多样化的训练数据集，希望能够激发大家对更高级的实例分割模型的研究。

280万样本，横跨350个类别

与之前各个版本的Open Images数据集相比，V5版本新增了对图像分割掩码的注释。对象样本达到了280万个，覆盖350个类别。

而且，与仅仅识别对象所在区域的边界框不同，图像分割掩码会标记目标对象的轮廓，在更高的细节水平上表征它们的空间范围。

谷歌说，在这个数据中，他们努力确保不同对象之间的注释一致。

比如说，所有猫的掩码都会包括尾巴；骆驼上的袋子，也会包含在其掩码中。下图，就是Open Images V5训练集中一些掩码的示例：

训练集中，一共包括268万个样本，分割掩码是由谷歌的交互式分割过程产生的，并通过专业的人工注释来不断校正分割神经网络的输出。

谷歌表示，这比单独的手动绘图更加有效，给出掩码平均精度能达到84%。

验证集和测试集中，一共有近10万掩码。这些掩码都是由人工标注，非常注重质量。他们在博客中说，这些掩码近乎完美，甚至捕捉到了复杂物体边界的细微细节。

谷歌认为，与大多数现有数据集提供的多边形标注相比，他们的训练集和验证+测试集提供了更精确的对象轮廓，下图是Open Images V5验证集中一些掩码的示例：

除了掩码，在这次对Open Images数据集的升级中，谷歌还增加了640万个经过人工验证的图像级标签。整体达到3650万，类别覆盖近20000个。

而且，他们还改进了验证集和测试集中600个对象类比的注释密度，添加了超过40万个边界框来匹配训练集中的注释密度，来确保能够更精确地评估目标检测模型。

目前，数据集已经开放下载，如果你有兴趣，请收好下面的传送门：

https://storage.googleapis.com/openimages/web/download.html

Open Images挑战赛

与此同时，谷歌还宣布，将在2019年的国际计算机视觉大会（ICCV）上，开启新一届的Open Images Challenge。基于Open Images V5的发布，挑战赛中增加了实例分割赛道。

此外，这一挑战赛中还有其他两个赛道：

大规模的目标检测，预测500个类别中所有对象样本周围的边界框。
视觉关系检测，检测特定关系中的目标对。

现在，包含所有注释的数据集已经可以获取。

测试集包括10万张图片，其中用于目标检测和视觉关系检测的数据集将于2019年6月3日在Kaggle上开放，用于实例分割的数据集将在7月1日开放。

如果你对这一挑战赛感兴趣，一定要记住下面的整个时间点：

提交结果的截止时间是2019年10月1日。

Open Images Challenge官方地址：

https://storage.googleapis.com/openimages/web/challenge2019.html

关于Open Images

Open Images是谷歌在2016年推出的大规模图像数据集，包括大约900万张图片，标注了数千个图像类别。

2018年，谷歌开放Open Images V4，增加了1540万个用于600个对象类别的边界框，以及30万个视觉关系注释，使其成为现有最大的带有目标位置注释的数据集。同时，谷歌也开始基于Open Images数据集发起挑战赛。

*延伸阅读

点击左下角“阅读原文”，即可申请加入极市目标跟踪、目标检测、工业检测、人脸方向、视觉竞赛等技术交流群，更有每月大咖直播分享、真实项目需求对接、干货资讯汇总，行业技术交流，一起来让思想之光照的更远吧~

觉得有用麻烦给个好看啦~

登录查看更多

相关内容

掩码

关注 1

【Google】监督对比学习，Supervised Contrastive Learning

专知会员服务

72+阅读 · 2020年4月24日

Google 发布图片配对基准及挑战：从系列图像重建三维物体和建筑物

专知会员服务

39+阅读 · 2020年4月4日

【CVPR2020】从未标记的视频中学习视频对象分割，Learning Video Object Segmentation from Unlabeled Videos

专知会员服务

34+阅读 · 2020年3月12日

谷歌提出“T5” 新NLP模型，突破迁移学习局限，多基准测试达SOTA！

专知会员服务

40+阅读 · 2020年2月26日

图像分类最新技术综述论文: 21种半监督、自监督和无监督学习方法一较高低

专知会员服务

182+阅读 · 2020年2月22日

斯坦福大学李飞飞组发布Action Genome:一种新的表达形式，新的数据集，以及将动作分解成时空场景图的新模型

专知会员服务

39+阅读 · 2020年1月12日

【浙江大学】对抗样本生成技术综述

专知会员服务

89+阅读 · 2020年1月6日

【Google&Waymo】自动驾驶感知的可扩展性:Waymo开放数据集，23位学者联名出品

专知会员服务

12+阅读 · 2019年12月18日

【论文】自训练噪声student模型提高ImageNet分类准确率（Self-training with Noisy Student improves ImageNet classification），谷歌研究科学家Quoc V. Le等

专知会员服务

23+阅读 · 2019年11月20日

西北工业大学发布最新遥感图像目标检测综述论文和Benchmark，带你全面了解遥感图像检测方法

专知会员服务

77+阅读 · 2019年10月12日

谷歌更强 NLP 模型 XLNet 开源：20 项任务全面碾压 BERT！

雷锋网

5+阅读 · 2019年6月20日

63万张！旷视发布最大物体检测数据集Objects365，物体检测竞赛登陆CVPR

极市平台

4+阅读 · 2019年4月19日

竞赛 | 旷视发布通用物体检测数据集 Objects365，开启 CVPR 物体检测挑战赛

AI科技评论

5+阅读 · 2019年4月17日

告别数据集资源匮乏，谷歌与斯坦福大学用弱监督学习给训练集打标签

量子位

8+阅读 · 2019年3月23日

DeepFashion2数据集：87.3万对买家秀-卖家秀图像+海量标注

极市平台

5+阅读 · 2019年2月12日

谷歌发布问答系统新语料，同时发布相关挑战赛

AI研习社

4+阅读 · 2019年2月10日

全景分割这一年，端到端之路

机器之心

14+阅读 · 2018年12月24日

谷歌发布最大图像标注数据集，190 万张图片开启公开图像挑战赛

AI研习社

7+阅读 · 2018年5月1日

谷歌放大招！全自动训练AI无需写代码，全靠刚发布的Cloud AutoML

量子位

3+阅读 · 2018年1月17日

900万张标注图像，谷歌发布Open Images最新V3版

AI100

3+阅读 · 2017年11月21日

Learning Dynamic Routing for Semantic Segmentation

Arxiv

8+阅读 · 2020年3月23日

S4Net: Single Stage Salient-Instance Segmentation

Arxiv

10+阅读 · 2019年4月10日

UPSNet: A Unified Panoptic Segmentation Network

Arxiv

3+阅读 · 2019年1月12日

Auto-DeepLab: Hierarchical Neural Architecture Search for Semantic Image Segmentation

Arxiv

5+阅读 · 2019年1月10日

Conditional BERT Contextual Augmentation

Arxiv

8+阅读 · 2018年12月17日

ShelfNet for Real-time Semantic Segmentation

Arxiv

7+阅读 · 2018年12月10日

Panoptic Segmentation with a Joint Semantic and Instance Segmentation Network

Arxiv

5+阅读 · 2018年9月6日

Agile Amulet: Real-Time Salient Object Detection with Contextual Attention

Arxiv

5+阅读 · 2018年2月20日

Mask R-CNN

Arxiv

7+阅读 · 2018年1月24日

Recurrent Instance Segmentation

Arxiv

5+阅读 · 2016年10月24日

VIP会员

280万样本！谷歌开放史上最大分割掩码数据集，开启新一轮挑战赛

乾明发自凹非寺
量子位报道 | 公众号 QbitAI

280万样本，横跨350个类别

Open Images挑战赛

关于Open Images

结构化数据的迁移学习：嫁接学习（分享竞赛大牛经验技巧）

竞赛推荐 | CVPR 2019 十大细粒度视觉识别挑战赛来袭，谷歌发来参赛征集令！

竞赛推荐 | 快手 ICIP2019 移动视频修复挑战赛

竞赛推荐 | DAVIS Challenge：视频目标分割挑战赛（CVPR2019）

相关内容

280万样本！谷歌开放史上最大分割掩码数据集，开启新一轮挑战赛

乾明 发自 凹非寺 量子位 报道 | 公众号 QbitAI

280万样本，横跨350个类别

Open Images挑战赛

关于Open Images

结构化数据的迁移学习：嫁接学习（分享竞赛大牛经验技巧）

竞赛推荐 | CVPR 2019 十大细粒度视觉识别挑战赛来袭，谷歌发来参赛征集令！

竞赛推荐 | 快手 ICIP2019 移动视频修复挑战赛

竞赛推荐 | DAVIS Challenge：视频目标分割挑战赛（CVPR2019）

相关内容

乾明发自凹非寺
量子位报道 | 公众号 QbitAI