能不能用GAN破解标注数据不足的问题呢

WpOh_rgznai100 2019-07-14 4944

电子说

1.2w人已加入

描述

在计算机视觉领域，深度学习方法已全方位在各个方向获得突破，这从近几年CVPR 的论文即可看出。

但这往往需要大量的标注数据，比如最著明的ImageNet数据集，人工标注了100多万幅图像，尽管只是每幅图像打个标签，但也耗费了大量的人力物力。

说到标注这件事，打个标签其实还好，如果是针对图像分割任务，要对图像进行像素级标注，那标注的成本就太高了。跟专业的标注公司打过交道的朋友都知道，打标签、标关键点和标像素区域，所要付出的成本可大不同。

在医学影像领域，图像数据往往难以获取，而这又是一个对标注精度要求极高的领域。

最近几年，以GAN为代表的生成模型经常见诸报端，那能否用GAN破解标注数据不足的问题呢？

最近发现一篇论文Generating large labeled data sets for laparoscopic image processing tasks using unpaired image-to-image translation，来自德国国家肿瘤疾病中心等单位的几位作者，提出通过GAN对计算机合成的人体腹腔镜图像进行转换的方法，能够大批量得到与真实图像相似的合成图像，并在器官分割实验中，大大改进了真实图像的分割精度。非常值得一读。

下面是作者信息：

计算机视觉