图像分割:

预测目标的轮廓。将不同的像素划分到不同的类别,非常细粒度的分类。

                

图像分割的应用场景

人像抠图,医学组织提取,遥感图像分析,自动驾驶,材料图像等。

               

图像分割的前景与背景

物体Things:可数前景目标(行人等)。

· 事物Stuff:不可数背景(天空,草地,路面)。

图像分割的三层境界

语义分割(semantic segmentation)每一个像素必须只能属于一类,预测结果为掩膜。

实例分割(instance segmentation)只预测前景目标的类别属性以及边框,个体ID,每一个像素可以属于多个ID。

全景分割(panoptic segmentation)每个像素点分配一个语义类别和一个唯一的实例ID。

                    

图像分割的数据集

VOC数据集:PASCAL VOC挑战赛(The PASCAL Visual Object Classes)是一个世界级的计算机视觉挑战赛。

       

从2007年开始引进了语义分割和实例分割的标注。

         

Cityscape数据集:50个城市在春夏秋三个季节不同时间段不同场景、背景的街景图。

                

语义分割和实例分割。

                

COCO数据集:以场景理解为目标,特别选取比较复杂的日常场景。

                   

数据集图像特点

               

图像分类精度相关指标:

PA(Pixel Accuracy):图像素分类精度。

 MPA(Mean Pixel Accuracy):每个类被正确分类的像素数的比例。

                               

IOU(Intersection over Union):前景目标的交并比。

MIOU(Mean Intersection over Union):每个类别的IOU的平均值。

FWLU(Frequency Weighted LU):根据每个类出现的概率给MLU赋权重计算的指标。

卷积模块和反卷积模块:

卷积模块:用于特征提取。

反卷积模块:用于上采样恢复到原始图像尺度。

卷积网络:编码器

反卷积网络:解码器

编码器和解码器的应用:

编码器和解码器在自然语言处理项目中的应用,如翻译项目。

Logo

DAMO开发者矩阵,由阿里巴巴达摩院和中国互联网协会联合发起,致力于探讨最前沿的技术趋势与应用成果,搭建高质量的交流与分享平台,推动技术创新与产业应用链接,围绕“人工智能与新型计算”构建开放共享的开发者生态。

更多推荐