图像分割项目总结
图像分割:
预测目标的轮廓。将不同的像素划分到不同的类别,非常细粒度的分类。

图像分割的应用场景
人像抠图,医学组织提取,遥感图像分析,自动驾驶,材料图像等。

图像分割的前景与背景
物体Things:可数前景目标(行人等)。
· 事物Stuff:不可数背景(天空,草地,路面)。
图像分割的三层境界
语义分割(semantic segmentation)每一个像素必须只能属于一类,预测结果为掩膜。
实例分割(instance segmentation)只预测前景目标的类别属性以及边框,个体ID,每一个像素可以属于多个ID。
全景分割(panoptic segmentation)每个像素点分配一个语义类别和一个唯一的实例ID。

图像分割的数据集
VOC数据集:PASCAL VOC挑战赛(The PASCAL Visual Object Classes)是一个世界级的计算机视觉挑战赛。

从2007年开始引进了语义分割和实例分割的标注。


、
Cityscape数据集:50个城市在春夏秋三个季节不同时间段不同场景、背景的街景图。

语义分割和实例分割。


COCO数据集:以场景理解为目标,特别选取比较复杂的日常场景。

数据集图像特点

图像分类精度相关指标:
PA(Pixel Accuracy):图像素分类精度。
MPA(Mean Pixel Accuracy):每个类被正确分类的像素数的比例。

IOU(Intersection over Union):前景目标的交并比。
MIOU(Mean Intersection over Union):每个类别的IOU的平均值。
FWLU(Frequency Weighted LU):根据每个类出现的概率给MLU赋权重计算的指标。
卷积模块和反卷积模块:
卷积模块:用于特征提取。
反卷积模块:用于上采样恢复到原始图像尺度。
卷积网络:编码器
反卷积网络:解码器
编码器和解码器的应用:
编码器和解码器在自然语言处理项目中的应用,如翻译项目。
DAMO开发者矩阵,由阿里巴巴达摩院和中国互联网协会联合发起,致力于探讨最前沿的技术趋势与应用成果,搭建高质量的交流与分享平台,推动技术创新与产业应用链接,围绕“人工智能与新型计算”构建开放共享的开发者生态。
更多推荐



所有评论(0)