FCN模型是让 Backbone + Decoder 这一套工程范式在分割领域真正成型的关键模型,有32s、16s、8s三种规格,8s的结构示意图如下:

这个模型逻辑很容易理解。它直接复用以前的分类网络(alexnet、vgg之类),将这些网络末尾的FC层替换成卷积层,得到的特征图再上采样(原论文使用转置卷积)得到跟原图尺寸一致的、对于每个像素预测出最佳类别的结果图。相对于32s,8s和16s利用了vgg中一些中间maxpool模块的输出结果。
FCN模型是让 Backbone + Decoder 这一套工程范式在分割领域真正成型的关键模型,有32s、16s、8s三种规格,8s的结构示意图如下:

这个模型逻辑很容易理解。它直接复用以前的分类网络(alexnet、vgg之类),将这些网络末尾的FC层替换成卷积层,得到的特征图再上采样(原论文使用转置卷积)得到跟原图尺寸一致的、对于每个像素预测出最佳类别的结果图。相对于32s,8s和16s利用了vgg中一些中间maxpool模块的输出结果。