位置: IT常识 - 正文

深度学习论文精读[6]:UNet++

编辑:rootadmin
深度学习论文精读

推荐整理分享深度学习论文精读[6]:UNet++,希望有所帮助,仅作参考,欢迎阅读内容。

文章相关热门搜索词:,内容如对您有帮助,希望把文章链接给更多的朋友!

UNet的编解码结构一经提出以来,大有统一深度学习图像分割之势,后续基于UNet的改进方案也经久不衰,一些研究者也在从网络结构本身来思考UNet的有效性。比如说编解码网络应该取几层,跳跃连接是否能够有更多的变化以及什么样的结构训练起来更加有效等问题。UNet本身是针对医学图像分割任务而提出来的网络结构,该任务不像自然图像分割,对分割精度要求并不是十分严格。但对于医学图像而言,器官和病灶的分割则要求极高的精确性,因为很多时候分割效果的好坏直接关系到对应的临床诊断决策。出于上述两个方面的动机,即设计更好的UNet结构和提升医学图像分割的精度,相关研究者提出了一种嵌套的UNet结构(Nested UNet),也叫UNet++,提出UNet++的论文为UNet++: A Nested U-Net Architecture for Medical Image Segmentation,发表于2018年的医学图像计算和计算机辅助干预(Medical Image Computing and Computer Assisted Intervention,MICCAI)会议上。

UNet++取名为嵌套的UNet,就在于其整体编解码网络结构中还嵌套了编解码的子网络(sub-networks),在此基础上重新设计UNet中间的跳跃连接,并补充了深监督机制加速网络训练收敛。完整的UNet++结构如下图所示。

图中黑色部分为原始的UNet结构,包括编码器下采样、解码器上采样和黑色虚线的跳跃连接三个部分;绿色部分即嵌套的UNet子网络,包括卷积和上采样两部分,而蓝色虚线部分就是UNet++重新设计后的跳跃连接,这部分跟DenseNet的密集连接类似,这里是为子网络提供跳跃连接;最上面红黑连线则是UNet++补充的深监督机制,目的是为了网络能够顺利得到训练。

下面我们从结构设计的角度来对UNet++进行解读。关于UNet结构,最首要的问题就是网络应该有几层,原始的UNet结构用了4层下采样和4层上采样,那么是不是4层就足以满足所有的分割任务需要?答案是否定的。通过本节之前的网络结构分析,我们已经知道,浅层网络能够提取图像粗粒度特征,获取图像基本形态;深层网络能够提取图像的抽象特征,获取图像语义信息,总之浅有浅的侧重,深有深的好处。同之前RefineNet的观点一样,UNet++的作者认为,不管是浅层、深层还是中层,所有层次的特征对于最后的分割都是重要的。有的数据分割任务简单,图像信息单一,可能浅层网络就足以达到很好的效果,而有的数据任务复杂,图像信息丰富,可能需要更深层的网络结构才能达到不错的效果,之前的UNet结构设计很难同时照顾到这种普适性。而UNet++通过设计不同深度的嵌套UNet子网络来实现这种普适性,所以UNet的深度到这里就解决了。

第二个问题则是加入不同深度的嵌套网络后,跳跃连接部分该如何调整。在UNet中,跳跃连接由同层编码器直连到编码器上采样对应层。但加入嵌套子网络后,UNet中原先的长连接就不复存在了,取而代之的是各子网络中的短连接。UNet++的作者们认为,长连接在UNet中是有必要的,能够将图像中前后信息联系起来,对于下采样造成的信息损失有很好的补充作用。所以,UNet++又参考DenseNet的密集连接设计,给嵌套网络补充了长连接,如下图5所示。

但是这样又带来了第三个问题:反向传播的时候中间部分可能会收不到由损失函数反传回来的梯度。所以见招拆招,UNet++又通过深监督的方法来强行加梯度,帮助网络正常进行训练。但深监督对于UNet++的好处绝不仅仅限于此,通过不同深监督损失函数,UNet++可以通过网络剪枝来实现可伸缩性。所以,总结来说UNet++相较于原始的UNet,有如下两个优势:

(1)通过嵌套子网络和长短连接来整合不同层次的图像特征,使得网络分割精度更高;

深度学习论文精读[6]:UNet++

(2)灵活的网络结构配合深监督机制,让参数量巨大的深度网络在可接受的精度范围内能够大幅度的缩减参数量。

UNet++与UNet等网络分割效果对比如下图所示。

UNet++也进一步壮大了UNet家族网络,后续基于其的改进版本也有很多,比如Attention UNet++、UNet 3+等。下述代码给出了UNet++的一个实现参考。完整代码可参考:

https://github.com/4uiiurz1/pytorch-nested-unet/blob/master/archs.py

class NestedUNet(nn.Module):def __init__(self, num_classes, input_channels=3, deep_supervision=False, **kwargs):        super().__init__()        nb_filter = [32, 64, 128, 256, 512]        self.deep_supervision = deep_supervisionself.pool = nn.MaxPool2d(2, 2)self.up = nn.Upsample(scale_factor=2, mode='bilinear', align_corners=True)self.conv0_0 = VGGBlock(input_channels, nb_filter[0], nb_filter[0])self.conv1_0 = VGGBlock(nb_filter[0], nb_filter[1], nb_filter[1])self.conv2_0 = VGGBlock(nb_filter[1], nb_filter[2], nb_filter[2])self.conv3_0 = VGGBlock(nb_filter[2], nb_filter[3], nb_filter[3])self.conv4_0 = VGGBlock(nb_filter[3], nb_filter[4], nb_filter[4])self.conv0_1 = VGGBlock(nb_filter[0]+nb_filter[1], nb_filter[0], nb_filter[0])self.conv1_1 = VGGBlock(nb_filter[1]+nb_filter[2], nb_filter[1], nb_filter[1])self.conv2_1 = VGGBlock(nb_filter[2]+nb_filter[3], nb_filter[2], nb_filter[2])self.conv3_1 = VGGBlock(nb_filter[3]+nb_filter[4], nb_filter[3], nb_filter[3])self.conv0_2 = VGGBlock(nb_filter[0]*2+nb_filter[1], nb_filter[0], nb_filter[0])self.conv1_2 = VGGBlock(nb_filter[1]*2+nb_filter[2], nb_filter[1], nb_filter[1])self.conv2_2 = VGGBlock(nb_filter[2]*2+nb_filter[3], nb_filter[2], nb_filter[2])self.conv0_3 = VGGBlock(nb_filter[0]*3+nb_filter[1], nb_filter[0], nb_filter[0])        self.conv1_3 = VGGBlock(nb_filter[1]*3+nb_filter[2], nb_filter[1], nb_filter[1])self.conv0_4 = VGGBlock(nb_filter[0]*4+nb_filter[1], nb_filter[0], nb_filter[0])if self.deep_supervision:self.final1 = nn.Conv2d(nb_filter[0], num_classes, kernel_size=1)self.final2 = nn.Conv2d(nb_filter[0], num_classes, kernel_size=1)self.final3 = nn.Conv2d(nb_filter[0], num_classes, kernel_size=1)self.final4 = nn.Conv2d(nb_filter[0], num_classes, kernel_size=1)else:self.final = nn.Conv2d(nb_filter[0], num_classes, kernel_size=1)def forward(self, input):x0_0 = self.conv0_0(input)x1_0 = self.conv1_0(self.pool(x0_0))x0_1 = self.conv0_1(torch.cat([x0_0, self.up(x1_0)], 1))x2_0 = self.conv2_0(self.pool(x1_0))x1_1 = self.conv1_1(torch.cat([x1_0, self.up(x2_0)], 1))x0_2 = self.conv0_2(torch.cat([x0_0, x0_1, self.up(x1_1)], 1))x3_0 = self.conv3_0(self.pool(x2_0))x2_1 = self.conv2_1(torch.cat([x2_0, self.up(x3_0)], 1))x1_2 = self.conv1_2(torch.cat([x1_0, x1_1, self.up(x2_1)], 1))x0_3 = self.conv0_3(torch.cat([x0_0, x0_1, x0_2, self.up(x1_2)], 1))x4_0 = self.conv4_0(self.pool(x3_0))x3_1 = self.conv3_1(torch.cat([x3_0, self.up(x4_0)], 1))x2_2 = self.conv2_2(torch.cat([x2_0, x2_1, self.up(x3_1)], 1))x1_3 = self.conv1_3(torch.cat([x1_0, x1_1, x1_2, self.up(x2_2)], 1))x0_4 = self.conv0_4(torch.cat([x0_0, x0_1, x0_2, x0_3, self.up(x1_3)], 1))if self.deep_supervision:output1 = self.final1(x0_1)output2 = self.final2(x0_2)output3 = self.final3(x0_3)output4 = self.final4(x0_4)            return [output1, output2, output3, output4]else:output = self.final(x0_4)return output

根据读者对于本系列的反馈,后续相关内容会逐步更新到深度学习语义分割与实战指南GitHub地址:

https://github.com/luwill/Semantic-Segmentation-Guide

往期精彩:

 深度学习论文精读[1]:FCN全卷积网络

 深度学习论文精读[2]:UNet网络

 深度学习论文精读[3]:SegNet

 深度学习论文精读[4]:RefineNet

 深度学习论文精读[5]:Attention UNet

 讲解视频来了!机器学习 公式推导与代码实现开录!

 完结!《机器学习 公式推导与代码实现》全书1-26章PPT下载

本文链接地址:https://www.jiuchutong.com/zhishi/299270.html 转载请保留说明!

上一篇:H5项目如何打包成APP(h5项目怎么打包成app)

下一篇:HTML入门零基础教程(三)(html零基础入门教程)

  • 小米10pro和小米10相比较(小米10pro和小米10手机壳通用吗)

    小米10pro和小米10相比较(小米10pro和小米10手机壳通用吗)

  • oppofindx2pro是曲面屏手机吗(oppofindx2pro曲率)

    oppofindx2pro是曲面屏手机吗(oppofindx2pro曲率)

  • ns精灵球充电不亮灯(ns精灵球电量)

    ns精灵球充电不亮灯(ns精灵球电量)

  • 小米手环序列号怎么查(小米手环序列号查询官网)

    小米手环序列号怎么查(小米手环序列号查询官网)

  • win10电脑连不上iphone热点(win10电脑连不上网)

    win10电脑连不上iphone热点(win10电脑连不上网)

  • p40 pro pro+区别(p40 pro和pro+的区别)

    p40 pro pro+区别(p40 pro和pro+的区别)

  • oppo手机忘记密码了怎么进入设置页面(oppo手机忘记密码怎么开机)

    oppo手机忘记密码了怎么进入设置页面(oppo手机忘记密码怎么开机)

  • 一寸蓝底电子照片怎么弄(一寸蓝底电子照片尺寸)

    一寸蓝底电子照片怎么弄(一寸蓝底电子照片尺寸)

  • akaal10是什么型号(ak aa l10)

    akaal10是什么型号(ak aa l10)

  • 芯片组驱动作用是什么(芯片组驱动是干什么的)

    芯片组驱动作用是什么(芯片组驱动是干什么的)

  • excel中不等于怎么表示(excel中不等于怎么打出来)

    excel中不等于怎么表示(excel中不等于怎么打出来)

  • 微信可以扫健康码吗(微信可以扫健康码行程码吗)

    微信可以扫健康码吗(微信可以扫健康码行程码吗)

  • 苹果11怎么打开3dtouch(苹果11怎么打开3d模式)

    苹果11怎么打开3dtouch(苹果11怎么打开3d模式)

  • 苹果手机充电突然很快(苹果手机充电突然特别慢怎么回事)

    苹果手机充电突然很快(苹果手机充电突然特别慢怎么回事)

  • ipad要充多久才能充满(ipad一般要充多久)

    ipad要充多久才能充满(ipad一般要充多久)

  • 华为碎屏险划痕换吗(华为碎屏险划痕能用吗)

    华为碎屏险划痕换吗(华为碎屏险划痕能用吗)

  • 手机玩一会儿就很烫是什么原因(手机玩一会儿就很烫会不会爆炸)

    手机玩一会儿就很烫是什么原因(手机玩一会儿就很烫会不会爆炸)

  • 魅族16sPro怎么关闭通知预览(魅族16s怎么关闭打开的应用)

    魅族16sPro怎么关闭通知预览(魅族16s怎么关闭打开的应用)

  • 齐白石的作品名称(齐白石的作品名画)

    齐白石的作品名称(齐白石的作品名画)

  • 淘宝怎么不弹出家乡版(淘宝怎么不弹出淘宝页面)

    淘宝怎么不弹出家乡版(淘宝怎么不弹出淘宝页面)

  • 交管12123怎么缴费(交管12123怎么缴款)

    交管12123怎么缴费(交管12123怎么缴款)

  • 华为手机查看屏幕厂家(华为手机查看屏幕供应商)

    华为手机查看屏幕厂家(华为手机查看屏幕供应商)

  • 荣耀magic2耳机口在哪(magic2耳机插口)

    荣耀magic2耳机口在哪(magic2耳机插口)

  • 三星4521f清零(三星scx-4521f清零)

    三星4521f清零(三星scx-4521f清零)

  • 2015711是小米啥型号(2015561是小米什么型号)

    2015711是小米啥型号(2015561是小米什么型号)

  • 应纳税所得额的会计分录
  • 向银行借款产生的利息
  • 工资进成本还是费用
  • 哪些行业不能开具增值税专用发票
  • 跨年度冲红的账务处理
  • a3软件怎么反记账
  • 购买润滑油分录
  • 注销时其他应付款余额怎么账务处理
  • 收到银行退回的银行汇票多余款
  • 付款单中未全付款怎么办
  • 银行手续费没拿可以退吗
  • 企业接受捐赠是营业收入吗
  • 其他业务活动包括
  • 租房发票房产税怎么算
  • 没超过标准的招待费缴税吗
  • 企业经营收入达到多少
  • 如何查询已开出的增值税发票是否被认证
  • 为什么中国没有工业革命
  • 出口企业应交税费是负数怎么解释
  • 替票是什么和发票的区别
  • 网上申报城建税及附加怎么操作
  • 居民小区人防设施主要是什么
  • 商业企业向供货方收取的返还收入
  • 建筑完税怎么计算
  • 冲销暂估入库的会计分录
  • 政府购买缴纳社保吗
  • 若依框架入门
  • 下列项目中属于免征增值税的有
  • 租赁合同维修义务谁承担
  • 个体工商税务登记需要费用
  • php快递查询系统
  • 怎么修改wifi密码视频教程
  • 进程查看工具
  • 企业采购过程中发生的材料短缺
  • laravel 5.4中实现无限级分类的方法示例
  • 可视化大屏的几种模式
  • yolov5训练自己的模型配置到单片机
  • 项目建设期算不算折旧
  • 网上银行回单可以做账吗
  • zabbix 网络监控
  • mysql5.7.23安装配置教程
  • mysql主键和索引
  • 哪些企业可以开发票
  • 代理记账的业务规范
  • 发票冲红字蓝字怎么处理
  • 公司注销前的资产负债
  • 消费税会计处理的设置
  • 机票电子行程单查询
  • 一般纳税人第一次逾期申报处罚吗
  • 母子公司间资产划转是否属于特殊性收入
  • 购买土地需要缴纳哪些费用
  • 管理人员工资属于酌量性固定成本
  • 账本更正方法
  • 开具的简易计税凭证
  • 收到投资款现金流量放到哪里
  • 退款产生的手续费怎么算
  • 股东参与经营可以退股吗
  • 代扣代缴增值税申报期限
  • 联营企业子公司是否构成关联方
  • 变更公司名称后银行如何做
  • 投资回报怎么写
  • 总账建账要建全部科目吗
  • 索尼vaio笔记本无法开机
  • mac 锁屏
  • centos中用户的基本属性
  • windows使用svn命令
  • mom.exe是什么程序
  • windows7怎么禁用网络
  • w10系统输入法
  • perl-v
  • python生成器有几种写法
  • python3 args
  • shell 命令执行顺序
  • android应用市场有哪些
  • javascript基础入门教程
  • jquery不生效的原因
  • 陕西税务电子税务局官网安装
  • 合伙企业取得的专利权属于合伙企业财产吗
  • 注册会计师和注册审计师哪个厉害
  • 税收优惠政策有哪些企业
  • 免责声明:网站部分图片文字素材来源于网络,如有侵权,请及时告知,我们会第一时间删除,谢谢! 邮箱:opceo@qq.com

    鄂ICP备2023003026号

    网站地图: 企业信息 工商信息 财税知识 网络常识 编程技术

    友情链接: 武汉网站建设