博客
关于我
ShakeDrop:深度残差学习中的 ShakeDrop 正则化
阅读量:799 次
发布时间:2023-04-15

本文共 1018 字,大约阅读时间需要 3 分钟。

ShakeDrop正则化方法在深度残差学习中的应用

在ResNeXt、ResNet、Wide ResNet(WRN)和PyramidNet等网络架构中,ShakeDrop正则化方法展现出优异的性能,优于Shake-Shake和RandomDrop。ShakeDrop通过结合两种不同的扰动方法,既能有效防止过拟合,又能保持模型的良好收敛性。

Shake-Shake的背景

Shake-Shake是一种通过随机调整网络权重来增强模型的正则化方法。其核心思想是,在训练过程中为每个样本生成两个随机系数α和β,分别用于不同的网络分支。Shake-Shake通过插值两个残差分支的输出,合成合理的增强数据,从而达到防止过拟合的目的。

RandomDrop的机制

RandomDrop则是一种通过随机丢弃网络构建块来加深网络的学习过程。它通过线性衰减概率pl来控制每个构建块被丢弃的比例,确保网络在学习过程中保持一定的深度。与Dropout不同,RandomDrop是层级的,而非元素的随机丢弃。

ShakeDrop的创新

ShakeDrop正则化方法将Shake-Shake和RandomDrop的优点结合起来,通过混合两种扰动方式,实现更强大的防过拟合效果。当α和β都为0时,ShakeDrop退化为RandomDrop;当α和β逐渐增加时,ShakeDrop逐步融合了Shake-Shake的特性。

实验结果

在CIFAR、ImageNet以及COCO检测和分割任务中,ShakeDrop展现出显著的性能优势。它不仅在ResNeXt等多分支网络中优于Shake-Shake和RandomDrop,在ResNet、Wide ResNet和PyramidNet等双分支网络中也显著超过了原始网络和RandomDrop。

结合Mixup的协同作用

ShakeDrop与Mixup正则化方法的结合进一步提升了模型性能。在大多数任务中,ShakeDrop能够在使用Mixup的情况下,显著降低误差率。这表明,ShakeDrop并非单纯的正则化方法,而是与其他增强方法协同工作的有效伙伴。

结论

ShakeDrop正则化方法通过创新的混合扰动策略,为深度残差网络的训练提供了一种高效的解决方案。它不仅保持了模型的良好收敛性,还显著提升了模型的泛化能力。对于希望在深度学习任务中取得优异性能的研究人员和工程师,ShakeDrop是一个值得深入探索的方向。

转载地址:http://lrrfk.baihongyu.com/

你可能感兴趣的文章
MySQL中你必须知道的10件事,1.5万字!
查看>>
MySQL中使用IN()查询到底走不走索引?
查看>>
Mysql中使用存储过程插入decimal和时间数据递增的模拟数据
查看>>
MySql中关于geometry类型的数据_空的时候如何插入处理_需用null_空字符串插入会报错_Cannot get geometry object from dat---MySql工作笔记003
查看>>
mysql中出现Incorrect DECIMAL value: '0' for column '' at row -1错误解决方案
查看>>
mysql中出现Unit mysql.service could not be found 的解决方法
查看>>
mysql中出现update-alternatives: 错误: 候选项路径 /etc/mysql/mysql.cnf 不存在 dpkg: 处理软件包 mysql-server-8.0的解决方法(全)
查看>>
Mysql中各类锁的机制图文详细解析(全)
查看>>
MySQL中地理位置数据扩展geometry的使用心得
查看>>
Mysql中存储引擎简介、修改、查询、选择
查看>>
Mysql中存储过程、存储函数、自定义函数、变量、流程控制语句、光标/游标、定义条件和处理程序的使用示例
查看>>
mysql中实现rownum,对结果进行排序
查看>>
mysql中对于数据库的基本操作
查看>>
Mysql中常用函数的使用示例
查看>>
MySql中怎样使用case-when实现判断查询结果返回
查看>>
Mysql中怎样使用update更新某列的数据减去指定值
查看>>
Mysql中怎样设置指定ip远程访问连接
查看>>
mysql中数据表的基本操作很难嘛,由这个实验来带你从头走一遍
查看>>
Mysql中文乱码问题完美解决方案
查看>>
mysql中的 +号 和 CONCAT(str1,str2,...)
查看>>