(1)梯度不稳定问题:

什么是梯度不稳定问题:深度神经网络中的梯度不稳定性,前面层中的梯度或会消失,或会爆炸。

原因:前面层上的梯度是来自于后面层上梯度的乘乘积。当存在过多的层次时,就出现了内在本质上的不稳定场景,如梯度消失和梯度爆炸。

(2)梯度消失(vanishing gradient problem):

原因:例如三个隐层、单神经元网络:

则可以得到:

然而,sigmoid方程的导数曲线为:

可以看到,sigmoid导数的最大值为1/4,通常abs(w)<1,则:

前面的层比后面的层梯度变化更小,故变化更慢,从而引起了梯度消失问题。

(3)梯度爆炸(exploding gradient problem):

当权值过大,前面层比后面层梯度变化更快,会引起梯度爆炸问题。

(4)sigmoid时,消失和爆炸哪个更易发生?

量化分析梯度爆炸出现时a的树枝范围:因为sigmoid导数最大为1/4,故只有当abs(w)>4时才可能出现

由此计算出a的数值变化范围很小,仅仅在此窄范围内会出现梯度爆炸问题。而最普遍发生的是梯度消失问题。

(5)如何解决梯度消失和梯度爆炸?

使用ReLU,maxout等替代sigmoid。(具体细节请看博主之前神经网络激活函数部分)

区别:(1)sigmoid函数值在[0,1],ReLU函数值在[0,+无穷],所以sigmoid函数可以描述概率,ReLU适合用来描述实数;(2)sigmoid函数的梯度随着x的增大或减小和消失,而ReLU不会。

最新文章

  1. 字典 Key值转换为数组
  2. MongoDB(四)mongodb设置用户访问权限
  3. HDU3870 Catch the Theves(平面图最小割转最短路)
  4. Android开发探秘之二:导入存在的项目及其注意事项
  5. 调用百度地图Api实现的查看地图功能的小插件
  6. 19款绚丽实用的jQuery/CSS3侧边栏菜单
  7. 表达式语言之EL表达式
  8. javascript 的点击复制事件
  9. 【MFC学习笔记-作业5-小数据库】【单选框,复选框,滚动条,列表框】
  10. 手游接入Facebook的那些坑
  11. boost::asio 连接管理11 如何关闭连接
  12. 【高德API】如何利用MapKit开发全英文检索的iOS地图
  13. 取消svn版本控制
  14. VirtualBox 安装增强工具
  15. Python协程爬取妹子图(内有福利,你懂得~)
  16. 自己编写的仿京东移动端的省市联动选择JQuery插件
  17. ssm项目整合shiro
  18. bzoj3637(lct)
  19. Android system :led_class驱动
  20. Shell编程-11-子Shell和Shell嵌套

热门文章

  1. [Java]如何把当前时间插入到数据库
  2. AutoFac简单入门
  3. google打不开怎么办?谷歌打不开的解决方法
  4. How to update WPF browser application manifest and xbap file with ‘mage.exe’
  5. AngularJS报错:[$injector:unpr] Unknown provider: $templateRequestProvider
  6. delphi中单独编译pas生成dcu文件
  7. tms web core介绍
  8. iOS App与iTunes文件传输的方法和对iOS App文件结构的说明
  9. Android 自动编译、打包生成apk文件 2 - 使用原生Ant方式
  10. linux批量改名