手机浏览器扫描二维码访问
在神经网络里,梯度消失的问题就是这种感觉,网络不知道该如何继续改进。
而梯度爆炸又是另外的一个极端。
假设这次你站在一座非常陡的悬崖边,一不小心就滚下去了!
因为坡度太陡了,你的速度变得非常快,失控了。
在神经网络中,这种情况也被称为“梯度爆炸”
当梯度太大时,参数的调整会变得过于剧烈,网络的学习变得不稳定,甚至会导致训练失败。
这就像你在陡峭的悬崖边滑落,一下子失去了控制。
网络的参数变化过大,导致结果变得很不稳定,甚至完全错误。
概括地说:
梯度消失就像在一座越来越平的山坡上,梯度变得很小,神经网络不知道该怎么调整,进而学习变得很慢,甚至无法进步。
梯度爆炸就像从悬崖边滚下去,梯度变得很大,网络的学习变得过于剧烈,结果会非常不稳定,训练过程变得不可控。
这两个问题经常会出现在深层神经网络中。
而这也是马库斯所要倾诉的困扰。
“说起来,最近的研究还卡在了‘梯度消失’的问题上。”
马库斯苦笑着说道,靠在沙发上,“我们在训练一些更深层次的神经网络时,发现模型一旦超过一定的深度,反向传播算法中的梯度会逐渐趋近于零,根本无法有效更新权重。
深度越大,梯度就越容易消失,整个网络的学习效率大幅下降。”
马库斯知道林枫硕士是麻省理工学院的计算机硕士,因此也就全都用专业术语表述了。
对于这些林枫当然能听明白,非但能听明白,而且作为一个资深的人工智能从业人员。
林枫也清楚知道马库斯面临的难题。
林枫对AI的发展也有所了解,涉及到梯度问题在2014年是深度学习研究中的一个巨大挑战。
甚至可以说解决不了梯度问题就很难有真正的深度学习,也就不会有后来的人工智能成果的一系列井喷。
林枫心说,自己这是一不小心站在了技术发展的最前沿了吗?
不得不说,这种举手投足之间就能影响时代命运的感觉是真的无比美妙。
“梯度消失的问题一直存在,尤其是深层网络。
梯度爆炸倒是相对好解决,但梯度消失会直接导致学习过程停滞不前。”
林枫沉思片刻,补充道,“这不仅是你们实验室的问题,也是整个领域的瓶颈。
反向传播的基本原理决定了,当信号在网络中层层传递时,梯度的变化会以指数级缩小。”
马库斯脑海中泛起了大大的问号,梯度爆炸问题好解决吗?
他怎么觉得梯度爆炸问题也挺麻烦的?
不过聊天本来就是求同存异,既然林同样认为梯度消失难以解决就够了。
马库斯也没纠结为什么林说梯度爆炸容易解决,而是继续就梯度消失发表观点说道:“是啊,哪怕有了ReLU(修正线性单元)激活函数的引入,虽然能在一定程度上减轻梯度消失,但对深层网络还是不够。”
林枫想了想,说道:“你们有考虑过改进网络结构吗?”
因为贪图便宜,所以搬进了一间便宜的出租房,但是没想到隔壁住着一只女鬼...
兵王会医术,谁也挡不住!奉师傅之命回归都市,肩负保护美女总裁的重任,斗纨绔,降恶少,神挡杀神。且看他如何游走万花丛,片叶不沾身。...
玄昊,是男是女?并不重要。...
前世,她助他登上皇位,换来的却是,被废后位,痛失爱子,失去家人,被砍掉一双腿。死前,她攥着剑尖,狠狠捅了自己五刀,将对他的情爱统统斩断。最后一刀,他亲手所赐,扎在了心窝,她死不瞑目。一觉醒来,她回到了十五岁那年,重活一世,她杀刁奴,虐庶妹,惩继母,诛渣男。她冷情冷心,再不沾染情爱,封锁了心门。某太子我丢了东西,你把心门锁了,我怎么要回?我的心,丢在了你身上…...
穿越当晚,新婚洞房。云绾宁被墨晔那狗男人凌虐的死去活来,后被抛之后院,禁足整整四年!本以为,这四年她过的很艰难。肯定变成了个又老又丑的黄脸婆!但看着她身子饱满勾人肌肤雪白挥金如土,身边还多了个跟他一模一样的肉圆子墨晔双眼一热,你哪来的钱!哪来的娃?!肉圆子瞪他离我娘亲远一点!当年之事彻查后,墨晔一脸真诚媳妇,我错了!儿子,爹爹错了!...
我叫末辛,十八岁。在别人眼里,这是个如花似玉的年纪,但在我们家,女孩的出生却是种不幸。这并非是来自于老一辈思想下毒害观念,而是因为一张人鬼契约书...