在训练过程中,loss的值非常大,可能是:
(1)没有除以归一化的因子(GAN中需要除以256*256*3),或者没有取平均值
(2)learning rate太大,导致更新之后的权值参数特别大,从而下一次计算prediction的时候数值很大,最终计算loss的时候prediction 和 ground truth 之间的差值特别大。
本文探讨了在训练过程中遇到loss值过大的两种常见原因:一是未进行适当的归一化处理;二是learning rate设置不当导致权值参数异常增大。通过调整这些参数可以有效降低loss值。
在训练过程中,loss的值非常大,可能是:
(1)没有除以归一化的因子(GAN中需要除以256*256*3),或者没有取平均值
(2)learning rate太大,导致更新之后的权值参数特别大,从而下一次计算prediction的时候数值很大,最终计算loss的时候prediction 和 ground truth 之间的差值特别大。
2769
2万+
2456

被折叠的 条评论
为什么被折叠?
