pytorch 梯度NAN异常值的解决方案

文章目录[隐藏]

pytorch 梯度NAN异常值
- gradient 为nan可能原因：
pytorch处理inf和nan数值
- 简单回顾

pytorch 梯度NAN异常值

gradient 为nan可能原因：

1、梯度爆炸

2、学习率太大

3、数据本身有问题

4、backward时，某些方法造成0在分母上，如：使用方法sqrt()

定位造成nan的代码：

import torch
# 异常检测开启
torch.autograd.set_detect_anomaly(True)
# 反向传播时检测是否有异常值，定位code
with torch.autograd.detect_anomaly():
 loss.backward()

pytorch处理inf和nan数值

在构建网络框架后，运行代码，发现很多tensor出现了inf值或者nan,在很多博客上没有找到对应的解决方法，大部分是基于numpy写的，比较麻烦。

下面基于torch BIF函数实现替换这2个值。

a = torch.Tensor([[1, 2, np.nan], [np.inf, np.nan, 4], [3, 4, 5]])
 
a
Out[158]: 
tensor([[1., 2., nan],
        [inf, nan, 4.],
        [3., 4., 5.]])

下面把nan值还为0：

a = torch.where(torch.isnan(a), torch.full_like(a, 0), a)
 
a
Out[160]: 
tensor([[1., 2., 0.],
        [inf, 0., 4.],
        [3., 4., 5.]])

接着把inf替换为1：

a = torch.where(torch.isinf(a), torch.full_like(a, 0), a)
 
a
Out[162]: 
tensor([[1., 2., 0.],
        [0., 0., 4.],
        [3., 4., 5.]])

简单回顾

tips:对于某些tensor,可能已经开启了grad功能，需要把它先转为普通tensor（使用.data）

torch.where(condition,T,F) 函数有三个输入值，

第一个是判断条件，

第二个是符合条件的设置值，

第三个是不符合条件的设置值

torch.full_like(input, fill_value, …) 返回与input相同size，单位值为fill_value的矩阵
 
#如下面这个例子，a为3*3的tensor
b =torch.full_like(a, 0,)
 
b
Out[165]: 
tensor([[0., 0., 0.],
        [0., 0., 0.],
        [0., 0., 0.]])

以上为个人经验，希望能给大家一个参考，也希望大家多多支持华域联盟。

您可能感兴趣的文章:

本文由华域联盟原创撰写：华域联盟 » pytorch 梯度NAN异常值的解决方案

转载请保留出处和原文链接：https://www.cnhackhy.com/27192.htm

pytorch 梯度NAN异常值的解决方案

pytorch 梯度NAN异常值

gradient 为nan可能原因：

pytorch处理inf和nan数值

简单回顾

相关文章

作者: sterben

发表回复取消回复

wordpress内链优化插件WP Keyword Link

.Net的GC垃圾回收原理及实现

.Net Core导入千万级数据至Mysql数据库的实现方法

IIS部署ASP.NET5的实现步骤

vMix Pro破解版(视频混合器软件)下载 V23.0.0.67 中文版(附破解教程)

vMix Pro破解版(视频混合器软件)下载 V23.0.0.67 中文版(附破解教程)

冰点还原精灵永久免费版 v8.55.020.5505 永久激活版

重磅！博彦科技正式发布鸿蒙HarmonyOS移动金融技术平台

HarmonyOS 4.2正式版华丽登场！22款设备今日即享

鸿蒙生态使能- HarmonyOS官网

联系我们

微信扫一扫关注我们

pytorch 梯度NAN异常值

gradient 为nan可能原因：

pytorch处理inf和nan数值

简单回顾

相关文章

作者: sterben

Pytorch反向传播中的细节-计算梯度时的默认累加操作

pytorch自定义不可导激活函数的操作

相关推荐

发表回复 取消回复

联系我们

微信扫一扫关注我们

发表回复取消回复