首页 > 资讯 > 精选 >pytorch中LN(LayerNorm)及Relu和其变相输出操作的示例分析

703

分享到

pytorch中LN(LayerNorm)及Relu和其变相输出操作的示例分析

2023-06-15 06:06:45 703人浏览薄情痞子

摘要

这篇文章主要介绍PyTorch中LN(LayerNORM)及Relu和其变相输出操作的示例分析，文中介绍的非常详细，具有一定的参考价值，感兴趣的小伙伴们一定要看完！主要就是了解一下pytorch中的使用layernorm这种归一化之后的数据

这篇文章主要介绍PyTorch中LN(LayerNORM)及Relu和其变相输出操作的示例分析，文中介绍的非常详细，具有一定的参考价值，感兴趣的小伙伴们一定要看完！

主要就是了解一下pytorch中的使用layernorm这种归一化之后的数据变化，以及数据使用relu，prelu，leakyrelu之后的变化。

import torchimport torch.nn as nnimport torch.nn.functional as Fclass model(nn.Module):    def __init__(self):        super(model, self).__init__()        self.LN=nn.LayerNorm(10,eps=0,elementwise_affine=True)        self.PRelu=nn.PReLU(init=0.25)        self.Relu=nn.ReLU()        self.LeakyReLU=nn.LeakyReLU(negative_slope=0.01,inplace=False)    def forward(self,input ):        out=self.LN(input)        print("LN:",out)        out1=self.PRelu(out)        print("PRelu:",out1)        out2=self.Relu(out)        print("Relu:",out2)        out3=self.LeakyReLU(out)        print("LeakyRelu:",out3)        return outtensor=torch.tensor([-0.9,0.1,0,-0.1,0.9,-0.4,0.9,-0.5,0.8,0.1])net=model()print(tensor)net(tensor)

输出：

tensor([-0.9000, 0.1000, 0.0000, -0.1000, 0.9000, -0.4000, 0.9000, -0.5000,
         0.8000, 0.1000])
LN: tensor([-1.6906, 0.0171, -0.1537, -0.3245, 1.3833, -0.8368, 1.3833, -1.0076,
         1.2125, 0.0171], grad_fn=<NativeLayerNormBackward>)
Relu: tensor([0.0000, 0.0171, 0.0000, 0.0000, 1.3833, 0.0000, 1.3833, 0.0000, 1.2125,
        0.0171], grad_fn=<ReluBackward0>)
PRelu: tensor([-0.4227, 0.0171, -0.0384, -0.0811, 1.3833, -0.2092, 1.3833, -0.2519,
         1.2125, 0.0171], grad_fn=<PreluBackward>)
LeakyRelu: tensor([-0.0169, 0.0171, -0.0015, -0.0032, 1.3833, -0.0084, 1.3833, -0.0101,
         1.2125, 0.0171], grad_fn=<LeakyReluBackward0>)

从上面可以看出，这个LayerNorm的归一化，并不是将数据限定在0-1之间，也没有进行一个类似于高斯分布一样的分数，只是将其进行了一个处理，对应的数值得到了一些变化，相同数值的变化也是相同的。

Relu的则是单纯将小于0的数变成了0，减少了梯度消失的可能性

PRelu是一定程度上的保留了负值，根据init给的值。

LeakyRelu也是一定程度上保留负值，不过比较小，应该是根据negative_slope给的值。

补充：PyTorch学习之归一化层（BatchNorm、LayerNorm、InstanceNorm、GroupNorm）

BN，LN，IN，GN从学术化上解释差异：

BatchNorm：batch方向做归一化，算NHW的均值，对小batchsize效果不好；BN主要缺点是对batchsize的大小比较敏感，由于每次计算均值和方差是在一个batch上，所以如果batchsize太小，则计算的均值、方差不足以代表整个数据分布

LayerNorm：channel方向做归一化，算CHW的均值，主要对RNN作用明显；

InstanceNorm：一个channel内做归一化，算H*W的均值，用在风格化迁移；因为在图像风格化中，生成结果主要依赖于某个图像实例，所以对整个batch归一化不适合图像风格化中，因而对HW做归一化。可以加速模型收敛，并且保持每个图像实例之间的独立。

GroupNorm：将channel方向分group，然后每个group内做归一化，算(C//G)HW的均值；这样与batchsize无关，不受其约束。

SwitchableNorm是将BN、LN、IN结合，赋予权重，让网络自己去学习归一化层应该使用什么方法。

pytorch中LN(LayerNorm)及Relu和其变相输出操作的示例分析

1 BatchNorm

torch.nn.BatchNorm1d(num_features, eps=1e-05, momentum=0.1, affine=True, track_running_stats=True)torch.nn.BatchNorm2d(num_features, eps=1e-05, momentum=0.1, affine=True, track_running_stats=True)torch.nn.BatchNorm3D(num_features, eps=1e-05, momentum=0.1, affine=True, track_running_stats=True)

参数：

num_features：来自期望输入的特征数，该期望输入的大小为'batch_size x num_features [x width]'

eps：为保证数值稳定性（分母不能趋近或取0）,给分母加上的值。默认为1e-5。

momentum：动态均值和动态方差所使用的动量。默认为0.1。

affine：布尔值，当设为true，给该层添加可学习的仿射变换参数。

track_running_stats：布尔值，当设为true，记录训练过程中的均值和方差；

实现公式：

track_running_stats：布尔值，当设为true，记录训练过程中的均值和方差；

实现公式：

pytorch中LN(LayerNorm)及Relu和其变相输出操作的示例分析

2 GroupNorm

torch.nn.GroupNorm(num_groups, num_channels, eps=1e-05, affine=True)

参数：

num_groups：需要划分为的groups

num_features：来自期望输入的特征数，该期望输入的大小为'batch_size x num_features [x width]'

eps：为保证数值稳定性（分母不能趋近或取0）,给分母加上的值。默认为1e-5。

momentum：动态均值和动态方差所使用的动量。默认为0.1。

affine：布尔值，当设为true，给该层添加可学习的仿射变换参数。

实现公式：

pytorch中LN(LayerNorm)及Relu和其变相输出操作的示例分析

3 InstanceNorm

torch.nn.InstanceNorm1d(num_features, eps=1e-05, momentum=0.1, affine=False, track_running_stats=False)torch.nn.InstanceNorm2d(num_features, eps=1e-05, momentum=0.1, affine=False, track_running_stats=False)torch.nn.InstanceNorm3d(num_features, eps=1e-05, momentum=0.1, affine=False, track_running_stats=False)

参数：

num_features：来自期望输入的特征数，该期望输入的大小为'batch_size x num_features [x width]'

eps：为保证数值稳定性（分母不能趋近或取0）,给分母加上的值。默认为1e-5。

momentum：动态均值和动态方差所使用的动量。默认为0.1。

affine：布尔值，当设为true，给该层添加可学习的仿射变换参数。

track_running_stats：布尔值，当设为true，记录训练过程中的均值和方差；

实现公式：

pytorch中LN(LayerNorm)及Relu和其变相输出操作的示例分析

4 LayerNorm

torch.nn.LayerNorm(normalized_shape, eps=1e-05, elementwise_affine=True)

参数：

normalized_shape：输入尺寸

[∗×normalized_shape[0]×normalized_shape[1]×…×normalized_shape[−1]]

eps：为保证数值稳定性（分母不能趋近或取0）,给分母加上的值。默认为1e-5。

elementwise_affine：布尔值，当设为true，给该层添加可学习的仿射变换参数。

实现公式：

pytorch中LN(LayerNorm)及Relu和其变相输出操作的示例分析

5 LocalResponseNorm

torch.nn.LocalResponseNorm(size, alpha=0.0001, beta=0.75, k=1.0)

参数：

size：用于归一化的邻居通道数

alpha：乘积因子，Default: 0.0001

beta ：指数，Default: 0.75

k：附加因子，Default: 1

实现公式：

pytorch中LN(LayerNorm)及Relu和其变相输出操作的示例分析

以上是“pytorch中LN(LayerNorm)及Relu和其变相输出操作的示例分析”这篇文章的所有内容，感谢各位的阅读！希望分享的内容对大家有帮助，更多相关知识，欢迎关注编程网精选频道！

--结束END--

本文标题: pytorch中LN(LayerNorm)及Relu和其变相输出操作的示例分析

本文链接: https://lsjlt.com/news/278237.html(转载时请注明来源链接)

有问题或投稿请发送至: 邮箱/279061341@qq.com QQ/279061341

回答

如何调试操作系统的错误？
操作系统

2023-11-15发布

回答

操作系统中的I/O系统是如何实现的？
操作系统

2023-11-15发布

回答

如何实现操作系统的内存管理？
操作系统

2023-11-15发布

回答

什么是虚拟内存，它对操作系统有什么影响？
操作系统

2023-11-15发布

回答

ASP中的MVC架构和WebForms架构有什么区别和使用场景？
ASP.NET

2023-11-15发布

回答

ASP中的数据验证和数据校验有什么不同？
ASP.NET

2023-11-15发布

回答

ASP中的ADO对象和DAO对象有什么区别和使用方法？
ASP.NET

2023-11-15发布

回答

Node.js中的包管理器NPM是什么？如何使用它进行依赖管理？
node.js

2023-11-15发布

回答

Vue.js中的动态组件是什么？如何使用它来动态渲染组件？
VUE

2023-11-15发布

回答

如何使用Vue.js实现懒加载和预加载？
VUE

2023-11-15发布

pytorch中LN(LayerNorm)及Relu和其变相输出操作的示例分析

1 BatchNorm

2 GroupNorm

3 InstanceNorm

4 LayerNorm

5 LocalResponseNorm

pytorch中LN(LayerNorm)及Relu和其变相输出操作的示例分析

pytorch中LN(LayerNorm)及Relu和其变相的输出操作

ESlint和其相关操作的示例分析

JS变量及其作用域的示例分析

Pytorch中Tensor基本操作的示例分析

pytorch中stack和cat的及to_tensor的示例分析

pytorch 6中batch_train批训练操作的示例分析

Angular模板引用变量及其作用域的示例分析

java中volatile变量并发操作的示例分析

golang中gorm操作mysql及gorm的示例分析

CentOS7中Xfs文件系统相关操作的示例分析

Pytorch训练模型得到输出后计算F1-Score 和AUC的示例分析

javascript中变量、作用域和内存的示例分析

JavaScript中变量作用域及内存问题的示例分析

R语言中corrplot标题居中及eps格式输出的示例分析

js中作用域和作用域链及预解析的示例分析

Redis中配置、启动、操作和关闭的示例分析

Redis中过期操作和过期策略的示例分析

python中文件操作和异常处理的示例分析

HTML5之pushstate、popstate操作history以及无刷新改变当前url的示例分析

使用golang框架有哪些常见的问题？

golang框架与其他流行框架的比较？

如何使用 C++ STL 扩展 C++ 语言的功能？

PHP 框架安全指南：如何实现安全编码实践？

mysql拆分函数使用要注意哪些事项

C++ 思维导图：全面整理编程核心知识

基于社区支持最强大的PHP框架

如何在 C++ 中有效使用 STL 函数对象？

PHP 框架中的调试和故障排除技术

经验丰富的开发者的PHP框架评估指南