手动计算BatchNorm, 手动计算LayerNorm, 手动计算GroupNorm, 手动计算InstanceNorm

接上一篇:
LayerNorm的图是不是画错了

这里手动计算 LN,本篇把我前两天闲的没事干写的验证代码放上了,还是上一篇的问题,有木有大佬解决一下我上一篇的问题,LayerNorm的图是画错了,还是我理解错了

1. 手动计算BN

python 复制代码
import torch
import torch.nn as nn

torch.manual_seed(1107)
# x = torch.arange(4).float().reshape(1, 2, 1, 2)  # 假设的输入
x = torch.rand(3, 32, 30, 32)

# 实例化BatchNorm2d
m = nn.BatchNorm2d(32, momentum=1)
m.train()  # 设置为评估模式

# m.running_var = 0

# 使用BatchNorm2d计算
y = m(x)

# 手动计算BatchNorm2d
x_mean = x.mean(dim=[0, 2, 3], keepdim=True)
x_var = x.var(dim=[0, 2, 3], keepdim=True, unbiased=False)
eps = m.eps


y_manual = (x - x_mean) / ((x_var + eps).sqrt())

# 检查两种方法的输出是否一致
# print("使用BatchNorm2d的结果:", y)
# print("手动计算的结果:", y_manual)
print("结果是否一致:", torch.allclose(y, y_manual, atol=1e-6))

2. 手动计算GN

python 复制代码
import torch
import torch.nn as nn

torch.manual_seed(1107)

num_channels = 64  # 确保这个数可以被num_groups整除
# 假设x的形状是(B, C, H, W),这里我们按照通常的卷积神经网络输入布局
x = torch.rand(32, num_channels, 256, 256)  # 修改x的形状以适配GroupNorm的输入需求

# 定义组数G,每组的通道数C/G需要是整数
num_groups = 32


m = nn.GroupNorm(
    num_groups=num_groups, num_channels=num_channels, eps=1e-5, affine=False
)
m.eval()  # 设置为评估模式

y = m(x)

# 手动计算GroupNorm
C_per_group = num_channels // num_groups

x = x.view(32, num_groups, C_per_group, 256, 256)  # 重塑x以便可以对每组进行操作
x_mean = x.mean(dim=[2, 3, 4], keepdim=True)
x_var = x.var(dim=[2, 3, 4], keepdim=True, unbiased=False)
eps = m.eps

y_manual = (x - x_mean) / ((x_var + eps).sqrt())
y_manual = y_manual.view(32, num_channels, 256, 256)  # 将y_manual的形状重塑回原始形状

print("结果是否一致:", torch.allclose(y, y_manual, atol=1e-6))

3. 手动计算IN

python 复制代码
import torch
import torch.nn as nn

torch.manual_seed(1107)

# 假设x的形状是(B, C, H, W)
x = torch.rand(32, 256, 40, 40)  # 添加一个维度以匹配四维输入

m = nn.InstanceNorm2d(256, affine=False, momentum=1)
m.eval()  # 设置为评估模式

y = m(x)

# 手动计算LayerNorm
x_mean = x.mean(dim=[2, 3], keepdim=True)
x_var = x.var(dim=[2, 3], keepdim=True, unbiased=False)
eps = m.eps

y_manual = (x - x_mean) / ((x_var + eps).sqrt())

print("结果是否一致:", torch.allclose(y, y_manual, atol=1e-6))
相关推荐
ModelHub XC信创模盒2 小时前
中国信创AI生态下 “信创模盒”社区战略招募种子用户
人工智能·大模型·开发者·信创·算力
袋鼠云数栈2 小时前
集团数字化统战实战:统一数据门户与全业态监管体系构建
大数据·数据结构·人工智能·多模态
廋到被风吹走2 小时前
【AI】Codex 多语言实测:Python/Java/JS/SQL 效果横评
java·人工智能·python
cskywit2 小时前
【IEEE TNNLS 2025】赋予大模型“跨院行医”的能力:基于全局与局部提示的医学图像泛化框架 (GLP) 解析
人工智能
2501_948114243 小时前
AI API Gateway 选型指南:2026 年生产环境下的聚合平台深度对比
人工智能·gateway
实在智能RPA3 小时前
Agent 在物流行业能实现哪些自动化?——深度拆解 AI Agent 驱动的智慧物流新范式
运维·人工智能·ai·自动化
TechubNews3 小时前
Jack Dorsey:告别传统公司层级,借助 AI 走向智能体架构
大数据·人工智能
伴野星辰3 小时前
如何提高YOLO8目标检测的准确性?
人工智能·目标检测·机器学习
胡耀超4 小时前
Token的八副面孔:为什么“词元“不需要更好的翻译,而需要更多的读者
大数据·人工智能·python·agent·token·代币·词元
带娃的IT创业者4 小时前
WeClaw_42_Agent工具注册全链路:从BaseTool到意图识别的标准化接入
大数据·网络·人工智能·agent·意图识别·basetool·工具注册