【动手学深度学习】读写文件

【动手学深度学习】读写文件

加载和保存张量

对于单个张量 我么可以直接调用load和save函数分别读写,这两个函数要求我们提供一个名称,save要求保存的变量作为输入

py 复制代码
import torch
from torch import nn
from torch.nn import functional as F

# 创建一个长度为4的张量
x = torch.arange(4)
torch.save(x, 'x-file')


x2 = torch.load('x-file')
print(x2)

存储一个张量列表,然后把他们写入内存

py 复制代码
y = torch.zeros(4)
torch.save([x,y],'x-files')
x2,y2 = torch.load('x-files')
(x2,y2)

我们甚至可以写入或者读取从字符串映射到张量的字典,方面读取权重

py 复制代码
# 创建张量字典  保存张量
mydict = {'x':x,'y':y}
torch.save(mydict,'mydict')

mydict2 = torch.load('mydict')
mydict2

加载和保存模型参数

深度学习框架提供内置函数来保存和加载整个网络,这里是保存模型的参数而不是保存整个模型

py 复制代码
class MLP(nn.Module):
    def __init__(self):
        super().__init__()
        self.hidden = nn.Linear(20,256)
        self.output = nn.Linear(256,10)

    def forward(self,X):
        return self.output(F.relu(self.hidden(X)))
    
net = MLP()
X = torch.randn(size= (2,20))
Y = net(X)

取出模型的参数保存在一个mlp.params文件中

py 复制代码
# 取出模型的参数保存在一个mlp.params文件中
torch.save(net.state_dict(),'mlp.params')

恢复模型,实例化原始多层感知机模型的一个备份,我们不需要随机初始化模型参数,而是直接读取文件中存储的参数

py 复制代码
clone = MLP()
clone.load_state_dict(torch.load('mlp.params'))
clone.eval()

比较两个对象的模型参数,那么输入相同的X 计算的输出应该相同

py 复制代码
Y_clone = clone(X)
Y_clone == Y
相关推荐
m0_650108241 小时前
【论文精读】CMD:迈向高效视频生成的新范式
人工智能·论文精读·视频扩散模型·高效生成·内容 - 运动分解·latent 空间
电鱼智能的电小鱼1 小时前
基于电鱼 AI 工控机的智慧工地视频智能分析方案——边缘端AI检测,实现无人值守下的实时安全预警
网络·人工智能·嵌入式硬件·算法·安全·音视频
年年测试1 小时前
AI驱动的测试:用Dify工作流实现智能缺陷分析与分类
人工智能·分类·数据挖掘
唐兴通个人2 小时前
人工智能Deepseek医药AI培训师培训讲师唐兴通讲课课程纲要
大数据·人工智能
WGS.3 小时前
llama factory 扩充词表训练
深度学习
共绩算力3 小时前
Llama 4 Maverick Scout 多模态MoE新里程碑
人工智能·llama·共绩算力
DashVector4 小时前
向量检索服务 DashVector产品计费
数据库·数据仓库·人工智能·算法·向量检索
AI纪元故事会4 小时前
【计算机视觉目标检测算法对比:R-CNN、YOLO与SSD全面解析】
人工智能·算法·目标检测·计算机视觉
音视频牛哥4 小时前
从协议规范和使用场景探讨为什么SmartMediaKit没有支持DASH
人工智能·音视频·大牛直播sdk·dash·dash还是rtmp·dash还是rtsp·dash还是hls
赞奇科技Xsuperzone4 小时前
DGX Spark 实战解析:模型选择与效率优化全指南
大数据·人工智能·gpt·spark·nvidia