IT数码 购物 网址 头条 软件 日历 阅读 图书馆
TxT小说阅读器
↓语音阅读,小说下载,古典文学↓
图片批量下载器
↓批量下载图片,美女图库↓
图片自动播放器
↓图片自动播放器↓
一键清除垃圾
↓轻轻一点,清除系统垃圾↓
开发: C++知识库 Java知识库 JavaScript Python PHP知识库 人工智能 区块链 大数据 移动开发 嵌入式 开发工具 数据结构与算法 开发测试 游戏开发 网络协议 系统运维
教程: HTML教程 CSS教程 JavaScript教程 Go语言教程 JQuery教程 VUE教程 VUE3教程 Bootstrap教程 SQL数据库教程 C语言教程 C++教程 Java教程 Python教程 Python3教程 C#教程
数码: 电脑 笔记本 显卡 显示器 固态硬盘 硬盘 耳机 手机 iphone vivo oppo 小米 华为 单反 装机 图拉丁
 
   -> 人工智能 -> Pytorch学习 - 保存模型和重新加载 -> 正文阅读

[人工智能]Pytorch学习 - 保存模型和重新加载

参考资料:
Pytorch官方文档链接
某博客

1. 3个函数

  1. torch.save() : 讲一个序列化对象保存到磁盘中。使用python的pickle工具。 模型 (model)、张量 (tensor) 和各种对象的字典 (dict) 都可以用这个函数保存。
  2. torch.load() :将pickle对象文件反序列化到内存中,也便于将数据加载到设备中
  3. torch.nn.Module.load_state_dict():加载模型的参数 state_dict介绍
    Pytorch中,torch.nn.Module里面的可学习参数(weights和biases)都存在model.parameters()中。

2. 模型不同后缀名的区别

pytorch常见保存模型文件的后缀名有 .pt , .pth,.pkl。其实它们并不是在格式上有区别,只是后缀不同而已(仅此而已),在用torch.save()函数保存模型文件时,各人有不同的喜好,有些人喜欢用.pt后缀,有些人喜欢用.pth或.pkl.用相同的torch.save()语句保存出来的模型文件没有什么不同。

3. 保存和重载模型

保存模型主要有两种方式:
(1)只保存模型的参数,之后使用时再重新构建一个同样结构的新模型,然后把保存的参数导入新模型。(推荐)

# 保存
torch.save(**model.state_dict()**,PATH)
# 读取
model = TheModelClass(*args,**kwargs) # 需要重新定义模型结构
**model.load_state_dict(torch.load(PATH))**  # 根据模型结构,调用模型参数
model.eval() # ??

(2)将整个模型保存下来,然后直接加载整个模型。(有点耗费内存…)

# 保存
torch.save(**model**,PATH)
# 读取
**model = torch.load(PATH)**  # 不需要重构模型结构,直接load即可
model.eval()

(3)如果没有训练完,仍然需要继续训练,除了model_state_dict需要保存,还需要保存optimizer_state_dict,epoch和loss。

# 保存
torch.save({
            'epoch': epoch,
            'model_state_dict': model.state_dict(),
            'optimizer_state_dict': optimizer.state_dict(),
            'loss': loss,
            ...
            }, PATH)

# 加载 相比于前面只需要加载load_state_dict,还需要加载optimizer,epoch,loss等参数
model = TheModelClass(*args, **kwargs)
optimizer = TheOptimizerClass(*args, **kwargs)

checkpoint = torch.load(PATH)
model.load_state_dict(checkpoint['model_state_dict'])
optimizer.load_state_dict(checkpoint['optimizer_state_dict'])
epoch = checkpoint['epoch']
loss = checkpoint['loss']

model.eval()
# - or -
model.train()
  人工智能 最新文章
2022吴恩达机器学习课程——第二课(神经网
第十五章 规则学习
FixMatch: Simplifying Semi-Supervised Le
数据挖掘Java——Kmeans算法的实现
大脑皮层的分割方法
【翻译】GPT-3是如何工作的
论文笔记:TEACHTEXT: CrossModal Generaliz
python从零学(六)
详解Python 3.x 导入(import)
【答读者问27】backtrader不支持最新版本的
上一篇文章      下一篇文章      查看所有文章
加:2022-02-28 15:28:52  更:2022-02-28 15:35:25 
 
开发: C++知识库 Java知识库 JavaScript Python PHP知识库 人工智能 区块链 大数据 移动开发 嵌入式 开发工具 数据结构与算法 开发测试 游戏开发 网络协议 系统运维
教程: HTML教程 CSS教程 JavaScript教程 Go语言教程 JQuery教程 VUE教程 VUE3教程 Bootstrap教程 SQL数据库教程 C语言教程 C++教程 Java教程 Python教程 Python3教程 C#教程
数码: 电脑 笔记本 显卡 显示器 固态硬盘 硬盘 耳机 手机 iphone vivo oppo 小米 华为 单反 装机 图拉丁

360图书馆 购物 三丰科技 阅读网 日历 万年历 2025年1日历 -2025/1/10 2:30:20-

图片自动播放器
↓图片自动播放器↓
TxT小说阅读器
↓语音阅读,小说下载,古典文学↓
一键清除垃圾
↓轻轻一点,清除系统垃圾↓
图片批量下载器
↓批量下载图片,美女图库↓
  网站联系: qq:121756557 email:121756557@qq.com  IT数码