最新国产好看的视频,伊人天堂AV在线,国产Aaaaaa视频,蜜臀视频在线观看一区,人妻av色图,密臀久久久精品影片,青青视频免费观看毛片,久草在线观看视,国产三级精品色情在线

pytorch模型的保存和加載、checkpoint操作

 更新時間:2021年06月05日 15:59:01   作者:幼稚園的扛把子~  
這篇文章主要介紹了pytorch模型的保存和加載、checkpoint操作,具有很好的參考價值,希望對大家有所幫助。如有錯誤或未考慮完全的地方,望不吝賜教

其實之前筆者寫代碼的時候用到模型的保存和加載,需要用的時候就去度娘搜一下大致代碼,現(xiàn)在有時間就來整理下整個pytorch模型的保存和加載,開始學習把~

pytorch的模型和參數(shù)是分開的,可以分別保存或加載模型和參數(shù)。所以pytorch的保存和加載對應存在兩種方式:

1. 直接保存加載模型

(1)保存和加載整個模型

# 保存模型
torch.save(model, 'model.pth\pkl\pt')    #一般形式torch.save(net, PATH) 
# 加載模型
model = torch.load('model.pth\pkl\pt')   #一般形式為model_dict=torch.load(PATH)

(2)僅保存和加載模型參數(shù)(推薦使用,需要提前手動構建模型)

速度快,占空間少

# 保存模型參數(shù)
torch.save(model.state_dict(), 'model.pth\pkl\pt')  #一般形式為torch.save(net.state_dict(),PATH)
# 加載模型參數(shù)
model.load_state_dict(torch.load('model.pth\pkl\pt') #一般形式為model_dict=model.load_state_dict(torch.load(PATH))

state_dict() 是一個Python字典,將每一層映射成它的參數(shù)張量。注意只有帶有可學習參數(shù)的層(卷積層、全連接層等),以及注冊的緩存(batchnorm的運行平均值)在state_dict 中才有記錄。state_dict同樣包含優(yōu)化器對象,存儲了優(yōu)化器的狀態(tài),所使用到的超參數(shù)。

然而,在實驗中往往需要保存更多的信息,比如優(yōu)化器的參數(shù),那么可以采取下面的方法保存:

torch.save({'epoch': epochID + 1, 'state_dict': model.state_dict(), 'best_loss': lossMIN,
        'optimizer': optimizer.state_dict(),'alpha': loss.alpha, 'gamma': loss.gamma},
        checkpoint_path + '/m-' + launchTimestamp + '-' + str("%.4f" % lossMIN) + '.pth.tar')

如下一個完整的使用model.state_dict()和optimizer.state_dict()例子:

# 定義模型
class TheModelClass(nn.Module):        #定義一個神經網(wǎng)絡模型 TheModelClass
    def __init__(self):
        super(TheModelClass, self).__init__()
        self.conv1 = nn.Conv2d(3, 6, 5)
        self.pool = nn.MaxPool2d(2, 2)
        self.conv2 = nn.Conv2d(6, 16, 5)
        self.fc1 = nn.Linear(16 * 5 * 5, 120)
        self.fc2 = nn.Linear(120, 84)
        self.fc3 = nn.Linear(84, 10)

    def forward(self, x):
        x = self.pool(F.relu(self.conv1(x)))
        x = self.pool(F.relu(self.conv2(x)))
        x = x.view(-1, 16 * 5 * 5)
        x = F.relu(self.fc1(x))
        x = F.relu(self.fc2(x))
        x = self.fc3(x)
        return x

# 初始化模型
model = TheModelClass()

# 初始化優(yōu)化器
optimizer = optim.SGD(model.parameters(), lr=0.001, momentum=0.9)

# 打印模型的 state_dict
print("Model's state_dict:")
for param_tensor in model.state_dict():        # param_tensor 為參數(shù)名稱
    print(param_tensor, "\t", model.state_dict()[param_tensor].size())

# 打印優(yōu)化器的 state_dict
print("Optimizer's state_dict:")
for var_name in optimizer.state_dict():
    print(var_name, "\t", optimizer.state_dict()[var_name])

輸出結果:

Model's state_dict:
conv1.weight torch.Size([6, 3, 5, 5])
conv1.bias torch.Size([6])
conv2.weight torch.Size([16, 6, 5, 5])
conv2.bias torch.Size([16])
fc1.weight torch.Size([120, 400])
fc1.bias torch.Size([120])
fc2.weight torch.Size([84, 120])
fc2.bias torch.Size([84])
fc3.weight torch.Size([10, 84])
fc3.bias torch.Size([10])

Optimizer's state_dict:
state {}
param_groups [{'lr': 0.001, 'momentum': 0.9, 'dampening': 0, 'weight_decay': 0, 'nesterov': False, 'params': [4675713712, 4675713784, 4675714000, 4675714072, 4675714216, 4675714288, 4675714432, 4675714504, 4675714648, 4675714720]}]

(3)load提供了很多重載的功能,其可以把在GPU上訓練的權重加載到CPU上跑

torch.load('tensors.pt')
# 強制所有GPU張量加載到CPU中
torch.load('tensors.pt', map_location=lambda storage, loc: storage)  #或者model.load_state_dict(torch.load('model.pth', map_location='cpu'))
# 把所有的張量加載到GPU 1中
torch.load('tensors.pt', map_location=lambda storage, loc: storage.cuda(1))
# 把張量從GPU 1 移動到 GPU 0
torch.load('tensors.pt', map_location={'cuda:1':'cuda:0'})

上述代碼只有在模型在一個GPU上訓練時才起作用。如果我在多個GPU上訓練模型并且保存它,然后嘗試在CPU上加載,會得到錯誤:KeyError: ‘unexpected key “module.conv1.weight” in state_dict' 如何解決?

因為此時已經使用模型保存了模型nn.DataParallel,該模型將模型存儲在該模型中module,而現(xiàn)在您正試圖加載模型DataParallel。您可以nn.DataParallel在網(wǎng)絡中暫時添加一個加載目的,也可以加載權重文件,創(chuàng)建一個沒有module前綴的新的有序字典,然后加載它。看第(4)點

(4)通過DataParalle使用多GPU時的保存和加載

odel=DataParalle(model)
#保存參數(shù)
torch.save(model.module.state_dict(), 'model.pth')

由此看出多個GPU時多了一個該模型中module,加載再cpu時,創(chuàng)建一個沒有module前綴的新的有序字典,然后加載它。

補充:一般來說,PyTorch的模型以.pt或者.pth文件格式保存。

2. 保存加載用于推理的常規(guī)Checkpoint/或繼續(xù)訓練**

checkpoint檢查點:不僅保存模型的參數(shù),優(yōu)化器參數(shù),還有l(wèi)oss,epoch等(相當于一個保存模型的文件夾)

if (epoch+1) % checkpoint_interval == 0:

        checkpoint = {"model_state_dict": net.state_dict(),
                      "optimizer_state_dict": optimizer.state_dict(),
                      "epoch": epoch}
        path_checkpoint = "./checkpoint_{}_epoch.pkl".format(epoch)
        torch.save(checkpoint, path_checkpoint)
#或者
#保存
torch.save({
            'epoch': epoch,
            'model_state_dict': model.state_dict(),
            'optimizer_state_dict': optimizer.state_dict(),
            'loss': loss,
            ...
            }, PATH)
#加載
model = TheModelClass(*args, **kwargs)
optimizer = TheOptimizerClass(*args, **kwargs)

checkpoint = torch.load(PATH)
model.load_state_dict(checkpoint['model_state_dict'])
optimizer.load_state_dict(checkpoint['optimizer_state_dict'])
epoch = checkpoint['epoch']
loss = checkpoint['loss']

model.eval()
# - 或者 -
model.train()

注意:

在保存用于推理或者繼續(xù)訓練的常規(guī)檢查點的時候,除了模型的state_dict之外,還必須保存其他參數(shù)。保存優(yōu)化器的state_dict也非常重要,因為它包含了模型在訓練時候優(yōu)化器的緩存和參數(shù)。除此之外,還可以保存停止訓練時epoch數(shù),最新的模型損失,額外的torch.nn.Embedding層等。

要保存多個組件,則將它們放到一個字典中,然后使用torch.save()序列化這個字典。一般來說,使用.tar文件格式來保存這些檢查點。

加載各個組件,首先初始化模型和優(yōu)化器,然后使用torch.load()加載保存的字典,然后可以直接查詢字典中的值來獲取保存的組件。

同樣,評估模型的時候一定不要忘了調用model.eval()。

是不是很簡單??!以上為個人經驗,希望能給大家一個參考,也希望大家多多支持腳本之家。

相關文章

  • Python中使用ipython的詳細教程

    Python中使用ipython的詳細教程

    ipython是一個非常流行的python解釋器,比python解釋器好用很多,本文重點給大家介紹Python中使用ipython的詳細教程,需要的朋友參考下吧
    2021-06-06
  • 使用python實現(xiàn)數(shù)據(jù)篩查

    使用python實現(xiàn)數(shù)據(jù)篩查

    一般數(shù)據(jù)篩查可以通過Python中的pandas庫來實現(xiàn),下面小編就來為大家介紹一下Python如何利用pandas實現(xiàn)數(shù)據(jù)篩查,感興趣的小伙伴可以一起學習一下
    2023-10-10
  • Python 3.x讀寫csv文件中數(shù)字的方法示例

    Python 3.x讀寫csv文件中數(shù)字的方法示例

    在我們日常開發(fā)中經常需要對csv文件進行讀寫,下面這篇文章主要給大家介紹了關于Python 3.x讀寫csv文件中數(shù)字的相關資料,文中通過示例代碼介紹的非常詳細,對大家具有一定的參考學習價值,需要的朋友們下面跟著小編來一起學習學習吧。
    2017-08-08
  • 如何利用Python將html轉為pdf、word文件

    如何利用Python將html轉為pdf、word文件

    網(wǎng)絡上存在很多將HTML轉換為PDF的軟件和工具,但是大家都知道收費,所以下面這篇文章主要給大家介紹了關于如何利用Python將html轉為pdf、word文件的相關資料,文中通過示例代碼介紹介紹的非常詳細,需要的朋友可以參考下
    2022-12-12
  • Python獲取C++中返回的char*字段的兩種思路

    Python獲取C++中返回的char*字段的兩種思路

    有時候需要獲取C++函數(shù)中返回來的不定長的char*字符串,本文小編為大家找到了兩種解決問題的思路,感興趣的小伙伴可以跟隨小編一起學習一下
    2025-04-04
  • python實現(xiàn)任意位置文件分割的實例

    python實現(xiàn)任意位置文件分割的實例

    今天小編就為大家分享一篇python實現(xiàn)任意位置文件分割的實例,具有很好的參考價值,希望對大家有所幫助。一起跟隨小編過來看看吧
    2018-12-12
  • Python socket套接字實現(xiàn)C/S模式遠程命令執(zhí)行功能案例

    Python socket套接字實現(xiàn)C/S模式遠程命令執(zhí)行功能案例

    這篇文章主要介紹了Python socket套接字實現(xiàn)C/S模式遠程命令執(zhí)行功能,涉及Python socket套接字編寫服務器/客戶機模式數(shù)據(jù)傳輸相關操作技巧,需要的朋友可以參考下
    2018-07-07
  • 解決redis與Python交互取出來的是bytes類型的問題

    解決redis與Python交互取出來的是bytes類型的問題

    這篇文章主要介紹了解決redis與Python交互取出來的是bytes類型的問題,具有很好的參考價值,希望對大家有所幫助。一起跟隨小編過來看看吧
    2020-07-07
  • django rest framework使用django-filter用法

    django rest framework使用django-filter用法

    這篇文章主要介紹了django rest framework使用django-filter用法,具有很好的參考價值,希望對大家有所幫助。一起跟隨小編過來看看吧
    2020-07-07
  • 解決Python中由于logging模塊誤用導致的內存泄露

    解決Python中由于logging模塊誤用導致的內存泄露

    這篇文章主要介紹了解決Python中由于logging模塊誤用導致的內存泄露,針對由于過多的UDP連接所產生的問題,需要的朋友可以參考下
    2015-04-04

最新評論

宁晋县| 探索| 宁化县| 南部县| 治县。| 扎鲁特旗| 环江| 临安市| 左贡县| 惠水县| 荣成市| 长沙市| 濉溪县| 陈巴尔虎旗| 马公市| 忻州市| 西藏| 兴城市| 扎赉特旗| 乃东县| 平邑县| 黑山县| 宿迁市| 鄯善县| 长顺县| 陵川县| 贞丰县| 河源市| 鞍山市| 边坝县| 大名县| 灵武市| 宝清县| 康定县| 云林县| 镇雄县| 芜湖县| 乐业县| 广西| 依兰县| 云浮市|