不同层设置不同学习率

来自网友在路上 146846提问提问时间：2023-09-22 05:51:20阅读次数： 46

最佳答案问答题库468位专家为你答疑解惑

使用预训练模型时，可能需要将
（1）预训练好的 backbone 的参数学习率设置为较小值，
（2）而backbone 之外的部分，需要使用较大的学习率。

from collections import OrderedDict
import torch.nn as nn
import torch.optim as optimnet = nn.Sequential(OrderedDict([("linear1", nn.Linear(10, 20)),("linear2", nn.Linear(20, 30)),("linear3", nn.Linear(30, 40))]))linear3_params = list(map(id, net.linear3.parameters()))
base_params = filter(lambda p: id(p) not in linear3_params, net.parameters())optimizer = optim.SGD([{'params': base_params},{'params': net.linear3.parameters(), 'lr': 0.0005}],lr=0.001, momentum=0.9)print(optimizer)
print(optimizer.param_groups[0]['lr'])
print(optimizer.param_groups[1]['lr'])

查看全文

99%的人还看了

相似问题

【LeetCode刷题-双指针】--259.较小的三数之和

猜你感兴趣

版权申明

本文"不同层设置不同学习率"：http://eshow365.cn/6-11233-0.html 内容来自互联网，请自行判断内容的正确性。如有侵权请联系我们，立即删除！

上一篇: Eclipse 安装 Lombok
下一篇: Python与数据分析--每天绘制Matplotlib库实例图片3张-第1天

晴海小常识分享

晴海小常识分享

不同层设置不同学习率

最佳答案问答题库468位专家为你答疑解惑

99%的人还看了

相似问题

猜你感兴趣

版权申明

推荐回答

晴海小常识分享

晴海小常识分享

不同层设置不同学习率

最佳答案 问答题库468位专家为你答疑解惑

99%的人还看了

相似问题

猜你感兴趣

版权申明

推荐回答

最佳答案问答题库468位专家为你答疑解惑