当前位置: 首页 > news >正文

一般网站尺寸centos lnmp wordpress

一般网站尺寸,centos lnmp wordpress,网站营销公司,成都公司网页制作公司strictFalse 但还是size mismatch for []: copying a param with shape [] from checkpoint,the shape in cur 问题 我们知道通过 model.load_state_dict(state_dict, strictFalse)可以暂且忽略掉模型和参数文件中不匹配的参数#xff0c;先将正常匹配的参数从文件中载入模…strictFalse 但还是size mismatch for []: copying a param with shape [] from checkpoint,the shape in cur 问题 我们知道通过 model.load_state_dict(state_dict, strictFalse)可以暂且忽略掉模型和参数文件中不匹配的参数先将正常匹配的参数从文件中载入模型。 笔者在使用时遇到了这样一个报错 RuntimeError: Error(s) in loading state_dict for ViT_Aes:size mismatch for mlp_head.1.weight: copying a param with shape torch.Size([1000, 768]) from checkpoint, the shape in current model is torch.Size([10, 768]).size mismatch for mlp_head.1.bias: copying a param with shape torch.Size([1000]) from checkpoint, the shape in current model is torch.Size([10]).一开始笔者很奇怪我已经写明strictFalse了不匹配参数的不管就是了为什么还要给我报错。 原因及解决方案 经过笔者仔细打印模型的键和文件中的键进行比对发现是这样的strictFalse可以保证模型中的键与文件中的键不匹配时暂且跳过不管但是一旦模型中的键和文件中的键匹配上了PyTorch就会尝试帮我们加载参数就必须要求参数的尺寸相同所以会有上述报错。 比如在我们需要将某个预训练的模型的最后的全连接层的输出的类别数替换为我们自己的数据集的类别数再进行微调有时会遇到上述情况。这时我们知道全连接层的参数形状会是不匹配比如我们加载 ImageNet 1K 1000分类的预训练模型它的最后一层全连接的输出维度是1000但如果我们自己的数据集是10分类我们需要将最后一层全链接的输出维度改为10。但是由于键名相同所以PyTorch还是尝试给我们加载这时1000和10维度不匹配就会导致报错。 解决方案就是我们将 .pth 模型文件读入后将其中我们不需要的层通常是最后的全连接层的参数pop掉即可。 以 ViT 为例子假设我们有一个 ViT 模型并有一个参数文件 vit-in1k.pth它里面存储着 ViT 模型在 ImageNet-1K 1000分类数据集上训练的参数而我们要在自己的10分类数据集上微调这个模型。 model ViT(num_classes10) ckpt torch.load(vit-in1k.pth, map_locationcpu) msg model.load_state_dict(ckpt, strictFalse) print(msg)直接这样加载会出错就是上面的错误 size mismatch for head.weight: copying a param with shape torch.Size([1000, 768]) from checkpoint, the shape in current model is torch.Size([10, 768]).size mismatch for head.bias: copying a param with shape torch.Size([1000]) from checkpoint, the shape in current model is torch.Size([10]).我们将最后 pth 文件加载进来之后即 ckpt 中全连接层的参数直接pop掉至于需要pop掉哪些键名就是上面报错信息中提到了的在这里就是 head.weight 和 head.bias ckpt.pop(head.weight) ckpt.pop(head.bias)之后在运行会发现我们打印的 msg 显示 _IncompatibleKeys(missing_keys[head.weight, head.bias], unexpected_keys[])即缺失了head.weight 和 head.bias 这两个参数这是正常的因为在自己的数据集上微调时我们本就不需要这两个参数并且已经将它们从模型文件字典 ckpt 中pop掉了。现在模型全连接之前的层通常即所谓的特征提取层的参数已经正常加载了接下来可以在自己的数据集上进行微调。 因为反正我们也不用这些参数就直接把这个键值对从字典中pop掉以免 PyTorch 在帮我们加载时试图加载这些维度不匹配我们也不需要的参数。
http://wiki.neutronadmin.com/news/227809/

相关文章:

  • 广告公司简介ppt娄底地seo
  • 举报网站建设长春新建设
  • 外贸网站建设公司信息iis配置网站无法访问
  • 网站注册信息wordpress 密码 hello
  • 一个旅游网站建设wordpress数据库域名表
  • 靖江网站推广做网站的步骤视频
  • 网站建设验收条款业务多平台怎么样
  • 如何规划企业网站做一个关于电影的网页设计
  • 做图网站有哪些东西做了半个月跨境电商不想干了
  • 网站建设与推广方案建行app下载官网
  • 看车二手车网站源码营销型网站功能模块
  • 做网站申请个体户谷歌seo快速排名优化方法
  • 网站收录入口是什么建收费网站
  • 网站建设去哪里学淄博网站设
  • 国内做视频课程的网站有哪些专业网站建设86215
  • wordpress 网站备案宁德市人社局官网
  • 深圳html5网站推广价格wordpress面包屑代码
  • 内涵 网站 源码网页架构人才培训中心
  • 重庆交通网站建设建设网站的技术方案是啥
  • 南京做网站多少钱怎么搭建一个微信小程序
  • 网站优化建设安徽百度网首页登录入口
  • 网站开发市场前景百度最新版app下载安装
  • 海淀教育互动平台网站建设如何做搞笑原创视频网站
  • 如何建设一个网站站佛山贸易网站建设
  • 陕西省建设集团公司网站上海网站建设公司兴田德润可以不
  • 不用花生壳做网站服务器wordpress 反应慢
  • j2ee大型网站开发框架宝洁公司网站建设案例
  • 软件开发可以做网站么整装公司排名前十强
  • php如何自学做网站即墨今天新闻大事
  • A00网站建设河北廊坊公布新增阳性人员轨迹