pytorch框架构建resnet模型的实现示例-kb88凯时官网登录

来自：网络

时间：2024-08-28

阅读：

一、训练模型

1.导入资源包

import torch.optim as optim: 导入pytorch的优化工具包，其中包括了各种优化算法，如sgd、adam等。
import torchvision.transforms as transforms: 导入pytorch的视觉变换工具包，用于对图像进行预处理和变换，如调整大小、裁剪、归一化等。
from torchvision import models: 从torchvision模块中导入预训练的模型，如resnet、alexnet、vgg等。

from sched import scheduler
import torch.optim as optim
import torch
import torch.nn as nn
import torch.utils.data
import torchvision.transforms as transforms
import torchvision.datasets as datasets
from torch.utils.data import dataloader
import torch.optim.lr_scheduler as lr_scheduler
import os
from torchvision import models

2.定义数据预处理

这些预处理操作的目的是为了增强模型的泛化能力，并确保模型在训练和验证时输入数据的格式一致。通过这些操作，模型能够接受不同尺寸、角度和方向的图像，从而提高其在实际应用中的表现。同时，归一化处理有助于稳定训练过程，加速模型收敛。，这些预处理操作的目的是为了增强模型的泛化能力，并确保模型在训练和验证时输入数据的格式一致。通过这些操作，模型能够接受不同尺寸、角度和方向的图像，从而提高其在实际应用中的表现。同时，归一化处理有助于稳定训练过程，加速模型收敛。

# 定义数据预处理
transform = {
    'train': transforms.compose([
        transforms.randomresizedcrop(size=256, scale=(0.8, 1.0)),
        transforms.randomrotation(degrees=15),
        transforms.randomhorizontalflip(),
        transforms.centercrop(size=224),
        transforms.totensor(),
        transforms.normalize([0.485, 0.456, 0.406],
                             [0.229, 0.224, 0.225])
    ]),
    'val': transforms.compose([
        transforms.resize(size=256),
        transforms.centercrop(size=224),
        transforms.totensor(),
        transforms.normalize([0.485, 0.456, 0.406],
                             [0.229, 0.224, 0.225])
    ])
}

3.读取数据

# 读取数据
dataset = './dataset'
train_directory = os.path.join(dataset, 'train')
valid_directory = os.path.join(dataset, 'val')
batch_size = 32
num_classes = 2  # 修改为您的分类数
data = {
    'train': datasets.imagefolder(root=train_directory, transform=transform['train']),
    'val': datasets.imagefolder(root=valid_directory, transform=transform['val'])
}
train_loader = dataloader(data['train'], batch_size=batch_size, shuffle=true, num_workers=8)
test_loader = dataloader(data['val'], batch_size=batch_size, shuffle=false, num_workers=8)

注：这段代码的主要目的是读取和准备图像数据集，以便用于训练和验证深度学习模型，这段代码设置了数据加载器，它们将在训练和验证过程中提供经过预处理的图像数据。这些数据加载器是pytorch中用于批量加载数据并使其易于迭代的重要工具。

二、定义卷积神经网络

1.导入必要的库

from torch.autograd import variable: 从torch.autograd模块中导入variable类。variable是pytorch中自动微分的关键类，它封装了张量，并提供了自动计算梯度等功能。然而，从pytorch 0.4版本开始，variable已经被整合到torch.tensor中，因此不再需要显式地从torch.autograd中导入variable。在最新的pytorch版本中，直接使用torch.tensor即可，它继承了variable的所有功能。

# 神经网络
import torch
import torch.nn as nn
from torch.autograd import variable

2.定义名为convolutional_block的卷积块类

这个convolutional_block类定义了一个卷积块，它将输入张量通过两个并行路径（step1和step2），然后将它们的结果相加，并应用relu激活函数。这种结构通常用于残差网络（resnet）中，有助于解决深度网络训练过程中的梯度消失问题。

class convolutional_block(nn.module):#convolutional_block层
    def __init__(self,cn_input,cn_middle,cn_output,s=2):
        super(convolutional_block,self).__init__()
        self.step1=nn.sequential(nn.conv2d(cn_input,cn_middle,(1,1),(s,s),padding=0,bias=false),nn.batchnorm2d(cn_middle,affine=false),nn.relu(inplace=true),
                            nn.conv2d(cn_middle,cn_middle,(3,3),(1,1),padding=(1,1),bias=false),nn.batchnorm2d(cn_middle,affine=false),nn.relu(inplace=true),
                            nn.conv2d(cn_middle,cn_output,(1,1),(1,1),padding=0,bias=false),nn.batchnorm2d(cn_output,affine=false))
        self.step2=nn.sequential(nn.conv2d(cn_input,cn_output,(1,1),(s,s),padding=0,bias=false),nn.batchnorm2d(cn_output,affine=false))
        self.relu=nn.relu(inplace=true)
        
    def forward(self,x):
        x_tmp=x
        x=self.step1(x)
        x_tmp=self.step2(x_tmp)
        x=x x_tmp
        x=self.relu(x)
        return x

3.定义了一个名为identity_block的恒等块类

定义了一个名为identity_block的恒等块类，它也是nn.module的子类。这个类实现了一个恒等块的构造和前向传播过程，它通常用于深度卷积神经网络（cnn）中，特别是在残差网络（resnet）结构中。恒等块的主要特点是输入和输出之间有一个直接的联系（即残差连接），这有助于解决深度网络训练过程中的梯度消失问题。

class identity_block(nn.module):#identity_block层
def __init__(self,cn,cn_middle):
super(identity_block,self).__init__()
self.step=nn.sequential(nn.conv2d(cn,cn_middle,(1,1),(1,1),padding=0,bias=false),nn.batchnorm2d(cn_middle,affine=false),nn.relu(inplace=true),
nn.conv2d(cn_middle,cn_middle,(3,3),(1,1),padding=1,bias=false),nn.batchnorm2d(cn_middle,affine=false),nn.relu(inplace=true),
nn.conv2d(cn_middle,cn,(1,1),(1,1),padding=0,bias=false),nn.batchnorm2d(cn,affine=false))
self.relu=nn.relu(inplace=true)
def forward(self,x):
x_tmp=x
x=self.step(x)
x=x x_tmp
x=self.relu(x)
return x

4.定义了一个名为resnet的深度卷积神经网络类

class resnet(nn.module):#主层
def __init__(self,c_block,i_block):
super(resnet,self).__init__()
self.conv=nn.sequential(nn.conv2d(3,64,(7,7),(2,2),padding=(3,3),bias=false),nn.batchnorm2d(64,affine=false),nn.relu(inplace=true),nn.maxpool2d((3,3),2,1))      
self.layer1=c_block(64,64,256,1)
self.layer2=i_block(256,64)
self.layer3=c_block(256,128,512)
self.layer4=i_block(512,128)
self.layer5=c_block(512,256,1024)
self.layer6=i_block(1024,256)
self.layer7=c_block(1024,512,2048)
self.layer8=i_block(2048,512)
self.out=nn.linear(2048,2,bias=false)
self.avgpool=nn.avgpool2d(7,7)
def forward(self,input):
x=self.conv(input)
x=self.layer1(x)
for i in range(2):            
x=self.layer2(x)
x=self.layer3(x)
for i in range(3):
x=self.layer4(x)
x=self.layer5(x)
for i in range(5):
x=self.layer6(x)
x=self.layer7(x)
for i in range(2):
x=self.layer8(x)
x=self.avgpool(x)
x=x.view(x.size(0),-1)
output=self.out(x)
return output
net=resnet(convolutional_block,identity_block).cuda()

注：这段代码定义了一个resnet结构的深度学习模型，它可以用于图像分类任务。模型的结构是模块化的，可以通过调整卷积块和恒等块的数量和配置来适应不同的需求和数据集。最后，模型被移动到gpu上以加速训练和推理过程。

三、创建模型

1. 检查gpu设备

如果 gpu 可用，则定义一个 torch.device 对象，表示使用 gpu。如果 gpu 不可用，则定义一个 torch.device 对象，表示使用 cpu。

以下是函数的详细步骤：
1)检查 gpu 可用性:

if torch.cuda.is_available(): 这行代码检查是否有可用的 gpu 设备。
device = torch.device(‘cuda’): 如果 gpu 可用，则定义一个 torch.device 对象，表示使用 gpu。
print(“cuda is available! using gpu for training.”): 打印一条消息，表示 cuda
可用，并且使用 gpu 进行训练。
else: 如果 gpu 不可用，则执行以下代码。

2)使用 cpu 进行训练:

evice = torch.device(‘cpu’): 定义一个 torch.device 对象，表示使用 cpu。
print(“cuda is not available. using cpu for training.”): 打印一条消息，表示 cuda 不可用，并且使用 cpu 进行训练。

# 首先，检查是否有可用的 gpu
if torch.cuda.is_available():
    # 定义 gpu 设备
    device = torch.device('cuda')
    print("cuda is available! using gpu for training.")
else:
    # 如果没有可用的 gpu，则使用 cpu
    device = torch.device('cpu')
    print("cuda is not available. using cpu for training.")

2. 训练过程

如果 gpu 可用，将模型移动到 gpu 上，并使用 gpu 进行训练；如果 gpu 不可用，则使用 cpu 进行训练。

3)将模型移动到 gpu:

model.to(device): 将模型移动到之前定义的 device 对象所表示的设备上。如果 device 是 ‘cuda’，则模型将被移动到 gpu；如果 device 是 ‘cpu’，则模型将被移动到 cpu。

4)定义损失函数:

criterion = nn.crossentropyloss(): 定义交叉熵损失函数，这是用于分类问题的常见损失函数。

5)创建优化器:

optimizer = optim.adam(alex_model.parameters(), lr=0.001, weight_decay=1e-4): 创建adam 优化器，其中 lr=0.001 表示学习率为 0.001，weight_decay=1e-4 表示权重衰减为 0.0001。

# 将模型移动到 gpu
model.to(device)
# 定义损失函数
criterion = nn.crossentropyloss()
# 创建优化器
optimizer = optim.adam(alex_model.parameters(), lr=0.001, weight_decay=1e-4)

运行结果：

四、训练模型

1. 设置模型为训练模式

这个函数是训练过程中的核心部分，它执行了模型的前向传播、损失计算、反向传播和参数更新，以及定期输出训练进度和性能指标。

def train(model, device, train_loader, optimizer, epoch):
model.train()
running_loss = 0.0
correct = 0
total = 0
for batch_idx, (data, target) in enumerate(train_loader):
data, target = data.to(device), target.to(device)
optimizer.zero_grad()
output = model(data)
loss = criterion(output, target)
loss.backward()
optimizer.step()
running_loss  = loss.item()
_, predicted = torch.max(output.data, 1)
total  = target.size(0)
correct  = (predicted == target).sum().item()
if batch_idx % 10 == 0:  # 每10个批次打印一次
print(f'epoch {epoch}, batch {batch_idx}, loss: {loss.item()}')
print(f'epoch {epoch}, loss: {running_loss / len(train_loader)}, accuracy: {100 * correct / total}%')

2.定义实验过程

这个函数是模型评估过程中的核心部分，它计算了模型在验证集上的损失和准确率，这些指标对于监控模型性能和调整训练策略非常重要。

# 定义验证过程
def val(model, device, test_loader, criterion):
model.eval()
running_loss = 0.0
correct = 0
total = 0
with torch.no_grad():
for data, target in test_loader:
data, target = data.to(device), target.to(device)
output = model(data)
loss = criterion(output, target)
running_loss  = loss.item()
_, predicted = torch.max(output.data, 1)
total  = target.size(0)
correct  = (predicted == target).sum().item()
print(f'validation, loss: {running_loss / len(test_loader)}, accuracy: {100 * correct / total}%')

3.增加学习率调度器

通过训练和验证过程来优化模型参数，并使用学习率调度器来调整学习率，以提高模型的性能。在实际应用中，epochs通常会设置为一个较大的值，以确保模型得到充分的训练。

# 创建优化器
optimizer = optim.adam(model.parameters(), lr=0.001, weight_decay=1e-4)
# 创建学习率调度器
scheduler = optim.lr_scheduler.steplr(optimizer, step_size=7, gamma=0.1)
# 训练模型
epochs = 1
for epoch in range(1, epochs   1):
train(model, device, train_loader, optimizer, epoch)
val(model, device, test_loader, criterion)
scheduler.step()  # 调整学习率

运行结果：

六、测试模型

1.导入资源包

torchvision.transforms：这个模块提供了一组图像转换操作，可以在数据加载时对图像进行预处理，例如调整大小、裁剪、翻转等。

import torch
from pil import image
import torchvision.transforms as transforms
from torchvision import models
from torch.autograd import variable

2.定义数据预处理

定义图像的预处理步骤，并将使用gpu（如果可用）进行模型训练。在实际应用中，您需要根据自己的数据集和任务需求来调整这些参数。

定义数据预处理

transform = transforms.compose([
transforms.resize(256),
transforms.centercrop(224),
transforms.totensor(),
transforms.normalize(mean=[0.485, 0.456, 0.406], std=[0.229, 0.224, 0.225]),
])
# 定义类别
classes = ['cat', 'dog']  # 替换为您的实际类别名称
# 检查是否有可用的 gpu
device = torch.device("cuda" if torch.cuda.is_available() else "cpu")

3.自定义resnet50模型

定义了一个自定义的resnet-50模型，这是一个在图像识别任务中广泛使用的卷积神经网络（cnn）架构。代码中使用了一些简写，比如c_block和i_block，这些应该是在代码的其他部分定义的类，分别代表resnet中的convolution block（卷积块）和identity block（恒等块）。

# 定义自定义的  resnet50 模型
class resnet(nn.module):#主层
def __init__(self,c_block,i_block):
super(resnet,self).__init__()
self.conv=nn.sequential(nn.conv2d(3,64,(7,7),(2,2),padding=(3,3),bias=false),nn.batchnorm2d(64,affine=false),nn.relu(inplace=true),nn.maxpool2d((3,3),2,1))      
self.layer1=c_block(64,64,256,1)
self.layer2=i_block(256,64)
self.layer3=c_block(256,128,512)
self.layer4=i_block(512,128)
self.layer5=c_block(512,256,1024)
self.layer6=i_block(1024,256)
self.layer7=c_block(1024,512,2048)
self.layer8=i_block(2048,512)
self.out=nn.linear(2048,2,bias=false)
self.avgpool=nn.avgpool2d(7,7)
def forward(self,input):
x=self.conv(input)
x=self.layer1(x)
for i in range(2):            
x=self.layer2(x)
x=self.layer3(x)
for i in range(3):
x=self.layer4(x)
x=self.layer5(x)
for i in range(5):
x=self.layer6(x)
x=self.layer7(x)
for i in range(2):
x=self.layer8(x)
x=self.avgpool(x)
x=x.view(x.size(0),-1)
output=self.out(x)
return output

4.实例化 resnet50 类

用于加载预训练的resnet-50模型，并使用该模型对上传的图片进行预测，image = variable(image).to(device): 这一行将预处理后的图像转换为pytorch变量（如果您的模型需要），并将其移动到device上。

# 实例化 resnet50 类
model=resnet(convolutional_block,identity_block).cuda()
# 加载权重
model.load_state_dict(torch.load("resnet50.pth"))
model.to(device)
model.eval()
# 定义预测函数
def predict_image(image_path):
# 打开图片
image = image.open(image_path)
# 应用预处理
image = transform(image).unsqueeze(0)  # 添加batch维度
# 转换为variable（如果模型需要）
image = variable(image).to(device)
# 获取模型预测
output = model(image)
_, prediction = torch.max(output.data, 1)
return classes[prediction.item()]
# 上传的图片路径
uploaded_image_path = '77.jpg'
# 进行预测
predicted_class = predict_image(uploaded_image_path)
print(f"the uploaded image is predicted as: {predicted_class}")

运行结果：

到此这篇关于pytorch框架构建resnet模型的实现示例的文章就介绍到这了,更多相关pytorch构建resnet模型内容请搜索以前的文章或继续浏览下面的相关文章希望大家以后多多支持！

目录 python 日期和时间戳的转换 python中处理时间的模块 python的time模块将时间戳转换为格式化字符串 python 的datetime模块 datetime模块中定义的类（这些

2024-10-20 21:50:48

目录 1. 异步组件 1.1 使用 defineasynccomponent 1.2 预加载 2. 路由懒加载 3. 动态组件 4. 事件触发的动态加载 5. 按需加载与状态管理结合结论 1. 异步组

2024-10-20 21:50:41

目录引言使用python保存ppt中的所有形状为图像文件用python保存ppt中带格式设计的图片为图像文件引言将powerpoint演示文稿中的形状（幻灯片中的内容元素，包括文本框、图形

2024-10-20 21:50:28

目录前言用python删除pdf文档页边距前言在处理pdf文档时，有时候我们会遇到pdf文件带有较大的页边距的情况。这样过大的页边距不仅浪费了页面空间，而且在打印或电子阅读时也

2024-10-20 21:50:20

目录 1.引言 2.准备工作 3.基础理论知识 4.步骤详解 5.常见问题解答 6.成果案例分享 7.案例代码示例1.引言火柴人（stick figure）是一种极简风格的图形，通常由简单的线段和圆圈

2024-10-20 21:50:09

目录环境介绍类和函数区别封装性：状态保持：可重用性：继承和多态：设计模式：代码组织：执行流程：参数传递：返回值：上下文管理：总结环境window10，pyc

2024-10-20 21:50:03

目录一、jwt的介绍二、jwt的组成 1、header（头部） 2、payload（负载） 3、signature（签名）三、python写jwt 1、安装jwt 2、使用jwt 3、解密jwt 总结一、jwt的介绍jw

2024-10-18 23:10:58

目录视频转换成 gif 图形的重要性 1. 增强表达效果 2. 适应性强 3. 文件大小优化 4. 易于创建和编辑 5. 吸引用户注意力 6. 简化获取信息的步骤用python实现视gif

2024-10-18 23:10:46

目录前言 1. 构建分子式 2. 判断化合价 3. 解析分子式 4. 化合物反应方程式平衡 5. 化合物的摩尔质量计算 6. 计算化合物的质量分数 7. 计算反应热 8. 计算化合物的ph值总

2024-10-18 23:10:16

目录 1 创建 pytest.ini 文件 2 常见参数及配置方法 3 高级配置 4 结论1 创建 pytest.ini 文件在项目的根目录下，创建一个名为 pytest.ini 的文件即可。pytest 会在执行测试

2024-10-18 23:10:06

目录一、xpath概念二、常用规则与方法 1.f12例子: 2.节点获取文本 3.属性匹配 4. 属性获取 5.iframe标签处理三、同级节点元素定位四、关键字定位五、定位

2024-10-18 23:09:49

目录引言发送get请求获取页面的二进制数据添加查询参数发送post请求处理json数据设置自定义header 发送带认证信息的请求发送带有表单数据的请求发送带有文件的请

2024-10-18 23:09:30

安装cpu版本：(以2.9.0版本为例)pip install tensorflow==2.9.0安装gpu版本：(以2.9.0版本为例)pip install tensorflow-gpu==2.9.0若下载缓慢，使用阿里国内镜像源加速下载：(以2.9

2024-10-14 19:47:12

目录概述用asyncio实现hello world 总结概述python中 asyncio 模块内置了对异步io的支持，用于处理异步io；是python 3.4版本引入的标准库。asyncio 的编程模型就是一个消息循

2024-10-14 19:47:02

目录 1. 问题描述 2. 解决办法 2.1 办法一：进入script 进行安装 2.2 办法二：设置环境变量总结 1. 问题描述这几天一直用python实战，今天用pip想要安装一个库，结果突然报了

2024-10-14 19:46:53

目录实践环境问题域定义协议格式(编写proto文件) 编译协议缓冲区协议缓冲区 api 枚举标准消息方法解析和序列化编写消息读取消息另一个示例参考链接

2024-10-14 19:46:35

目录使用pip时报nameerror: name‘pip’is not defined错误 1. 问题描述 2. 解决办法总结使用pip时报nameerror: name‘pip’is not defined错

2024-10-14 19:46:27

目录 1. 概述 2. arange() 2.1 语法 2.2 参数 2.3 实例总结 1. 概述numpy 中 arange() 主要是用于生成数组，具体用法如下；2. arange()2.1 语法numpy.arange(start, sto

2024-10-14 19:46:12

目录 1. 概述 2. vstack() 2.1 语法 2.2 参数 2.3 实例 3. hstack() 3.1 语法 3.2 参数 3.3 实例总结 1. 概述在numpy中，最希望处理的数据就是数组和矩阵，下面就

2024-10-14 19:46:03

目录 python列表简介 numpy数组简介性能比较 1. 数组操作 2. 循环操作内存使用比较 1. 内存占用 2. 大数据集结论在python中，处理数值数据时，我们通常面临两种选

2024-10-14 19:45:55

目录引言基础语法介绍核心概念基本语法规则基础实例问题描述代码示例进阶实例问题描述高级代码实例实战案例问题描述 kb88凯时官网登录的解决方案代码实现扩展

2024-10-14 19:45:46

目录引言 python excel库 python 在excel 中的添加数据条引言在excel中添加数据条是一种数据可视化技巧，它通过条形图的形式在单元格内直观展示数值的大小，尤其适合比较同一

2024-10-14 19:45:37

目录

一、引言

二、什么是查询集？

2.1 创建查询集

三、查询集的延迟加载

3.1 查询集的惰性行为

2024-10-14 19:44:53

字符串问题我正在使用 python 通过 jdbc（或 odbc）访问 iris 数据库。我想将数据提取到 pandas 数据框中来操作数据并从中创建图表。我在使用 jdbc 时遇到了字符串处理问题。

2024-09-30 00:07:53

您的组织是否拥有太多 github 存储库，并且您需要一种简单的方法来总结和记录每个存储库的内容以用于报告、仪表板或审计目的？下面是一个使用 github api 完成该操作的快速脚本

2024-09-30 00:07:10

python构建代理池构建有效的代理池对于爬虫任务至关重要，因为它可以绕过网站反爬或提升爬虫效率。在python中构建代理池的方法如下：一、收集代理免费代理网站：如freeproxylist

2024-09-18 16:06:35

本文介绍基于python语言，针对一个文件夹下大量的excel表格文件，对其中的每一个文件加以操作——将其中指定的若干列的数据部分都向上移动一行，并将所有

2024-09-09 23:42:47

技术背景一般情况下我们会选择使用明文形式来存储数据，如json、txt、csv等等。如果是需要压缩率较高的存储格式，还可以选择使用hdf5或者npz等格式。还有一种比较紧凑的数据存

2024-09-09 23:40:42

要将阿拉伯数字转换成中国汉字表示的数字，我们需要一个映射表来转换每个数字，并且处理不同位数的数字（如十、百、千、万等）。1. python实现阿拉伯数字转换成中国汉字下面是一个

2024-09-09 23:40:16

目录一、问题描述二、问题解决一、问题描述笔者在使用opencv读取带有中文路径的图片时，发现会出现乱码的情况。具体问题如下：# 读取带有中文路径的图片出现错误import cv2img_

2024-08-28 10:54:27

2020-10-21

2021-03-02

2020-05-07

2020-05-26

2021-01-13

2021-04-02

2020-05-10

2020-05-09

2020-05-10

2020-10-21

pytorch框架构建resnet模型的实现示例-kb88凯时官网登录

目录

一、训练模型

1.导入资源包

2.定义数据预处理

3.读取数据

二、定义卷积神经网络

1.导入必要的库

2.定义名为convolutional_block的卷积块类

3.定义了一个名为identity_block的恒等块类

4.定义了一个名为resnet的深度卷积神经网络类

三、创建模型

1. 检查gpu设备

2. 训练过程

四、训练模型

1. 设置模型为训练模式

2.定义实验过程

3.增加学习率调度器

六、测试模型

1.导入资源包

2.定义数据预处理

3.自定义resnet50模型

4.实例化 resnet50 类

热点内容

免费资源网

在线工具

扫一扫随时看

本站下载频道