pytorch深度學習神經網絡實現手寫字體識別

本文轉載自查看原文 2019-09-17 23:51 1183 人工智能與機器學習/ 深度學習與神經網絡/ Python數據分析與處理/ Python

利用平pytorch搭建簡單的神經網絡實現minist手寫字體的識別，采用三層線性函數迭代運算，使得其具備一定的非線性轉化與運算能力，其數學原理如下：


其具體實現代碼如下所示：
import torch
import matplotlib.pyplot as  plt
def plot_curve(data):    #曲線輸出函數構建
    fig=plt.figure()
    plt.plot(range(len(data)),data,color="blue")
    plt.legend(["value"],loc="upper right")
    plt.xlabel("step")
    plt.ylabel("value")
    plt.show()

def plot_image(img,label,name): #輸出二維圖像灰度圖
    fig=plt.figure()
    for i in range(6):
        plt.subplot(2,3,i+1)
        plt.tight_layout()
        plt.imshow(img[i][0]*0.3081+0.1307,cmap="gray",interpolation="none")
        plt.title("{}:{}".format(name, label[i].item()))
        plt.xticks([])
        plt.yticks([])
    plt.show()
def one_hot(label,depth=10):      #根據分類結果的數目將結果轉換為一定的矩陣形式[n,1],n為分類結果的數目
    out=torch.zeros(label.size(0),depth)
    idx=torch.LongTensor(label).view(-1,1)
    out.scatter_(dim=1,index=idx,value=1)
    return out

batch_size=512
import torch
from torch import nn                         #完成神經網絡的構建包
from torch.nn import functional as F         #包含常用的函數包
from torch import optim                      #優化工具包
import torchvision                           #視覺工具包
import  matplotlib.pyplot as plt
from utils import plot_curve,plot_image,one_hot
#step1 load dataset 加載數據包
train_loader=torch.utils.data.DataLoader(
    torchvision.datasets.MNIST("minist_data",train=True,download=True,transform=torchvision.transforms.Compose(
        [torchvision.transforms.ToTensor(),torchvision.transforms.Normalize((0.1307,),(0.3081,))
         ])),
    batch_size=batch_size,shuffle=True)
test_loader=torch.utils.data.DataLoader(
    torchvision.datasets.MNIST("minist_data",train=True,download=False,transform=torchvision.transforms.Compose(
        [torchvision.transforms.ToTensor(),torchvision.transforms.Normalize((0.1307,),(0.3081,))
         ])),
    batch_size=batch_size,shuffle=False)
x,y=next(iter(train_loader))
print(x.shape,y.shape)
plot_image(x,y,"image")
print(x)
print(y)

#構建神經網絡結構
class Net(nn.Module):
    def __init__(self):
        super(Net,self).__init__()
        #xw+b
        self.fc1=nn.Linear(28*28,256)
        self.fc2=nn.Linear(256,64)
        self.fc3=nn.Linear(64,10)
    def forward(self, x):
        #x:[b,1,28,28]
        #h1=relu(xw1+b1)
        x=F.relu(self.fc1(x))
        #h2=relu(h1w2+b2)
        x=F.relu(self.fc2(x))
        #h3=h2w3+b3
        x=(self.fc3(x))
        return x

net=Net()
#[w1,b1,w2,b2,w3,b3]
optimizer=optim.SGD(net.parameters(),lr=0.01,momentum=0.9)
train_loss=[]
for epoch in range(3):
    for batch_idx,(x,y) in enumerate(train_loader):
        #x:[b,1,28,28],y:[512]
        x=x.view(x.size(0),28*28)
        # => [b,10]
        out =net(x)
        # [b,10]
        y_onehot=one_hot(y)
        #loss=mse(out,y_onehot)
        loss= F.mse_loss(out,y_onehot)

        optimizer.zero_grad()
        loss.backward()
        #w'=w-lr*grad
        optimizer.step()
        train_loss.append(loss.item())

        if batch_idx %10==0:
           print(epoch,batch_idx,loss.item()) #輸出其預測loss損失函數的變化曲線
plot_curve(train_loss)
#get optimal [w1,b1,w2,b2,w3,b3]

total_correct=0
for x,y in test_loader:
    x=x.view(x.size(0),28*28)
    out=net(x)
    pred=out.argmax(dim=1)
    correct=pred.eq(y).sum().float().item()
    total_correct+=correct
total_num=len(test_loader.dataset)
acc=total_correct/total_num
print("test.acc:",acc) #輸出整體預測的准確度

x,y=next(iter(test_loader))
out=net(x.view(x.size(0),28*28))
pred=out.argmax(dim=1)
plot_image(x,pred,"test")
實現結果如下所示：

免責聲明！

本站轉載的文章為個人學習借鑒使用，本站對版權不負任何法律責任。如果侵犯了您的隱私權益，請聯系本站郵箱yoyou2525@163.com刪除。

猜您在找 神經網絡-手寫字體識別【深度學習】paddlepaddle——基於卷積神經網絡的手寫字識別案例莫煩pytorch學習筆記（八）——卷積神經網絡（手寫數字識別實現） [神經網絡與深度學習（一）]使用神經網絡識別手寫數字 tensorflow卷積神經網絡與手寫字識別 (CNN卷積神經網絡)用pytorch實現多層感知機（MLP)（全連接神經網絡FC）分類MNIST手寫數字體的識別深度學習---手寫字體識別程序分析（python）【神經網絡和深度學習】筆記 - 第一章使用神經網絡識別手寫數字《神經網絡與深度學習》第一章使用神經網絡來識別手寫數字（三）- 用Python代碼實現《神經網絡與深度學習》：第一章使用神經網絡來識別手寫數字（一）