1.使用RNN做MNIST分类

第一次用LSTM,从简单做起吧~~

注意事项：

batch_first=True 意味着输入的格式为（batch_size,time_step,input_size),False 意味着输入的格式为（time_step,batch_size,input_size)
取r_out[:,-1,:]，即取时间步最后一步的结果，相当于LSTM把一张图片全部扫描完后的返回的状态向量（此时的维度变为（64，64），前面的64是batch_size,后面的64是隐藏层的神经元个数）

 import torch

 from torch.autograd import Variable

 from torchvision import datasets,transforms

 #超参数

 EPOCH=1

 BATCH_SIZE=64

 TIME_STEP=28#run time step/image height

 INPUT_SIZE=28#run input size/image width

 LR=0.01

 DOWNLOAD_MNIST=True

 train_data=datasets.MNIST(root='./mnist',train=True,transform=transforms.ToTensor(),download=DOWNLOAD_MNIST)

 train_loader=torch.utils.data.DataLoader(dataset=train_data,batch_size=BATCH_SIZE,shuffle=True)

 test_data=datasets.MNIST(root='./mnist',train=False,transform=transforms.ToTensor(),download=DOWNLOAD_MNIST)

 test_loader=torch.utils.data.DataLoader(dataset=test_data,batch_size=BATCH_SIZE,shuffle=True)

 class RNN(torch.nn.Module):

     def __init__(self):

         super(RNN,self).__init__()

         self.rnn=torch.nn.LSTM(

             input_size=INPUT_SIZE,

             hidden_size=64,

             num_layers=1,

             batch_first=True,

         )

         self.out=torch.nn.Linear(64,10)

     def forward(self, x):

         r_out,(h_n,h_c)=self.rnn(x,None)#[64,28,64]

         out=self.out(r_out[:,-1,:])#[64,10]

         return out

 #time_step,batch,input  batch_first=False,

 rnn=RNN()

 print(rnn)

 optimizer=torch.optim.Adam(rnn.parameters(),lr=LR)

 loss_func=torch.nn.CrossEntropyLoss()

 for epoch in range(EPOCH):

     for step,(x,y) in enumerate(train_loader):

         b_x=Variable(x.view(-1,28,28))#reshape x to (batch,time_step.input_size)

         b_y=Variable(y).squeeze()

         output=rnn(b_x)

         loss=loss_func(output,b_y)

         optimizer.zero_grad()

         loss.backward()

         optimizer.step()

         if step %50==0:

             for test_x,test_y in test_loader:

                 test_output=rnn(test_x.view(-1,28,28))

                 pred_y=torch.max(test_output,1)[1].data.numpy().squeeze()

                 test_y=test_y.numpy()

                 acc=sum(pred_y==test_y)/test_y.size

                 print(acc)

1.使用RNN做MNIST分类的更多相关文章

芝麻HTTP：TensorFlow LSTM MNIST分类
本节来介绍一下使用 RNN 的 LSTM 来做 MNIST 分类的方法,RNN 相比 CNN 来说,速度可能会慢,但可以节省更多的内存空间. 初始化首先我们可以先初始化一些变量,如学习率.节点单元数 ...
2.使用RNN做诗歌生成
诗歌生成比分类问题要稍微麻烦一些,而且第一次使用RNN做文本方面的问题,还是有很多概念性的东西~~~ 数据下载: 链接:https://pan.baidu.com/s/1uCDup7U5rGuIlIb ...
使用CNN做文本分类——将图像2维卷积换成1维
使用CNN做文本分类 from __future__ import division, print_function, absolute_import import tensorflow as tf ...
《机器学习系统设计》之应用scikit-learn做文本分类（上）
前言: 本系列是在作者学习<机器学习系统设计>([美] WilliRichert)过程中的思考与实践,全书通过Python从数据处理.到特征project,再到模型选择,把机器学习解决这个 ...
Tensorflow实战第十课（RNN MNIST分类）
设置RNN的参数我们本节采用RNN来进行分类的训练(classifiction).会继续使用手写数据集MNIST. 让RNN从每张图片的第一行像素读到最后一行,然后进行分类判断.接下来我们导入MNI ...
深度学习原理与框架-Tensorflow卷积神经网络-卷积神经网络mnist分类 1.tf.nn.conv2d(卷积操作) 2.tf.nn.max_pool(最大池化操作) 3.tf.nn.dropout(执行dropout操作) 4.tf.nn.softmax_cross_entropy_with_logits(交叉熵损失) 5.tf.truncated_normal(两个标准差内的正态分布)
1. tf.nn.conv2d(x, w, strides=[1, 1, 1, 1], padding='SAME') # 对数据进行卷积操作参数说明:x表示输入数据,w表示卷积核, stride ...
TensorFlow入门（三）多层 CNNs 实现 mnist分类
欢迎转载,但请务必注明原文出处及作者信息. 深入MNIST refer: http://wiki.jikexueyuan.com/project/tensorflow-zh/tutorials/mni ...
用keras的cnn做人脸分类
keras介绍 Keras是一个简约,高度模块化的神经网络库.采用Python / Theano开发. 使用Keras如果你需要一个深度学习库: 可以很容易和快速实现原型(通过总模块化,极简主义,和可 ...
tensorflow RNN循环神经网络 (分类例子)-【老鱼学tensorflow】
之前我们学习过用CNN(卷积神经网络)来识别手写字,在CNN中是把图片看成了二维矩阵,然后在二维矩阵中堆叠高度值来进行识别. 而在RNN中增添了时间的维度,因为我们会发现有些图片或者语言或语音等会在时 ...

随机推荐

bzoj 2816: [ZJOI2012]网络 (LCT 建多棵树)
链接:https://www.lydsy.com/JudgeOnline/problem.php?id=2816 题面: http://www.lydsy.com/JudgeOnline/upload ...
打印并输出 log/日志到文件（C++）
#include <stdarg.h> #define MAX_LEN 1024 bool debug_mode; // 使用方法同 printf void lprintf(const c ...
jmeter笔记（1）--原理，下载与安装
Apache JMeter是Apache组织开发的基于Java的压力测试工具.用于对软件做压力测试,它最初被设计用于Web应用测试,但后来扩展到其他测试领域. 它可以用于测试静态和动态资源,例如静态文 ...
百度在职 iOS 架构师的成长笔记，送给还在迷茫的你！
前言我们经常在网上会看到这样的文章,你的同龄人正在如何如何.......这是典型的贩卖焦虑的文章.的确,现阶段,刚毕业几年的年轻人,面临车,房子等,有时候压力挺大的. 但你过度焦虑的话,每天生活在恐 ...
css实现文本两端对齐
display:inline-block; text-align:center; text-align-last:justify;
maven wrapper使用本地maven
修改maven-wrapper.properties内容如下: #distributionUrl=https://repo1.maven.org/maven2/org/apache/maven/apa ...
Kubenetes 资源清单定义入门
Kubernetes 常用资源资源对象工作负载型资源对象(workload): Pod Replicaset ReplicationController Deployments Stat ...
MySQL安全配置向导mysql_secure_installation详解
安装完mysql-server 会提示可以运行mysql_secure_installation.运行mysql_secure_installation会执行几个设置: a)为root用户设置密码 ...
JAVA关于字符串&&字符数组处理的小题目
JAVA关于字符串&&字符数组的小题目第二题:分析以下需求,并用代码实现 1.键盘录入一个大字符串,再录入一个小字符串 2.统计小字符串在大字符串中出现的次数 3.代码运行打印格式: ...
Linux查看系统信息的命令及已安装软件包的命令
系统 uname -a查看内核/操作系统/CPU信息head -n 1 /etc/issue查看操作系统版本cat /proc/cpuinfo查看CPU信息hostname查看计算机名lspci -t ...

1.使用RNN做MNIST分类

1.使用RNN做MNIST分类的更多相关文章

随机推荐

热门专题