神经网络入手[上]

  • [x] 神经网络的核心部分
  • [x] Keras介绍
  • [ ] 使用Keras解决简单问题:分类和回归

神经网络剖析

神经网络的训练与下列对象相关:

  • 网络层Layers,网络层结合形成神经网络模型;
  • 输入数据以及对应标签;
  • 损失函数,定义用来学习的反馈信号;
  • 优化方法,定义学习过程。

    关系图:



    网络层堆叠形成网络模型,网络模型由输入数据得到预测值。损失函数比较预测值与实际值,得到损失函数值:用来评估预测结果的好坏;优化方法用损失值来更新网络模型的权重系数。

网络层:神经网络模型的构建模块

网络层是神经网络的基本数据结构。一个网络层把一个或多个数据输入张量进行数据处理过程得到一个或多个输出张量。一些网络层是无状态的(没有网络参数),但大多数网络层是有状态的---网络层的权重系数,这些通过随机梯度下降算法学到的权重张量,形成了网络层的知识

不同的网络进行的数据处理各不相同,因此需要的数据格式及数据类型也有所差异。比如:2D张量,形状为(samples,features)存储简单的向量信息,通常是全连接层(FC 或 Dense)的输入格式要求;LSTM网络层通常处理3D张量,形状为(samples,timesteps,featuers)的序列数据;2D卷积层通常处理存储在4D张量中的图片数据。

可以把网络层看做深度学习的乐高积木块,通过积木块我们可以搭建不同的网络模型。在Keras框架中通过把相互兼容的网络层堆叠形成数据处理过程,而网络层的兼容性是指该网络层接收特定形状的输入张量同时返回特东形状的输出张量

例如:

from keras import layers
layer = layers.Dense(32, input_shape=(784, ))

定义的网络层只接收2D张量,第一维度为784,;同时网络层输出的第一维度为32。

在Keras中,不必担心网络的兼容性,因为添加到网络模型中的网络层是动态构建地,匹配接下来连接的网络层。比如:

from keras import models
from keras import layers model = models.Sequential()
model.add(layers.Dense(32, input_shape=(784, )))
model.add(layers.Dense(32))

第二个Dense层不必定义接收张量的形状,keras能自动定义。

网络模型:网络层堆叠而成

一个神经网络模型是网络层的非循环连接而成。最常见的是网络层的线性连接堆叠,讲一个输入张量转换为一个输出张量。

也存在不同的网络拓扑结构,如:

  • 二分支网络模型;
  • 多分支网络模型;
  • Inception块.

网络模型的拓扑结构定义了一个假设空间。通过选择网络模型的拓扑结构,限制了假设空间能进行的张量操作,通过这些张量操作有输出张量得到对应的输出张量;之后寻找这些张量操作中涉及到的权重系数张量。

网络模型结构的选择与其说是一门科学不如说是一门艺术,尽管存在一些可以依赖的经验和原理,但只有不断尝试才能使你成为一个优秀的神经网络缔造者。

损失函数和优化算法:配置学习过程的关键

网络模型结构定义完成之后,仍然需要定义两件事:

  • 损失函数:训练过程中最小化的函数值,一种评估网络模型的表现;
  • 优化算法:决定基于损失函数如何更新权重系数;有常见的SGD,以及变种SGD算法。

多输出神经网络模型可能有多个损失函数(一个输出一个损失函数)。但是梯度下降过程必然是基于一个损失函数标量值;所以,对于有多个损失函数的网络模型来说,所有的损失函数值必须整合(平均化处理)成一个标量值

特定问题需要选择特定的损失函数。对于常见的问题,如:分类、回归、序列预测,有对应的指导-选择正确的损失函数。具体:二分类问题使用对数损失binary crossentropy,多分类问题采用分类交叉熵categorical crossentropy,回归问题使用均方误差,序列学习问题采用Connectionist temporal classification(CTC)损失函数等等。只有在面对真正要解决的科学问题时,才能决定要使用的损失函数类型以及定义。

Keras 介绍

Keras是一个Python语言的深度学习框架,提供了快速搞笑的深度学习网络模型定义和训练方法。Keras设计初衷是为了方便科学家能进行快速实验。Keras特征:

  • 相同代码同时支持CPU、GPU运行;
  • 用户友好API--网络模型定义、训练方便;
  • 内置卷积神经网络、循环神经网络等等;
  • 支持任意的网络架构:多输入、多输出网络模型,网络层共享,模型共享等等。

    Keras支持所有的Python版本,从2.7到3.6(mid-2017).Keras 有200000个用户,从学术科学家和工程师到新手以及大公司的毕业生,还有兴趣爱好者。Google、Netflix、Uber、CERN、Yelp,Square以及上百个创业公司都猜使用Keras框架应用在相应的业务上。Keras也是Kaggle上流行的网络框架。

Keras,TensorFlow,Theano 和 CNTK

Keras 是一个模型级别的工具库,提供构建神经网络模型的高级API。Keras并不进行底层的操作比如张量操作和导数计算;相应地,Keras以来与特定的张量库进行这些操作,作为Keras的背后引擎。目前,Keras支持3个背后引擎:TensorFlow、Theano和CNTK。将来,有望支持更多的深度学习框架成为Keras的背后计算引擎。

Keras开发

Keras工作流大致如下:

  1. 定义训练数据:输入张量和目标张量;
  2. 定义网络层(或网络模型):由输入张量处理得到输出张量;
  3. 配置训练过程--选择损失函数、优化算法以及监测指标;
  4. 通过调用模型的fit()方法在训练数据上迭代训练。

模型定义有两种方法:使用Sequential类(使用于网络层的线性堆叠,目前最常见);以及函数式API(支持任意网络架构,更灵活)。

方法一:Sequential类

from keras import models
from keras import layers model = models.Sequential()
model.add(layers.Dense(32, activation='relu', input_shape=(784,)))
model.add(layers.Dense(10, activation='softmax'))

方法二: 函数式API

input_tensor = layers.Input(shape=(784,))
x = layers.Dense(32, activation='relu')(input_tensor)
output_tensor = layers.Dense(10, activation='softmax')(x) model = models.Model(inputs=input_tensor, outputs=output_tensor)

一旦模型架构定义完成,不必区分到底网络模型是怎么定义的,之后的处理步骤没有差别。

学习过程在编译过程中配置:定义优化算法、损失函数和监测指标。比如:

from keras import optimizers

model.compile(optimizer=optimizer.RMSProp(lr=0.001),loss='mse',metrics=['accuracy'])

最后,通过fit()方法将numpy数组形式的输入数据(以及对应标签)输入到网络模型中进行模型的学习过程。

model.fit(input_tensor, target_tensor, batch_size=128, epochs=10)

[Deep-Learning-with-Python]神经网络入手学习[上]的更多相关文章

  1. Deep learning with Python 学习笔记(11)

    总结 机器学习(machine learning)是人工智能的一个特殊子领域,其目标是仅靠观察训练数据来自动开发程序[即模型(model)].将数据转换为程序的这个过程叫作学习(learning) 深 ...

  2. Deep learning with Python 学习笔记(10)

    生成式深度学习 机器学习模型能够对图像.音乐和故事的统计潜在空间(latent space)进行学习,然后从这个空间中采样(sample),创造出与模型在训练数据中所见到的艺术作品具有相似特征的新作品 ...

  3. Deep learning with Python 学习笔记(9)

    神经网络模型的优化 使用 Keras 回调函数 使用 model.fit()或 model.fit_generator() 在一个大型数据集上启动数十轮的训练,有点类似于扔一架纸飞机,一开始给它一点推 ...

  4. Deep learning with Python 学习笔记(8)

    Keras 函数式编程 利用 Keras 函数式 API,你可以构建类图(graph-like)模型.在不同的输入之间共享某一层,并且还可以像使用 Python 函数一样使用 Keras 模型.Ker ...

  5. Deep learning with Python 学习笔记(7)

    介绍一维卷积神经网络 卷积神经网络能够进行卷积运算,从局部输入图块中提取特征,并能够将表示模块化,同时可以高效地利用数据.这些性质让卷积神经网络在计算机视觉领域表现优异,同样也让它对序列处理特别有效. ...

  6. Deep learning with Python 学习笔记(6)

    本节介绍循环神经网络及其优化 循环神经网络(RNN,recurrent neural network)处理序列的方式是,遍历所有序列元素,并保存一个状态(state),其中包含与已查看内容相关的信息. ...

  7. Deep learning with Python 学习笔记(5)

    本节讲深度学习用于文本和序列 用于处理序列的两种基本的深度学习算法分别是循环神经网络(recurrent neural network)和一维卷积神经网络(1D convnet) 与其他所有神经网络一 ...

  8. Deep learning with Python 学习笔记(3)

    本节介绍基于Keras的使用预训练模型方法 想要将深度学习应用于小型图像数据集,一种常用且非常高效的方法是使用预训练网络.预训练网络(pretrained network)是一个保存好的网络,之前已在 ...

  9. Deep learning with Python 学习笔记(2)

    本节介绍基于Keras的CNN 卷积神经网络接收形状为 (image_height, image_width, image_channels)的输入张量(不包括批量维度),宽度和高度两个维度的尺寸通常 ...

随机推荐

  1. python之线程、进程

    线程语法 class Thread(_Verbose): """A class that represents a thread of control. This cla ...

  2. Oracle EBS 附件功能

    SELECT fde.table_name, fde.data_object_code, fdet.user_entity_name, fdet.user_entity_prompt, fat.app ...

  3. terminal 总结

    (1) Mac添加命令别名 切换到用户主目录 (2). 编辑或新建.bash_profile文件 (3). 添加别名 alias ll='ls -Alh' (4). 重载该配置文件 source .b ...

  4. Zabbix日常监控之lvs监控

    参考博文:http://blog.51cto.com/kaibinyuan/1711863 监控环境的搭建请参考:https://www.cnblogs.com/huangyanqi/p/918780 ...

  5. 微信小程序 取随机数

    第一思路 如:现在要从50<  . =<100内取一个随机数: ran.Next(1,50)生成的是1-50的随机数+50 结束 第二思路 Math.random()的取值范围是: 0&l ...

  6. [BZOJ 5252][LOJ 2478][九省联考2018] 林克卡特树

    [BZOJ 5252][LOJ 2478][九省联考2018] 林克卡特树 题意 给定一个 \(n\) 个点边带权的无根树, 要求切断其中恰好 \(k\) 条边再连 \(k\) 条边权为 \(0\) ...

  7. Java问题汇总(一) ----------2019/2/22

    第一次写,就弄弄简单样式

  8. springboot+mybatis+mysql创建简单web后台项目

    第一步:搭建框架 新建进入这个页面 新建名字,第一次可以默认,然后下一步 第三步:选择依赖 第四步:新建项目名和存放项目路径(你可以新建一个文件夹存放) 点击finish,首次创建Springboot ...

  9. CI 2.2 + smarty 3.1.18 完美整合配置成功

    CI 2.2 + smarty 3.1.18 配置成功 一.准备文档下载  (CI 框架和smarty) 二.将Smarty-3.1.18 源码包里面的libs文件夹copy到ci的项目目录appli ...

  10. Joinpoint继承体系-笔记

    Joinpoint继承层次图: 由上图可以知道的所有的接口的实现都在ReflectiveMethodInvocation这个类中.ConstructorInvocation接口只有一个方法,这个方法的 ...