反向传播（Back Propagation）

Remixi 2024-09-08 05:45:50 原文

反向传播（Back Propagation）

通常在设计好一个神经网络后，参数的数量可能会达到百万级别。而我们利用梯度下降去跟新参数的过程如（1）。但是在计算百万级别的参数时，需要一种有效计算梯度的方法，这种方法就是反向传播（简称BP），因此BP并不是一种新的算法，使用BP就是能够使计算梯度时更加有效率。

其中θ为神经网络的参数，为梯度。

链式法则

设有两个函数为y=g(x),z=h(y)，那么要计算z对x导数，则计算过程如（2）

设有三个函数为x=g(s),y=h(s),z=k(x,y)，那么要计算z对x导数，则计算过程如（3）

BP计算过程

假定我们设计的神经网络结构如图1-1所示，其中y_j神经网络为输出值，d_h为隐藏层神经元的输出值，x_i为输入值，b_j、m_h分别是隐藏层和输出层神经元的偏置；

图1-1 神经网络结构

设神经网络的损失函数为L(θ)（L(θ)具体的结构根据实际情况来确定，θ表示所有参数）；w_jh的更新形式为

由于w_jh是通过影响，继而影响y_j，最终影响L(θ)。因此w_jh的更新计算可以通过（2）的链式法则进行展开。

其中，需要在确定激活函数和损失函数的具体结果后才就可以进行微分。而则可以在神经网络前向传播的过程中就可以计算，因此这一项的计算是自下向上，因此也称作forward pass。

类比于w_jh的更新情况，b_j的更新计算为

再计算v_hi的的更新情况，跟w_jh的更新情况没有太大差别。v_hi通过影响输入，继而影响d_h，d_h通过影响所有的输出层神经元的输入，继而影响输出值Y={y₁,y₂,...y_l}，最终影响L(θ)，因此需要运用（3）进行链式法则展开

其中（8）中的跟计算的部分项相同。因此，要计算下层参数的微积分，就需要计算上层参数的微积分。整个参数的更新计算自上向下，这个计算过程也称作backward pass。

参考资料

[1]机器学习-李宏毅

[2]《机器学习》-周志华

反向传播（Back Propagation）的更多相关文章

神经网络中误差反向传播(back propagation)算法的工作原理
注意:版权所有,转载需注明出处. 神经网络,从大学时候就知道,后面上课的时候老师也讲过,但是感觉从来没有真正掌握,总是似是而非,比较模糊,好像懂,其实并不懂. 在开始推导之前,需要先做一些准备工作,推 ...
前馈神经网络-反向传播(Back Propagation)公式推导走读
构造:输入神经元个数等于输入向量维度,输出神经元个数等于输出向量维度.(x1=(1,2,3),则需要三个输入神经元) 一前向后传播隐层:
前向传播算法(Forward propagation)与反向传播算法(Back propagation)
虽然学深度学习有一段时间了,但是对于一些算法的具体实现还是模糊不清,用了很久也不是很了解.因此特意先对深度学习中的相关基础概念做一下总结.先看看前向传播算法(Forward propagation)与 ...
吴恩达深度学习反向传播（Back Propagation）公式推导技巧
由于之前看的深度学习的知识都比较零散,补一下吴老师的课程希望能对这块有一个比较完整的认识.课程分为5个部分(粗体部分为已经看过的): 神经网络和深度学习改善深层神经网络:超参数调试.正则化以及优化 ...
Deep Learning 学习笔记（7）：神经网络的求解与反向传播算法（Back Propagation）
反向传播算法(Back Propagation): 引言: 在逻辑回归中,我们使用梯度下降法求参数方程的最优解. 这种方法在神经网络中并不能直接使用, 因为神经网络有多层参数(最少两层),(?为何不能 ...
BP(back propagation)反向传播
转自:http://www.zhihu.com/question/27239198/answer/89853077 机器学习可以看做是数理统计的一个应用,在数理统计中一个常见的任务就是拟合,也就是给定 ...
再谈反向传播（Back Propagation）
此前写过一篇<BP算法基本原理推导----<机器学习>笔记>,但是感觉满纸公式,而且没有讲到BP算法的精妙之处,所以找了一些资料,加上自己的理解,再来谈一下BP.如有什么疏漏或 ...
Backpropagation反向传播算法（BP算法）
1.Summary: Apply the chain rule to compute the gradient of the loss function with respect to the inp ...
深度神经网络（DNN）反向传播算法(BP)
在深度神经网络(DNN)模型与前向传播算法中,我们对DNN的模型和前向传播算法做了总结,这里我们更进一步,对DNN的反向传播算法(Back Propagation,BP)做一个总结. 1. DNN反向 ...

随机推荐

码农英语四级考了6次，也能进知名IT外企
程序员学英语这显然不是新鲜的话题,但再怎么重复强调都不过分! 为啥要学 IT是当今世界发展最快的行业,没有之一!作为其中的从业人员,要始终保持对最新技术的关注度,难免需要阅读英文新闻或文章平时工作 ...
[leetcode]61. Rotate List反转链表k个节点
类似于找链表的后k个节点不同的是要把前边的接到后边 public ListNode rotateRight(ListNode head, int k) { //特殊情况 if (head==null ...
json 与 ajax
json类似与js中的对象,但是json中不能有方法,json相当于python中的字典,但是json中的键值如果是字符串的话,需要加上双引号:ajax是一个前后台配合的技术,它可以让js发送http ...
SonarQube学习（三）- 项目代码扫描
一.前言元旦三天假,两天半都在玩86版本DNF,不得不说,这个服真的粘度太高了,但是真的很良心. 说明: 注册账号上线100w点券,一身+15红字史诗装备以及+21强化新手武器.在线泡点一分钟888 ...
ORB-SLAM3 细读单目初始化过程(上)
作者:乔不思来源:微信公众号|3D视觉工坊(系投稿) 3D视觉精品文章汇总:https://github.com/qxiaofan/awesome-3D-Vision-Papers/ 点击上方&qu ...
让微信小程序开发如鱼得水
关于微信小程序开发一直想写一篇相关的文章总结和记录下,结果拖延症犯了迟迟没有下笔:这不最近天气不错,于是找一个空闲的下午将这篇文章输出下(好像跟天气没啥关系),那我们就开始吧! 注意:本文默认开发 ...
Python使用urllib,urllib3,requests库+beautifulsoup爬取网页
Python使用urllib/urllib3/requests库+beautifulsoup爬取网页 urllib urllib3 requests 笔者在爬取时遇到的问题 1.结果不全 2.'抓取失 ...
MyBatis中id回填的两种方式
在一种场景下需要刚刚插入数据的ID,如果数据少可以先看数据库,记下ID,但数据很多,假设一万个用户并发,每个用户都插入自己的ID,就很难记下来. 下面给定一个场景: 1 User user = new ...
Docker学习笔记之创建Ubuntu基础镜像
在创建基础镜像之前需要安装Bootstrap工具debootstrap,所以执行命令: sudo apt install debootstrap 软件安装完成后就可以使用debootstrap工具下载 ...
3.利用jmeter制作性能脚本
jmeter录制脚本示例  jmeter手工脚本编写与调试  业务逻辑实现之逻辑控制器  业务脚本参数化实现  jmeter处理cookie  beanshell脚本 ...