Tensorflow 损失函数及学习率的四种改变形式

Reference: https://blog.csdn.net/marsjhao/article/details/72630147

分类问题损失函数-交叉熵（crossentropy)

交叉熵描述的是两个概率分布之间的距离，分类中广泛使用的损失函数，公式如下

在网络中可以通过Softmax回归将前向传播得到的结果变为交叉熵要求的概率分数值。Tensorflow中，Softmax回归的参数被去掉，通过一层将神经网络的输出变为一个概率分布。

代码实现

import tensorflow as tf

y_ = tf.constant([[1.0, 0, 0]]) # 正确标签

y1 = tf.constant([[0.9, 0.06, 0.04]]) # 预测结果1

y2 = tf.constant([[0.5, 0.3, 0.2]]) # 预测结果2

# 以下为未经过Softmax处理的类别得分

y3 = tf.constant([[10.0, 3.0, 2.0]])

y4 = tf.constant([[5.0, 3.0, 1.0]])

# 自定义交叉熵

cross_entropy1 = -tf.reduce_mean(y_ * tf.log(tf.clip_by_value(y1, 1e-10, 1.0)))

#tf.clip_by_value 将一个tensor元素数值限制在指定范围内,防止一些错误，起到数值检查作用。

cross_entropy2 = -tf.reduce_mean(y_ * tf.log(tf.clip_by_value(y2, 1e-10, 1.0)))

# TensorFlow提供的集成交叉熵

# 注：该操作应该施加在未经过Softmax处理的logits上，否则会产生错误结果

# labels为期望输出，且必须采用labels=y_, logits=y的形式将参数传入

cross_entropy_v2_1 = tf.nn.softmax_cross_entropy_with_logits(labels=y_, logits=y3)

cross_entropy_v2_2 = tf.nn.softmax_cross_entropy_with_logits(labels=y_, logits=y4)

sess = tf.InteractiveSession()

print('[[0.9, 0.06, 0.04]]:', cross_entropy1.eval())

print('[[0.5, 0.3, 0.2]]:', cross_entropy2.eval())

print('v2_1', cross_entropy_v2_1.eval())

print('v2_2',cross_entropy_v2_2.eval())

sess.close()

'''

[[0.9, 0.06, 0.04]]: 0.0351202

[[0.5, 0.3, 0.2]]: 0.231049

v2_1 [ 0.00124651]

v2_2 [ 0.1429317]

'''

回归问题损失函数-均方误差（MSE,mean squared error）

均方误差也可以用于分类问题的损失函数，

自定义损失函数

对于如下自定义损失函数的Tensorflow实现

loss= tf.reduce_sum(tf.where(tf.greater(y, y_), (y-y_)*loss_more,(y_-y)*loss_less))

tf.greater(x,y),返回x>y判断结果的bool型tensor。 tf.where(condition,x=None,y=None,name=None)根据condition选择x或者y。

代码实现

import tensorflow as tf

from numpy.random import RandomState

batch_size = 8

x = tf.placeholder(tf.float32, shape=(None, 2), name='x-input')

y_ = tf.placeholder(tf.float32, shape=(None, 1), name='y-input')

w1 = tf.Variable(tf.random_normal([2,1], stddev=1, seed=1))

y = tf.matmul(x, w1)

# 根据实际情况自定义损失函数

loss_less = 10

loss_more = 1

# tf.select()在1.0以后版本中已删除，tf.where()替代

loss = tf.reduce_sum(tf.where(tf.greater(y, y_),

                               (y-y_)*loss_more, (y_-y)*loss_less))

train_step = tf.train.AdamOptimizer(learning_rate=0.001).minimize(loss)

rdm = RandomState(seed=1) # 定义一个随机数生成器并设定随机种子

dataset_size = 128

X = rdm.rand(dataset_size, 2)

Y = [[x1 + x2 +rdm.rand()/10.0 - 0.05] for (x1, x2) in X] # 增加一个-0.05~0.05的噪声

sess = tf.InteractiveSession()

tf.global_variables_initializer().run()

for i in range(5000):

    start = (i * batch_size) % dataset_size

    end = min(start+batch_size, dataset_size)

    train_step.run({x: X[start: end], y_: Y[start: end]})

    if i % 500 == 0:

        print('step%d:\n' % i, w1.eval())

print('final w1:\n', w1.eval())

sess.close()

'''

loss_less = 10

loss_more = 1

final w1:

 [[ 1.01934695]

 [ 1.04280889]]

loss_less = 1

loss_more = 10

final w1:

 [[ 0.95525807]

 [ 0.9813394 ]]

loss_less = 1

loss_more = 1

final w1:

 [[ 0.9846065 ]

 [ 1.01486754]]

'''

Tensorflow 的Cross_Entropy实现

1. tf.nn.softmax_cross_entropy_with_logits(_sentinel=None,labels=None,logits=None,dim=-1,name=Node)

作用：自动计算logits(未经过Softmax)与labels 之间的cross_entropy交叉熵。logits 为神经网络最后一层的输出，有batch的话，大小为[batchsize,num_classes]，单样本的话就是num_classes。labels：为ground Truth大小同上。labels的每一行为one-hot表示。

2.tf.nn.sparse_softmax_cross_entropy_with_logits()

输入的logits是未经缩放的，函数内部对logits进行一个softmax操作。返回值为一个向量，求交叉熵做一步tf.reduce_sum操作，求loss，进一步做tf.reduce_mean，对向量求均值。

3.tf.nn.sigmoid_cross_entropy_with_logits(_sentinel=None,labels=None,logits=None,name=None)

4.tf.nn.weithted_cross_entropy_with_logits(targets,logits,pos_weith,name=None)

学习率的四种改变形式：

1.fixed:learning rate 固定不变

2.Step:在每次迭代stepsize次后，减少gmma倍。lr = lr x gamma

3. polynomial: 呈多项式曲线下降，lr = base_lr x(t/T)^power

4. Inv:随着迭代次数的增加而下降。LR = base_lr x(1+gmma x iter)^power

Tensorflow 损失函数及学习率的四种改变形式的更多相关文章

javascript——四种函数调用形式
此文的目的是分析函数的四种调用形式,弄清楚函数中this的意义,明确构造函对象的过程,学会使用上下文调用函数. 在JavaScript中,函数是一等公民,函数在JavaScript中是一个数据类型,而 ...
JavaScript高级之函数的四种调用形式
主要内容分析函数的四种调用形式弄清楚函数中this的意义明确构造函对象的过程学会使用上下文调用函数了解函数的调用过程有助于深入学习与分析JavaScript代码. 本文是JavaScript ...
Android颜色值(RGB)所支持的四种常见形式
Android中颜色值是通过红(Red).绿(Green).蓝(Blue)三原色,以及一个透明度(Alpha)值来表示的,颜色值总是以井号(#)开头,接下来就是Alpha-Red-Green-Blue ...
我的Android进阶之旅------>Android颜色值(RGB)所支持的四种常见形式
Android中颜色值是通过红(Red).绿(Green).蓝(Blue)三原色,以及一个透明度(Alpha)值来表示的,颜色值总是以井号(#)开头,接下来就是Alpha-Red-Green-Blue ...
this的四种绑定形式
一 , this的默认绑定当一个函数没有明确的调用对象的时候,也就是单纯作为独立函数调用的时候,将对函数的this使用默认绑定:绑定到全局的window对象. 一个例子 function fire ...
javascript this 代表的上下文,JavaScript 函数的四种调用形式
JavaScript 是一种脚本语言,支持函数式编程.闭包.基于原型的继承等高级功能.其中JavaScript 中的 this 关键字,就是一个比较容易混乱的概念,在不同的场景下,this会化身不同的 ...
get的四种请求形式
$_GET变量当用户以get方式请求页面并发送数据的时候,$_GET变量就存储了这些数据——get数据!get请求有4种形式:形式1:<form action=”abc.php” meth ...
【javascript】函数中的this的四种绑定形式
目录 this的默认绑定 this的隐式绑定隐式绑定下,作为对象属性的函数,对于对象来说是独立的在一串对象属性链中,this绑定的是最内层的对象 this的显式绑定:(call和bind方法) n ...
【javascript】函数中的this的四种绑定形式 — 大家准备好瓜子，我要讲故事啦~~
javascript中的this和函数息息相关,所以今天,我就给大家详细地讲述一番:javascript函数中的this 一谈到this,很多让人晕晕乎乎的抽象概念就跑出来了,这里我就只说最 ...

随机推荐

读Java并发编程实践中，向已有线程安全类添加功能--客户端加锁实现示例
在Java并发编程实践中4.4中提到向客户端加锁的方法.此为验证示例,写的不好,但可以看出结果来. package com.blackbread.test; import java.util.Arra ...
centos安装fish shell
对于 CentOS 7,请以根用户 root 运行下面命令: cd /etc/yum.repos.d/ wget https://download.opensuse.org/repositories/ ...
k64 datasheet学习笔记52---Universal Asynchronous Receiver/Transmitter (UART)
1.前言 UART实现与外设或CPU的通信 2. UART概述 2.1基本特性 (1)Full-duplex operation (2)Standard mark/space non-return-t ...
Nginx在线服务状态下平滑升级及ab压力测试【转】
今天,产品那边发来需求,说有个 APP 的 IOS 版本下载包需要新增 https 协议,在景安购买了免费的 SSL 证书.当我往 nginx 上新增 ssl 时,发现服务器上的 nginx 居然没编 ...
DeprecationWarning: Calling an asynchronous function without callback is deprecated. - how to find where the “function:” is?
I recently updated my node to 7.2.1 and noticed that there is a warning coming: (node:4346) Deprecat ...
VS2013 VS2015 VS2017调试出现无法启动iis express web服务器
最近老是遇到这个问题,天天如此,烦死人,网上答案繁多,但是都解决不了,也是由于各种环境不同导致的,这里把几种解决方法都记录下一.其他项目都可以,就这么一个不行因为其他项目都可以,就这么一个不行,所 ...
$Django 聚合函数、分组查询、F,Q查询、orm字段以及参数
一.聚合函数 from django.db.models import Avg,Sum,Max,Min,Count,F,Q #导入 # .查询图书的总价,平均价,最大价,最小价 ...
使用python脚本批量删除阿里云oss中的mp4文件
#encoding:utf-8 ''' oss中有一些mp4文件需要删除,首先定位出这些文件放在txt文本中然后通过python操作oss进行批量删除 ''' import oss2 auth = ...
Linux Free命令每个数字的含义和 cache 、buffer的区别
Linux Free命令每个数字的含义和 cache .buffer的区别我们按照图中来一细细研读(数字编号和图对应)1,total:物理内存实际总量2,used:这块千万注意,这里可不是实际已经 ...
Mysql41道练习题
1.自行创建测试数据 2.查询“生物”课程比“物理”课程成绩高的所有学生的学号.ps:针对的是自己的生物成绩比物理成绩高,再把符合条件的学生的学号查出来: # 查到生物和物理的 id: sele ...

Tensorflow 损失函数及学习率的四种改变形式

Tensorflow 损失函数及学习率的四种改变形式的更多相关文章

随机推荐

热门专题