Coursera DeepLearning.ai Logistic Regression逻辑回归总结

既《Machine Learning》课程后，Andrew Ng又推出了新一系列的课程《DeepLearning.ai》，注册了一下可以试听7天。之后每个月要$49，想想还是有点贵，所以能听到哪儿算哪儿吧...

Week one主要讲了近年来为啥Deep learning火起来了，有时间另起一贴总结一下。

Week two回顾了Logistic Regression(逻辑回归）。虽然它听上去已经不是一个陌生的概念了，但是每次想起时还是会迟疑一下，所以干脆记录一发备忘。

1. 逻辑回归虽然名字起的是回归，实则是一个用于二分类的方法。

2. 逻辑回归和线性回归的区别与联系

　　2.1 区别

　　逻辑回归是分类方法，线性回归是回归方法。

　　2.2 联系

　　逻辑回归的函数包含了线性回归的形式。具体来说，逻辑回归的公式为：$y=\sigma(w^{T}x+b)$，其中$w^Tx+b$就是线性回归的形式，而$\sigma(z)$是一个sigmoid函数，这个函数可以把$z$放缩到0~1的区间。

3. 逻辑回归为什么要有一个$\sigma(z)$

试想我们使用$y=w^Tx+b$来作为输出值，如果没有对输入的特征$x$包括参数$w$做任何的限制，那么$y$理论上是可以任意大或任意小的，这就使得在做判别的时候更困难了（因为不知道$y$的极限值在哪里）。如果用了$\sigma(z)$做一个放缩，把$y$放缩到0~1后，做判别的时候只需要简单地设置一个阈值0.5就可以了。

4. Loss function的形式

从这一页slide中可以看出，Loss function是如下定义的：

\[ L(\hat y, y) = -(y\log \hat y + (1-y)\log(1-\hat y))\]

为什么不定义成square error，$\frac 1 2 (y-\hat y)^2$? Andrew的解释是因为后者在最优化过程中是非凸的，用梯度下降求解参数时不能够保证找到全局最优。而前者是可以保证使用梯度下降是能找到全局最优解的。可以参见slide中右侧的那两个曲线图。

5. 术语定义Terminology

以前不太区分这两个概念。在Andrew的视频中，Loss function是针对某一个样本来说的；Cost function是针对所有样本来说的。后者是前者的一个平均。

（来源于课程讲义）

Coursera DeepLearning.ai Logistic Regression逻辑回归总结的更多相关文章

【原】Coursera—Andrew Ng机器学习—Week 3 习题—Logistic Regression 逻辑回归
课上习题 [1]线性回归 Answer: D A 特征缩放不起作用,B for all 不对,C zero error不对 [2]概率 Answer:A [3]预测图形 Answer:A 5 - x1 ...
Logistic Regression(逻辑回归)（二）—深入理解
(整理自AndrewNG的课件,转载请注明.整理者:华科小涛@http://www.cnblogs.com/hust-ghtao/) 上一篇讲解了Logistic Regression的基础知识,感觉 ...
Logistic Regression逻辑回归
参考自: http://blog.sina.com.cn/s/blog_74cf26810100ypzf.html http://blog.sina.com.cn/s/blog_64ecfc2f010 ...
Logistic Regression(逻辑回归)
分类是机器学习的一个基本问题, 基本原则就是将某个待分类的事情根据其不同特征划分为两类. Email: 垃圾邮件/正常邮件肿瘤: 良性/恶性蔬菜: 有机/普通对于分类问题, 其结果 y∈{0,1 ...
机器学习简要笔记（五）——Logistic Regression(逻辑回归）
1.Logistic回归的本质逻辑回归是假设数据服从伯努利分布,通过极大似然函数的方法,运用梯度上升/下降法来求解参数,从而实现数据的二分类. 1.1.逻辑回归的基本假设 ①伯努利分布:以抛硬币为例 ...
Deep Learning 学习笔记（4）：Logistic Regression 逻辑回归
逻辑回归主要用于解决分类问题,在现实中有更多的运用, 正常邮件or垃圾邮件车or行人涨价or不涨价用我们EE的例子就是: 高电平or低电平同时逻辑回归也是后面神经网络到深度学习的基础. (原来 ...
【原】Coursera—Andrew Ng机器学习—课程笔记 Lecture 6_Logistic Regression 逻辑回归
Lecture6 Logistic Regression 逻辑回归 6.1 分类问题 Classification6.2 假设表示 Hypothesis Representation6.3 决策边界 ...
机器学习之LinearRegression与Logistic Regression逻辑斯蒂回归(三)
一评价尺度 sklearn包含四种评价尺度 1 均方差(mean-squared-error) 2 平均绝对值误差(mean_absolute_error) 3 可释方差得分(explained_v ...
吴恩达深度学习：2.1Logistic Regression逻辑回归及其损失函数
1.Logistic Regression是一个二元分类问题 (1)已知输入的特征向量x可能是一张图,你希望把它识别出来,这是不是猫图,你需要一个算法,可以给出预测值,更正式的y是一个概率,当输入特征 ...

随机推荐

b继承a
有下面这样的一段代码: function a(){ this.foo = function(){ console.log('foo'); } } var b = {}; 请问如何让b继承a? b.__ ...
mac攻略(2) -- apache站点配置
[http://www.cnblogs.com/redirect/p/6112164.html] Mac OS X 中默认有两个目录可以直接运行你的 Web 程序, 一个是系统级的 Web 根目录:/ ...
CentOS下安装go语言编译环境
1.下载Go语言的安装包这里给大家一个百度的分享连接http://pan.baidu.com/s/1qY3xPaG下载到CentOS的系统之中 $ tar -xzf go1.5.2.linux-xx ...
dnsmasq 做 DHCP 服务器
/etc/dnsmasq.conf #DNS服务器的地址,就是我的热点的地址 listen-address=192.168.1.1 #设置DHCP分配的地址范围和时间 dhcp-range=192.1 ...
[Uva10294]Arif in Dhaka
[Uva10294]Arif in Dhaka 标签: 置换 Burnside引理题目链接题意有很多个珠子穿成环形首饰,手镯可以翻转和旋转,项链只能旋转.(翻转过的手镯相同,而项链不同) 有n个 ...
Redis入门_下
本文主要介绍redis一些高级特性. 1.Redis HyperLogLog Redis HyperLogLog 是用来做基数统计的算法,HyperLogLog 的优点是,在输入元素的数量或者体积非常 ...
分布式高性能消息处理中心HPMessageCenter
# HPMessageCenter 高性能消息分发中心.用户只需写好restful接口,在portal里面配置消息的处理地址,消息消费者就会自动访问相关接口,完成消息任务. ### 部署说明 **创建 ...
高并发关于微博、秒杀抢单等应用场景在PHP环境下结合Redis队列延迟入库
第一步:创建模拟数据表. CREATE TABLE `test_table` ( `id` int(11) NOT NULL AUTO_INCREMENT, `uid` int(11) NOT NUL ...
合唱团 (线性dp)
题意:有 n 个学生站成一排,每个学生有一个能力值,牛牛想从这 n 个学生中按照顺序选取 k 名学生,要求相邻两个学生的位置编号的差不超过 d,使得这 k 个学生的能力值的乘积最大,你能返回最大的乘积 ...
SPFA+SLF+LLL优化模板
#include<algorithm> #include <iostream> #include <cstdlib> #include <cstring> ...

Coursera DeepLearning.ai Logistic Regression逻辑回归总结

Coursera DeepLearning.ai Logistic Regression逻辑回归总结的更多相关文章

随机推荐

热门专题