ML—高斯判别分析

华电北风吹

天津大学认知计算与应用重点实验室

日期：2015/12/11

高斯判别分析属于生成模型，模型终于学习一个特征-类别的联合概率。

0 多维正态分布

确定一个多维正态分布仅仅须要知道分布的均值向量μ∈Rn×1\mu\in R^{n\times 1}和一个协方差矩阵Σ∈Rn×n\Sigma\in R^{n\times n}.

其概率密度函数例如以下：

p(x;μ,Σ)=1(2π)n/2|Σ|1/2exp(−12(x−μ)TΣ−1(x−μ))(0)p(x;\mu,\Sigma)=\frac{1}{(2\pi)^{n/2}| \Sigma|^{1/2}}exp(-\frac{1}{2}(x-\mu)^T\Sigma^{-1}(x-\mu)) \tag{0}

一、高斯判别分析

适用范围：输入特征是连续

模型表述：

y∼Bernoulli(ϕ)(1-1)y\sim Bernoulli(\phi) \tag{1-1}

x|y=0∼N(μ0,Σ)()x|y=0\sim N (\mu_0,\Sigma) \tag{}

x|y=1∼N(μ1,Σ)()x|y=1\sim N(\mu_1,\Sigma) \tag{}

结合公式0能够将公式1-1写为：

p(y)=ϕy(1−ϕ)1−y(1-2)p(y)=\phi^y(1-\phi)^{1-y} \tag{1-2}

p(x|y=0)=1(2π)n/2|Σ|1/2exp(−12(x−μ0)TΣ−1(x−μ0))()p(x|y=0)=\frac{1}{(2\pi)^{n/2}| \Sigma|^{1/2}}exp(-\frac{1}{2}(x-\mu_0)^T\Sigma^{-1}(x-\mu_0)) \tag{}

p(x|y=1)=1(2π)n/2|Σ|1/2exp(−12(x−μ1)TΣ−1(x−μ1))()p(x|y=1)=\frac{1}{(2\pi)^{n/2}| \Sigma|^{1/2}}exp(-\frac{1}{2}(x-\mu_1)^T\Sigma^{-1}(x-\mu_1)) \tag{}

能够看到对于二分类高斯判别分析。模型的參数是ϕ,μ0,μ1,Σ\phi,\mu_0,\mu_1,\Sigma。注意到这里的两个n维正态分布公用了一个协方差矩阵。

对于m个输入样本，有

p(x(i),y(i);ϕ,μ0,μ1,Σ)=p(y(i);ϕ)p(x(i)|y(i);μ,Σ)(1-3)p(x^{(i)},y^{(i)};\phi,\mu_0,\mu_1,\Sigma)=p(y^{(i)};\phi)p(x^{(i)}|y^{(i)};\mu,\Sigma)\tag{1-3}

easy得到对数似然函数例如以下

l(ϕ,μ0,μ1,Σ)=log∏mi=1p(x(i),y(i);ϕ,μ0,μ1,Σ)(1-4)l(\phi,\mu_0,\mu_1,\Sigma)=\log\prod_{i=1}^{m}{p(x^{(i)},y^{(i)};\phi,\mu_0,\mu_1,\Sigma)} \tag{1-4}

求解似然函数最大化得到高斯判别分析的模型參数解形式例如以下：

ϕ=1m∑mi=11{y(i)=1}(1-5)\phi=\frac{1}{m}\sum_{i=1}^{m}{1\{{y^{(i)}}=1\}} \tag{1-5}

μ0=∑mi=11{y(i)=0}x(i)∑mi=11{y(i)=0}()\mu_0=\frac{\sum_{i=1}^{m}{1\{{y^{(i)}}=0\}x^{(i)}}}{\sum_{i=1}^{m}{1\{{y^{(i)}}=0\}}} \tag{}

μ1=∑mi=11{y(i)=1}x(i)∑mi=11{y(i)=1}()\mu_1=\frac{\sum_{i=1}^{m}{1\{{y^{(i)}}=1\}x^{(i)}}}{\sum_{i=1}^{m}{1\{{y^{(i)}}=1\}}} \tag{}

Σ=1m∑mi=1(x(i)−μy(i))(x(i)−μy(i))T()\Sigma=\frac{1}{m}\sum_{i=1}^{m}{(x^{(i)}-\mu_{y^{(i)}})(x^{(i)}-\mu_{y^{(i)}})^T} \tag{}

二、高斯判别分析与逻辑回归

能够easy写出高斯判别分析的预測函数。因为是生成模型。模型存在两种输出p(y=1|x。ϕ,μ0,μ1,Σ)p(y=1|x。\phi,\mu_0,\mu_1,\Sigma)和p(y=0|x；ϕ,μ0,μ1,Σ)p(y=0|x；\phi,\mu_0,\mu_1,\Sigma)。在这里重点关注第一个。

p(y=1|x。ϕ,μ0,μ1,Σ)=p(y=1|x)p(y=1|x)+p(y=0|x)(2-1)p(y=1|x。\phi,\mu_0,\mu_1,\Sigma)=\frac{p(y=1|x)}{p(y=1|x)+p(y=0|x)} \tag{2-1}

经过变换，分解组合等变换操作能够得到例如以下形式：

p(y=1|x。ϕ,μ0,μ1,Σ)=11+e−θTx(2-2)p(y=1|x。\phi,\mu_0,\mu_1,\Sigma)=\frac{1}{1+e^{-\theta^Tx}} \tag{2-2}

注：分子分母同除以分子，消除同类项。系数转化为指数上的指数，矩阵展开相减消除等简单操作就可以得到。

尽管能够得到相似的格式。可是高斯判别分析与逻辑回归仍然存在非常大差别：

1、模型性质：高斯判别分析属于生成模型。逻辑回归属于判别模型

2、p(y=1|x)和p(y=0|x)在逻辑回归中和为1。在高斯判别分析中不存在这个性质。

3、模型如果：高斯判别分析如果样本特征在每一个类别下分别服从于各异的高维正态分布。逻辑回归是类别标签满足伯努利分布如果下的广义线性模型。

$(function () {
$('pre.prettyprint code').each(function () {
var lines = $(this).text().split('\n').length;
var $numbering = $('

ML—高斯判别分析的更多相关文章

[置顶] 生成学习算法、高斯判别分析、朴素贝叶斯、Laplace平滑——斯坦福ML公开课笔记5
转载请注明:http://blog.csdn.net/xinzhangyanxiang/article/details/9285001 该系列笔记1-5pdf下载请猛击这里. 本篇博客为斯坦福ML公开 ...
高斯判别分析 Gaussian Discriminant Analysis
如果在我们的分类问题中,输入特征xx是连续型随机变量,高斯判别模型(Gaussian Discriminant Analysis,GDA)就可以派上用场了. 以二分类问题为例进行说明,模型建立如下: ...
Gaussian discriminant analysis 高斯判别分析
高斯判别分析(附Matlab实现) 生成学习算法高斯判别分析(Gaussian Discriminant analysis,GDA),与之前的线性回归和Logistic回归从方法上讲有很大的不同,G ...
【cs229-Lecture5】生成学习算法：1）高斯判别分析（GDA）;2）朴素贝叶斯（NB）
参考: cs229讲义机器学习(一):生成学习算法Generative Learning algorithms:http://www.cnblogs.com/zjgtan/archive/2013/ ...
Stanford大学机器学习公开课（五）：生成学习算法、高斯判别、朴素贝叶斯
(一)生成学习算法在线性回归和Logistic回归这种类型的学习算法中我们探讨的模型都是p(y|x;θ),即给定x的情况探讨y的条件概率分布.如二分类问题,不管是感知器算法还是逻辑回归算法,都是在解 ...
StanFord ML 笔记第四部分
第四部分: 1.生成学习法 generate learning algorithm 2.高斯判别分析 Gaussian Discriminant Analysis 3.朴素贝叶斯 Navie Baye ...
【Coursera】高斯混合模型
一.高斯混合模型软分类算法,即对每一个样本,计算其属于各个分布的概率,概率值最大的就是这个样本所属的分类. 对于训练样本的分布,看成为多个高斯分布加权得到的.其中每个高斯分布即为某一特定的类. 高斯 ...
ML—朴素贝叶斯
华电北风吹日期:2015/12/12 朴素贝叶斯算法和高斯判别分析一样同属于生成模型.但朴素贝叶斯算法须要特征条件独立性如果,即样本各个特征之间相互独立. 一.朴素贝叶斯模型朴素贝叶斯算法通过训练 ...
生成式学习算法（三）之----高斯判别分析模型（Gaussian Discriminant Analysis ，GDA）
高斯判别分析模型(Gaussian Discriminant Analysis ,GDA) 当我们分类问题的输入特征$x $为连续值随机变量时,可以用高斯判别分析模型(Gaussian Discrim ...

随机推荐

java Callable创建线程
package com.java.concurrent; import java.util.concurrent.Callable; import java.util.concurrent.Execu ...
jQuery 插件格式规范
方式一(自定义对象): (function($, window, document) { var Plugin, defaults, pluginName; 调用时的函数名: pluginN ...
FTP配置的一些笔记
1.必须关闭防火墙 iptables -F iptables -X iptables -Z vi /etc/selinux/config SELINUX=disabled seten ...
CSS3详解：transform、transition
CSS3 transform是什么? transform的含义是:改变,使-变形:转换 CSS3 transform都有哪些常用属性? transform的属性包括:rotate() / skew() ...
H5定位
百度地图javaScript API 一.在html文件中引入 <script src="http://api.map.baidu.com/api?ak=Uk9tDddYkrQImXw ...
Linux修改date
与cn校时 ntpdate cn.pool.ntp.org 设置时区 TZ='Asia/Shanghai'; export TZ 刷新生效 source ~/.bashrc vi /etc/profi ...
R语言高性能编程（三）
一.使用并行计算加倍提升性能1.数据并行 VS 任务并行实现数据并行的算法scoket 并行性注意并行计算时间并不与执行任务的计算资源数目成正比(计算机核心),amdahl定律:并行代码的速度受限于串 ...
Python进阶---面向对象的程序设计思想
Python的面向对象一.面向过程与面向对象的对比面向过程的程序设计的核心是过程(流水线式思维),过程即解决问题的步骤,面向过程的设计就好比精心设计好一条流水线,考虑周全什么时候处理什么东西. 优 ...
net user命令详解
net use \\ip\ipc$ " " /user:" " 建立IPC空链接 net use \\ip\ipc$ "密码" /user: ...
老男孩最新Python全栈开发视频教程（92天全）重点内容梳理笔记看完就是全栈开发工程师
为什么要写这个系列博客呢? 说来讽刺,91年生人的我,同龄人大多有一份事业,或者有一个家庭了.而我,念了次985大学,年少轻狂,在大学期间迷信创业,觉得大学里的许多课程如同吃翔一样学了几乎一辈子都用不 ...

ML—高斯判别分析

ML—高斯判别分析的更多相关文章

随机推荐

热门专题