Robust De-noising by Kernel PCA

引
主要内容

Takahashi T, Kurita T. Robust De-noising by Kernel PCA[C]. international conference on artificial neural networks, 2002: 739-744.

引

这篇文章是基于对Kernel PCA and De-Noisingin Feature Spaces的一个改进。

针对高斯核：

\[k(x,y) = \exp (-\|x-y\|^2/c)
\]

我们希望最小化下式（以找到$x$的一个近似的原像):

\[\rho(z) = \|\Phi(z) - P_H \Phi(x)\|^2
\]

获得了一个迭代公式：

\[z(t) = \frac{\sum_{i=1}^N w_i k(x_i, z(t-1))x_i}{\sum_{i=1}^N w_i k(x_i, z(t-1))}
\]

其中$w_i=\sum_{h=1}^Hy_h u_i^h$,$u$通过求解kernel PCA获得（通常是用$\alpha$表示的）,$z(0)=x$。

主要内容

虽然我们可以通过撇去小特征值对应的方向，但是这对于去噪并不足够。Kernel PCA and De-Noisingin Feature Spaces中所提到的方法，也就是上面的那个迭代的公式，也没有很好地解决这个问题。既然$\{y_h\}$并没有改变——也就是说，我们可能一直在试图用带噪声的数据去恢复一个不带噪声的数据。

所以，作者论文，在迭代更新过程中，$y_h$也应该进行更新。

这样，每一步我们都可以看作是在寻找：

\[\|\Phi(z)-P_H\Phi(\widetilde{x}(t)\|
\]

的最小值。

从$(10)$可以发现，除非$\widetilde{x}(t)=z(t-1)$是$x$的一个比较好的估计，否则，通过这种方式很有可能会失败（这里的失败定义为，最后的结果与$x$差距甚远)。这种情况我估计是很容易发生的。所以，作者提出了一种新的，更新$\widetilde{x}(t)$的公式：

其中$B(t)$为确定度，是一个$M \times M$的矩阵，定义为：

\[B(t) = diag(\beta_1(t), \ldots, \beta_M(t)) \\
\beta_j(t) = \exp (-(x_j - z_j (t-1))^2/2\sigma_j^2)
\]

对角线元素，反映了$x_j$和$z_j(t-1)$的差距，如果二者差距不大，说明$P_H(x)$和$x$的差距不大，$x$不是异常值点，所以，结果和$x$的差距也不会太大，否则$x$会被判定为一个异常值点，自然$z$应该和$x$的差别大一点。

$\sigma_j$的估计是根据另一篇论文来的，这里只给出估计的公式：

$\mathrm{med}(x)$表示$x$的中位数，$\varepsilon_{ij}$表示第$i$个训练样本第$j$个分量与其重构之间平方误差。话说，这个重构如何获得呢？

Robust De-noising by Kernel PCA的更多相关文章

A ROBUST KERNEL PCA ALGORITHM
目录引主要内容问题一问题二 Lu C, Zhang T, Du X, et al. A robust kernel PCA algorithm[C]. international confer ...
Kernel Methods (5) Kernel PCA
先看一眼PCA与KPCA的可视化区别: 在PCA算法是怎么跟协方差矩阵/特征值/特征向量勾搭起来的?里已经推导过PCA算法的小半部分原理. 本文假设你已经知道了PCA算法的基本原理和步骤. 从原始输入 ...
Kernel PCA 原理和演示
Kernel PCA 原理和演示主成份(Principal Component Analysis)分析是降维(Dimension Reduction)的重要手段.每一个主成分都是数据在某一个方向上的 ...
【模式识别与机器学习】——PCA与Kernel PCA介绍与对比
PCA与Kernel PCA介绍与对比 1. 理论介绍 PCA:是常用的提取数据的手段,其功能为提取主成分(主要信息),摒弃冗余信息(次要信息),从而得到压缩后的数据,实现维度的下降.其设想通过投影矩 ...
Probabilistic PCA、Kernel PCA以及t-SNE
Probabilistic PCA 在之前的文章PCA与LDA介绍中介绍了PCA的基本原理,这一部分主要在此基础上进行扩展,在PCA中引入概率的元素,具体思路是对每个数据$\vec{x}_i$,假设$ ...
Kernel PCA and De-Noisingin Feature Spaces
目录引主要内容 Kernel PCA and De-Noisingin Feature Spaces 引 kernel PCA通过$k(x,y)$隐式地将样本由输入空间映射到高维空间$F$ ...
Kernel PCA for Novelty Detection
目录引主要内容的选择数值实验矩形框 spiral 代码 Hoffmann H. Kernel PCA for novelty detection[J]. Pattern Recognitio ...
Missing Data in Kernel PCA
目录引主要内容关于缺失数据的导数附录极大似然估计代码 Sanguinetti G, Lawrence N D. Missing data in kernel PCA[J]. europea ...
核化主成分分析（Kernel PCA）应用及调参
核化这个概念在很多机器学习方法中都有应用,如SVM,PCA等.在此结合sklearn中的KPCA说说核函数具体怎么来用. KPCA和PCA都是用来做无监督数据处理的,但是有一点不一样.PCA是降维,把 ...

随机推荐

大数据学习day28-----hive03------1. null值处理，子串，拼接，类型转换 2.行转列，列转行 3. 窗口函数（over，lead,lag等函数） 4.rank（行号函数）5. json解析函数 6.jdbc连接hive，企业级调优
1. null值处理,子串,拼接,类型转换 (1) 空字段赋值(null值处理) 当表中的某个字段为null时,比如奖金,当你要统计一个人的总工资时,字段为null的值就无法处理,这个时候就可以使用N ...
如何通过 User-Agent 识别百度蜘蛛
如果有大量的百度蜘蛛抓取网站就需要注意了:有可能是其他爬虫伪造百度蜘蛛恶意抓取网站. 如果遇到这种情况,这时候就需要查看日志来确定是不是真正的百度蜘蛛(baidu spider).搜索引擎蜘蛛.用户访 ...
容器之分类与各种测试（四）——multiset
multiset是可重复关键字的关联式容器,其与序列式容器相比最大的优势在于其查找效率相当高.(牺牲空间换取时间段) 例程 #include<stdexcept> #include< ...
vim一键整理代码命令
vim下写代码超实用代码格式整理命令,仅需四步 ①先使用 gg 命令使光标回到第一行 ②shift+v 进入可视模式 ③shift+g 全选 ④按下 = 即可混乱的代码格式四步整理以后工整又 ...
【STM32】使用SDIO进行SD卡读写，包含文件管理FatFs（八）-认识内存管理
[STM32]使用SDIO进行SD卡读写,包含文件管理FatFs(一)-初步认识SD卡 [STM32]使用SDIO进行SD卡读写,包含文件管理FatFs(二)-了解SD总线,命令的相关介绍 [STM3 ...
ps精修
1.磨皮方法: a,, 添加高斯模糊后,按住alt键新建图层蒙版,设置前景色为白色,用画笔在脸上雀斑的位置涂抹,注意脸轮廓位置不要涂抹.最后添加曲线提亮 b. 添加蒙尘和划痕后,后面上面的一样
Javaj基础知识runtime error
遇到的java 运行时错误: NullPointerException空指针 ,简单地说就是调用了未经初始化的对象或者是不存在的对象,这个错误经常出现在创建图片,调用数组这些操作中,比如图片未经初始 ...
Spring支持5种类型的增强
Spring支持5种类型的增强:1.前置增强:org.springframework.aop.BeforeAdvice代表前置增强,因为Spring只支持方法级的增强,所以MethodBeforeAd ...
java.util.Collections.copy()方法注意点
今天发现单独的将一个ArrayList的对象添加到另外一个ArrayList的时候,总是源列表和目的列表相同的内存地址.原因如下: 偶然看到了Collections的copy(List desc,Li ...
用户信息系统_serviceImpl
package com.hopetesting.service.impl;import com.hopetesting.dao.UserDao;import com.hopetesting.dao.i ...

Robust De-noising by Kernel PCA

引

主要内容

Robust De-noising by Kernel PCA的更多相关文章

随机推荐

热门专题