MLR算法[Paper笔记]

介绍

MLR算法是alibaba在2012年提出并使用的广告点击率预估模型，2017年发表出来。

如下图，LR不能拟合非线性数据，MLR可以拟合非线性数据，因为划分-训练模式。

讨论，非线性拟合能力：

数据划分规则如下公式，特征分片数m=1时，退化为LR；上图MLR中m=4。m越大，模型的拟合能力越强，一般m=12。

基础知识

优化方法：

1）剃度下降：

大小：一阶导数，方向：导数负方向。由目标函数的泰勒一阶展开式求得

2）牛顿法：

大小：一阶导数，方向：－海信矩阵的逆。由目标函数的泰勒二阶展开式求

3）拟牛顿法(LBFGS)：牛顿方向通过约等替换，每个样本保存下面三个参数：delta x ，delta剃度和p：

增量替换，计算牛顿方向D

LBFGS方法通过一阶导数中值定理，避免了计算海信矩阵（复杂度太大）。但是L1范数不能求导，所以需要OWLQN方法。

4）OWLQN：

(1)次梯度定义如下，

(2)不可导点取左or右次梯度，如下

直观解释，当你打算用左偏导时，说明是在负象限，因此要加上一个负值，使得更新之后参数更往负象限前进，这样就避免了跨象限；当打算用右偏导数时，说明在正象限，一次要加上一个正值，使得更新之后参数更往正象限前进，从而避免跨象限；否则，只能直接设置subgradient为0。

(3)象限搜索line search：

x不在0点时，line search在x_i所在象限搜索；如果模型参数在0点，就要在(2)次梯度约束的象限内进行line search.

MLR算法

算法公式如下：

0计算边界下降方向d：

1计算梯度大小：theta在0处不可导，取sign符号函数dij。

2计算最终下降方向p：

3象限内梯度下降，同OWLQN，line search：

paper介绍，MLR与LBFGS有三点不同：

1）OWLQN需要计算次梯度，MLR需要计算方向导数；

2）计算最终下降方向p时，MLR也要进行象限约束；

3）象限搜索line search，与OWLQN相似。

分布式框架实现

分布式

User特征共享

个人理解是为了加快运算速度，具体特征划分如下所示。其中，c是用户特征，nc是非用户特征。

实验结果

实验截图略，具体图表可以查看参考paper

纵坐标是内存使用率，特征共享技巧使速度提高了三倍。

参考paper：Learning Piece-wise Linear Models from Large Scale Data for Ad Click Prediction

MLR算法[Paper笔记]的更多相关文章

读paper笔记[Learning to rank]
读paper笔记[Learning to rank] by Jiawang 选读paper: [1] Ranking by calibrated AdaBoost, R. Busa-Fekete, B ...
C / C++算法学习笔记（8）－SHELL排序
原始地址:C / C++算法学习笔记(8)-SHELL排序基本思想先取一个小于n的整数d1作为第一个增量(gap),把文件的全部记录分成d1个组.所有距离为dl的倍数的记录放在同一个组中.先在各组 ...
Manacher算法学习笔记 | LeetCode#5
Manacher算法学习笔记 DECLARATION 引用来源:https://www.cnblogs.com/grandyang/p/4475985.html CONTENT 用途:寻找一个字符串的 ...
《Algorithms算法》笔记：元素排序(4)——凸包问题
<Algorithms算法>笔记:元素排序(4)——凸包问题 Algorithms算法笔记元素排序4凸包问题凸包问题凸包问题的应用凸包的几何性质 Graham 扫描算法代码凸包问 ...
《Algorithms算法》笔记：元素排序(3)——洗牌算法
<Algorithms算法>笔记:元素排序(3)——洗牌算法 Algorithms算法笔记元素排序3洗牌算法洗牌算法排序洗牌 Knuth洗牌 Knuth洗牌代码洗牌算法洗牌的思想很 ...
《Algorithm算法》笔记：元素排序(2)——希尔排序
<Algorithm算法>笔记:元素排序(2)——希尔排序 Algorithm算法笔记元素排序2希尔排序希尔排序思想为什么是插入排序 h的确定方法希尔排序的特点代码有关排序的介绍 ...
MIT算法导论笔记
详细MIT算法导论笔记 (网络链接) 第一讲:课程简介及算法分析 (Sheridan) 第二讲:渐近符号.递归及解法 (Sheridan) 第三讲:分治法(1)(Sheridan) 第四讲:快排及随 ...
Johnson算法学习笔记
$Johnson$算法学习笔记. 在最短路的学习中,我们曾学习了三种最短路的算法,$Bellman-Ford$算法及其队列优化$SPFA$算法,$Dijkstra$算法.这些算法可以快 ...
某科学的PID算法学习笔记
最近,在某社团的要求下,自学了PID算法.学完后,深切地感受到PID算法之强大.PID算法应用广泛,比如加热器.平衡车.无人机等等,是自动控制理论中比较容易理解但十分重要的算法. 下面是博主学习过程中 ...

随机推荐

centos7 最小安装无ifconfig
可能不会有人看到这篇文章,加入有幸被看到,建议读者从后往前看!最小化安装问题:1 没有ifconfig 命令,解决:yum install net-tools2 使用yum install n ...
Python 由__dict__和dir()引发的一些思考
关于__dict__和dir()的区别和作用请参考这篇文章:http://blog.csdn.net/lis_12/article/details/53521554 说下我当时遇到的问题: class ...
本地文件与服务器文件同步shell脚本。
#!/bin/sh read -t 30 -p "请输入项目名:" name echo -e "\n" echo "项目名为:$name" ...
SE6 不定参数和默认参数详解和使用细节
在SE5以前我们通常通过arguments类数组对象来引用不定形参,SE6则使用了一种叫做不定参数的写法,比起隐式的arguments要直观的多. 不定参数使用...参数名来指定一个不定参数,参数名指 ...
径向基网络（RBF network）
来源:http://blog.csdn.net/zouxy09/article/details/13297881 1.径向基函数径向基函数(Radical Basis Function,RBF)方法 ...
中高级JavaScript易错面试题
写出下题的输出 1.函数的实参与形参length var length = 10; function fn() { console.log(this.length); } var obj = { le ...
Ubuntu下比较通用的makefile实例
本文转自http://blog.chinaunix.net/uid-20608849-id-360294.html 笔者在写程序的时候会遇到这样的烦恼:一个项目中可能会有很多个应用程序,而新建一个应 ...
CLR Via C#: 类型基础
所有类型都从System.Object派生一下两个类型定义是完全一致的 class Employee { } class Employee : System.Object { } 由于所有类型最终都 ...
jquery.editable-select 可编辑下拉框之获取select值和input值
使用jquery.editable-select可以实现可编辑下拉框的功能,但需要先导入jquery.js,jquery.editable-select.css,jquery.editable-sel ...
JDBC连接数据库的几种方法
一. 最古老的方法(通过 Driver 接口直接连接数据库) 首先创建一个 Driver 实现类的对象 Driver dirver = new com.mysql.jdbc.Driver(); 准备连 ...

MLR算法[Paper笔记]

MLR算法[Paper笔记]的更多相关文章

随机推荐

热门专题