利用LM神经网络和决策树去分类

# -*- coding: utf-8 -*-

import pandas as pd

from scipy.interpolate import lagrange

from matplotlib import pyplot as plt

from random import shuffle

from keras.models import Sequential #导入神经网络初始化函数

from keras.layers.core import Dense, Activation #导入神经网络层函数、激活函数

# inputfile='F:\\python数据挖掘\\chapter6\\chapter6\\demo\\data\\missing_data.xls'

# outputfile='F:\\python数据挖掘\\chapter6\\chapter6\\demo\\tmp\\missing_data_sale.xls'

# data=pd.read_excel(inputfile,header=None)

datafile = 'F:\\python数据挖掘\\chapter6\\chapter6\\demo\\data\\model.xls'

data = pd.read_excel(datafile)

#print(data)

#print(type(data))

data = data.as_matrix()#转换成矩阵或者是数组型，对数据进行操作。

shuffle(data)#随机扰乱数据

#print(data)

p = 0.8 #设置训练数据比例

train = data[:int(len(data)*p),:]

test = data[int(len(data)*p):,:]

#

#

netfile = 'F:\\python数据挖掘\\chapter6\\chapter6\\demo\\tmp\\net.model1' #构建的神经网络模型存储路径

#

net = Sequential() #建立神经网络

net.add(Dense(input_dim=3,output_dim=10)) #添加输入层（3节点）到隐藏层（10节点）的连接

#net.add(Dense(32, input_dim=16))

net.add(Activation('relu')) #隐藏层使用relu激活函数

net.add(Dense(input_dim=10, output_dim=1)) #添加隐藏层（10节点）到输出层（1节点）的连接

net.add(Activation('sigmoid')) #输出层使用sigmoid激活函数

net.compile(loss = 'binary_crossentropy', optimizer = 'adam', class_mode = "binary") #编译模型，使用adam方法求解

net.fit(train[:,:3], train[:,3], nb_epoch=2, batch_size=1) #训练模型，循环1000次,Keras模块中的batch_size指的就是小批量梯度下降法。

net.save_weights(netfile) #保存模型

#predict_result = net.predict_classes(train[:,:3]).reshape(len(train)) #预测结果变形

'''这里要提醒的是，keras用predict给出预测概率，predict_classes才是给出预测类别，而且两者的预测结果都是n x 1维数组，而不是通常的 1 x n'''

#

# from cm_plot import * #导入自行编写的混淆矩阵可视化函数

# cm_plot(train[:,3], predict_result).show() #显示混淆矩阵可视化结果

#

from sklearn.metrics import roc_curve #导入ROC曲线函数

#

predict_result = net.predict(test[:,:3]).reshape(len(test))

fpr, tpr, thresholds = roc_curve(test[:,3], predict_result, pos_label=1)

print(fpr,tpr)

plt.plot(fpr, tpr, linewidth=2, label = 'ROC of LM') #作出ROC曲线

plt.xlabel('False Positive Rate') #坐标轴标签

plt.ylabel('True Positive Rate') #坐标轴标签

plt.ylim(0,1.05) #边界范围

plt.xlim(0,1.05) #边界范围

plt.legend(loc=4) #图例

plt.show() #显示作图结果

结果画出的图如上面所示。

主要步骤为：

第一：从原始数据中随机性的抽取数据，然后进行数据探索分析数据，数据探索分析包括：

1.数据清洗

2.缺失值处理

3.数据变换

第二：建模样本数据

1.模型训练

2.模型评价

第三：预处理后诊断数据

第四：自动诊断

第五：根据诊断结果进行模型的优化与重构

最后，再进行模型的训练和评价。

利用LM神经网络和决策树去分类的更多相关文章

javascript实现朴素贝叶斯分类与决策树ID3分类
今年毕业时的毕设是有关大数据及机器学习的题目.因为那个时间已经步入前端的行业自然选择使用JavaScript来实现其中具体的算法.虽然JavaScript不是做大数据处理的最佳语言,相比还没有优势,但 ...
CART决策树（分类回归树）分析及应用建模
一.CART决策树模型概述(Classification And Regression Trees) 决策树是使用类似于一棵树的结构来表示类的划分,树的构建可以看成是变量(属性)选择的过程,内部节 ...
Neuromation新研究：利用卷积神经网络进行儿童骨龄评估
近日,Neuromation 团队在 Medium 上撰文介绍其最新研究成果:利用卷积神经网络(CNN)评估儿童骨龄,这一自动骨龄评估系统可以得到与放射科专家相似或更好的结果.该团队评估了手骨不同区域 ...
利用BP神经网络预测水道浅滩演变
论文 <基于现代技术的河道浅滩演变研究> 利用BP神经网络来预测浅滩演变 BP输出因子:浅滩的年平均淤积厚度以及浅滩上最小水深,是反映浅滩变化的两个基本指标,是确定浅滩航道尺度能否满足航行 ...
Spark Mllib里决策树二元分类使用.areaUnderROC方法计算出以AUC来评估模型的准确率和决策树多元分类使用.precision方法以precision来评估模型的准确率（图文详解）
不多说,直接上干货! Spark Mllib里决策树二元分类使用.areaUnderROC方法计算出以AUC来评估模型的准确率具体,见 Hadoop+Spark大数据巨量分析与机器学习整合开发实战的 ...
Spark Mllib里如何对决策树二元分类和决策树多元分类的分类数目numClasses控制（图文详解）
不多说,直接上干货! 决策树二元分类的分类数目numClasses控制具体,见 Hadoop+Spark大数据巨量分析与机器学习整合开发实战的第13章使用决策树二元分类算法来预测分类Stumble ...
用pytorch1.0搭建简单的神经网络：进行多分类分析
用pytorch1.0搭建简单的神经网络:进行多分类分析 import torch import torch.nn.functional as F # 包含激励函数 import matplotlib ...
利用CNN神经网络实现手写数字mnist分类
题目: 1)In the first step, apply the Convolution Neural Network method to perform the training on one ...
利用卷积神经网络（CNN）构造社区问答系统
/* 版权声明:能够随意转载,转载时请标明文章原始出处和作者信息 .*/ author: 张俊林 ...

随机推荐

iOS - OC Block 代码块
前言 Block 是一段预先准备好的代码,可以在需要的时候执行,可以当作参数传递.Block 可以作为函数参数或者函数的返回值,而其本身又可以带输入参数或返回值.Block 是 C 语言的,类似于一个 ...
iOS - MVP 架构模式
1.MVP 从字面意思来理解,MVP 即 Modal View Presenter(模型视图协调器),MVP 实现了 Cocoa 的 MVC 的愿景.MVP 的协调器 Presenter 并没有对 ...
MonkeyRunner学习（2）常用命令
目录: 1.截图 2.暂停 (时延秒) 3.屏幕操作 4.打印 5.字符串发送到键盘输入(登录输入) 6.唤醒设备屏幕 7.重起手机 8.按键(系统键) 9.回车键 10.for 循环 11.循环截图 ...
[精品推荐]Android Studio插件整理
GOOD 现在Android的开发者基本上都使用Android Studio进行开发(如果你还在使用eclipse那也行,毕竟你乐意怎么样都行).使用好Android Studio插件能大量的减少我们 ...
Hadoop 基本操作
1.关闭安全模式 hadoop dfsadmin -safemode leave
转：c的回归-云风
C 的回归周末出差,去另一个城市给公司的一个项目解决点问题.回程去机场的路上,我用手机上 google reader 打发时间.第一眼就看到孟岩大大新的一篇:Linux之父话糙理不糙 .主题是 C ...
使用Nginx和Logstash以及kafka来实现网站日志采集的详细步骤和过程
使用Nginx和Logstash以及kafka来实现网站日志采集的详细步骤和过程先列出来总体启动流程: (1)启动zookeeper集群(hadoop01.hadoop02和hadoop03这3台机 ...
配置Java EE Eclipse+Tomcat开发环境
以下将详细介绍在Eclipse下搭建Java EE开发环境的每一步, 环境:Win 7 + JDK 1.7 + Eclipse IDE for Java EE Developers 3.7 +Tomc ...
json遍历key value
http://blog.csdn.net/lanshengsheng2012/article/details/17679487 public static void main(String[] arg ...
java 集合（Map3）
Map接口下的实现类: HashMap 1.存储原理: 向HashMap中添加元素时,首先会调用hashCode(),算的哈希值,然后算出该元素在哈希表中的存储位置. 情况1 情况2(java 集 ...

利用LM神经网络和决策树去分类

利用LM神经网络和决策树去分类的更多相关文章

随机推荐

热门专题