机器学习常用sklearn库
Sklearn.model_selection(模型选择)
Cross_val_score:交叉验证
Train_test_split:数据切割
GridsearchCV:网格搜索
Sklearn.metrics(覆盖了分类任务中大部分常用验证指标)
Confusion_matrix(y_test,y_predict):混淆矩阵
Classification_report(y_test,y_predict):分类报告
Precision_score(test_y,prey):精确率
recall_score(test_y,prey):召回率
F1_score(test_y,prey):F1值
Roc_auc_score(test_y,prey):AUC值
Roc_curve(test_y,prepro[:,1]):ROC曲线参数
Mean_squared_error:均方差
R2_score:R2决定系数
Sklearn.tree(决策树)
DecisionTreeClassifier:分类决策树
DecisionTreeRegression:回归决策树
Export_graphviz():生成决策树图片
export_graphviz(best_dt,'best_dt.dot')
os.system('dot -Tjpg best_dt.dot -o 1604C.jpg')
Sklearn.decomposition(分解降维)
PCA:降维
explained_variance_ratio_ :每一行对应的等级数集
TruncatedSVD:文本降维
Sklearn.cluster(聚类)
Kmeans:K均值
AgglomerativeClustering:层次聚类
DBSCAN:密度聚类
Sklearn.linear_model(线性回归)
Lasson:L1正则化
ridge:岭回归L2正则化
LinearRegression:线性回归
Sklearn.ensemble(集成算法)
RandomForestClassifier:随机森林
ExtraTreesClassifier:极限随机树
AdaBoostClassifier:Adaboost算法(弱学习器)
GradientBoostingClassifier:GBDT(梯度提升回归树)算法
Sklearn.neighbors(邻近)
KNeighborsClassifier:KNN算法
Sklearn.svm
SVC:支持向量机
Sklearn.naive_bayes(朴素贝叶斯算法)
GaussionNB:高斯朴素贝叶斯
MultionmialNB:多项式朴素贝叶斯
BernoulliNB:伯努利朴素贝叶斯(分词)
Sklearn.proprecessing(数据预处理)
oneHotEncoder:独热编码
MinMaxscaler:线性归一化
StandardScaler:标准差归一化
LabelEncoder:数值标准化(类别特征转数值特征)
polynomialFeatures:多项式
Sklearn.feature_extraction.text(特征文本抽取)
CountVectorizer:词向量化
Sklearn.pipeline:管道
Pipeline:管道
Jieba
analyse:文本分析
Analyse.extract_tags 方法,提取排名靠前的关键词
Posseg:词性
Posseg.lcut() 方法,词性标注
Gensim
Corpora:全集
Corpora.Dictionary() 方法,构建词典
Models:模型
Models.Ldamodel() 方法,建立LDA主题模型,生成主题
From sqlalchemy import create_engine 连接mysql数据库
create_engine("mysql+pymysql://root:root@localhost:3306/pysql")
from wordcloud import WordCloud : 云词图
From PIL import Image 读取图片
wordcloud=WordCloud(font_path="simhei.ttf",background_color="white",max_font_size=80,mask=image)
机器学习常用sklearn库的更多相关文章
- Python机器学习笔记:sklearn库的学习
网上有很多关于sklearn的学习教程,大部分都是简单的讲清楚某一方面,其实最好的教程就是官方文档. 官方文档地址:https://scikit-learn.org/stable/ (可是官方文档非常 ...
- 2.sklearn库中的标准数据集与基本功能
sklearn库中的标准数据集与基本功能 下面我们详细介绍几个有代表性的数据集: 当然同学们也可以用sklearn机器学习函数来挖掘这些数据,看看可不可以捕捉到一些有趣的想象或者是发现: 波士顿房价数 ...
- 1.sklearn库的安装
sklearn库 sklearn是scikit-learn的简称,是一个基于Python的第三方模块.sklearn库集成了一些常用的机器学习方法,在进行机器学习任务时,并不需要实现算法,只需要简单的 ...
- Python: sklearn库——数据预处理
Python: sklearn库 —— 数据预处理 数据集转换之预处理数据: 将输入的数据转化成机器学习算法可以使用的数据.包含特征提取和标准化. 原因:数据集的标准化(服从均值为 ...
- 【机器学习】SKlearn + XGBoost 预测 Titanic 乘客幸存
Titanic 数据集是从 kaggle下载的,下载地址:https://www.kaggle.com/c/titanic/data 数据一共又3个文件,分别是:train.csv,test.csv, ...
- day-10 sklearn库实现SVM支持向量算法
学习了SVM分类器的简单原理,并调用sklearn库,对40个线性可分点进行训练,并绘制出图形画界面. 一.问题引入 如下图所示,在x,y坐标轴上,我们绘制3个点A(1,1),B(2,0),C(2,3 ...
- Python数据分析常用的库总结
Python之所以能够成为数据分析与挖掘领域的最佳语言,是有其独特的优势的.因为他有很多这个领域相关的库可以用,而且很好用,比如Numpy.SciPy.Matploglib.Pandas.Scikit ...
- 复盘一篇讲sklearn库学习文章(上)
认识 sklearn 官网地址: https://scikit-learn.gor/stable/ 从2007年发布以来, scikit-learn已成为重要的Python机器学习库, 简称sklea ...
- Python常用的库简单介绍一下
Python常用的库简单介绍一下fuzzywuzzy ,字符串模糊匹配. esmre ,正则表达式的加速器. colorama 主要用来给文本添加各种颜色,并且非常简单易用. Prettytable ...
随机推荐
- netty(七) Handler的执行顺序
Handler在netty中,无疑占据着非常重要的地位.Handler与Servlet中的filter很像,通过Handler可以完成通讯报文的解码编码.拦截指定的报文.统一对日志错误进行处理.统一对 ...
- tensorflow源码阅读(c++)(一)
root/tensorflow/core |--common_runtime # 公共运行库 |--distributed_runtime # 分布式执行模块,含有grpc session, grpc ...
- H-Modify Minieye杯第十五届华中科技大学程序设计邀请赛现场赛
题面见 https://ac.nowcoder.com/acm/contest/700#question 题目大意是有n个单词,有k条替换规则(单向替换),每个单词会有一个元音度(单词里元音的个数)和 ...
- Java8-函数式接口理解及测试
1. 函数式接口的理解 根据重构的思想,需要把容易变化的模块进行抽象并封装起来,从这个点来看,Java8新引入的函数式接口就是基于这个思想进行设计的. 2. 函数式接口定义 2.1 自定义如下 需要 ...
- promise之我见
在我们平时的方法中有很多方法是promise封装的, 有些函数后边跟的then和catch 就是promise的方法,先看一下pormise的特点 (1)对象的状态不受外界影响.Promise对象代表 ...
- selenium之 chromedriver与chrome版本映射表(更新至v2.46)
chromedriver版本 支持的Chrome版本 v2.46 v71-73 v2.45 v70-72 v2.44 v69-71 v2.43 v69-71 v2.42 v68-70 v2.41 v6 ...
- Win7远程桌面:发生身份验证错误
下载并安装KB4103718补丁,安装完成后重启计算机 http://www.catalog.update.microsoft.com/Search.aspx?q=KB4103718 根据操作系统选择 ...
- PHP整理--MySQL--DOS命令操作数据库
一.MySQL:关系型数据库,存在表的概念. MySQL的结构:数据库可以存放很多表,每张表可以存放多个字段,每个字段可以存放多个记录. 二.Dos操作数据库 用PHPStudy终端➡其他选项菜单➡M ...
- linux 学习之路:mkdir命令使用
linux mkdir 命令 在当前目录下创建文件夹,当前账号需要保证目录下有写到权限. 1.命令格式 mkdir[选项]文件名 mkdir 创建目录文件 语法:mkdir [ -m Mode ] ...
- windows server 2016安装
slmgr /skms kms.03k.org slmgr /ato slmgr /ipk WC2BQ-8NRM3-FDDYY-2BFGV-KHKQY kms服务器: https://03k.org/ ...