python相关性算法解决方案(rest/数据库/json/下载)
1. 场景描述
一直做java,因项目原因,需要封装一些经典的算法到平台上去,就一边学习python,一边网上寻找经典算法代码,今天介绍下经典的相关性算法,算法原理就不介绍了,只从代码层面进行介绍,包含:rest接口、连接mpp数据库、回传json数据、下载图片及数据。(python聚类算法解决方案(rest接口/连接mpp数据库/回传json数据/下载图片及数据))
2. 解决方案
2.1 项目套路
(1)python经典算法是单独的服务器部署,提供rest接口出来,供java平台调用,交互的方式是http+json;
(2)数据从mpp数据库-Greenplum中获取;
(3)返回的数据包括三个:1是生成相关性图片的地址;2是相关性项目完整数据地址;3是返回给前端的200条json预览数据。
2.2 restapi类
分两个类,第一个是restapi类,封装rest接口类,其他的经典算法在这里都有对应的方法,是个公共类。
完整代码:
# -*- coding: utf-8 -*-
from flask import Flask, request, send_from_directory
from relation import execRelation
import logging
app = Flask(__name__)
#1. 服务器上更改为服务器地址,用于存放数据
dirpath = 'E:\\ruanjianlaowang'
#2. 测试连通性,软件老王
@app.route('/')
def index():
return "Hello, World!"
#3. 相关性算法
@app.route('/getRelationInfoByLaowang', methods=['POST'])
def getRelationInfoByLaowang():
try:
result = execRelation(request.get_json(), dirpath)
except IndexError as e:
logging.error(str(e))
return 'exception:' + str(e)
except KeyError as e:
logging.error(str(e))
return 'exception:' + str(e)
except ValueError as e:
logging.error(str(e))
return 'exception:' + str(e)
except Exception as e:
logging.error(str(e))
return 'exception:' + str(e)
else:
return result
#4.文件下载(图片及csv)
@app.route("/<path:filename>")
def getImages(filename):
return send_from_directory(dirpath, filename, as_attachment=True)
#5.启动
if __name__ == '__main__':
app.run(host="0.0.0.0", port=5000, debug=True)
代码说明:
使用的是第三方的flask提供的rest服务
(1)服务器上更改为服务器地址,用于存放数据
(2)测试连通性,软件老王
(3)相关性算法 软件老王
(4)文件下载(图片及csv)
(5)启动
2.3 相关性算法类
完整代码:
import matplotlib.pyplot as plt
import seaborn as sns
import dbgp as dbgp
plt.switch_backend('agg')
from pandas.io import json
import numpy as np
# 执行 软件老王
def execRelation(params, dirpath):
# 1.获取参数,软件老王
sql = params.get("sql")
url = params.get("url")
name = params.get("name")
grouplinesname = params.get("grouplinesname")
#2. 校验是否为空,软件老王
flag = checkparam(sql)
if not flag is None and len(flag) != 0:
return flag
# 3. 从数据库获取数据,软件老王
try:
new_data = dbgp.queryGp(sql)
except IndexError:
return sql
except KeyError:
return sql
except ValueError:
return sql
except Exception:
return sql
if new_data.empty:
return "exception:此数据集无数据,请到数据处理或可视化确认后重试"
# 4 相关性调用,软件老王
if not grouplinesname is None and len(grouplinesname) != 0:
new_data.columns = grouplinesname.split(',')
corr = new_data.corr()
# 5.生成导出excel 软件老王
outputfile = dirpath + name + '.csv'
corr.to_csv(outputfile, encoding='utf_8_sig') # 保存结果
#6.生成图片及返回json,软件老王
# 6.1 中文处理,软件老王
plt.rcParams['font.sans-serif'] = ['simhei']
plt.rcParams['font.family'] = 'sans-serif'
plt.rcParams['axes.unicode_minus'] = False
# 6.2 画图,生成图片,软件老王
f, ax = plt.subplots(figsize=(14, 10))
mask = np.zeros_like(corr)
mask[np.triu_indices_from(mask)] = True
cmap = sns.cubehelix_palette(n_colors=6, start=0, rot=0.4, gamma=1.0, hue=0.8, light=0.85, dark=0.15, reverse=False, as_cmap=False)
sns.heatmap(corr, cmap=cmap, square=False, linewidths=0.05, ax=ax, annot=True)
# 6.3 返回json数据给前端展示,软件老王
ax.set_title(name)
image = dirpath + name + '.jpg'
f.savefig(image, dpi=150, bbox_inches='tight')
plt.clf()
plt.close(0)
# 6.3 返回json数据给前端展示,软件老王
result = {}
result['image_url'] = url + '/' + name + '.jpg'
result['details_url'] = url + '/' + name + '.csv'
result['data'] = corr[:200]
result = json.dumps(result, ensure_ascii=False)
result = result.replace('\\', '')
return result
def checkparam(sql):
if sql is None or sql.strip() == '' or len(sql.strip()) == 0:
return "数据集或数据列,不能为空"
代码说明:
(1)获取参数,软件老王;
(2)校验是否为空,软件老王;
(3)从数据库获取数据,软件老王;
(4)相关性调用,软件老王;
(5)生成导出excel 软件老王
(6)生成图片及返回json,软件老王
(6.1) 中文处理,软件老王
(6.2) 画图,生成图片,软件老王
(6.3) 返回json数据给前端展示,软件老王
2.4 执行效果
2.4.1 json返回
{"image_url":"http://10.192.168.1:5000/relation-软件老王-5656556111.jpg","details_url":"http://10.192.168.1:5000/relation-软件老王-5656556111.csv","data":{"老王1":{"老王1":1.0,"老王2":-0.4202351976,"老王3":0.2285667348,"老王4":-0.4980851314,"老王5":-0.3329292459},"老王2":{"老王1":-0.4202351976,"老王2":1.0,"老王3":-0.4460527829,"老王4":-0.091612708,"老王5":-0.033863611},"老王3":{"老王1":0.2285667348,"老王2":-0.4460527829,"老王3":1.0,"老王4":-0.2253017703,"老王5":-0.451881358},"老王4":{"老王1":-0.4980851314,"老王2":-0.091612708,"老王3":-0.2253017703,"老王4":1.0,"老王5":0.3636169126},"老王5":{"老王1":-0.3329292459,"老王2":-0.033863611,"老王3":-0.451881358,"老王4":0.3636169126,"老王5":1.0}}}
2.4.2 返回图片

2.4.3 返回的数据

另外说明: 目前项目环境上用的是8核16G的虚拟机,执行数据量是30万,运行状况良好。
I’m 「软件老王」,如果觉得还可以的话,关注下呗,后续更新秒知!欢迎讨论区、同名公众号留言交流!
python相关性算法解决方案(rest/数据库/json/下载)的更多相关文章
- python聚类算法解决方案(rest接口/mpp数据库/json数据/下载图片及数据)
1. 场景描述 一直做java,因项目原因,需要封装一些经典的算法到平台上去,就一边学习python,一边网上寻找经典算法代码,今天介绍下经典的K-means聚类算法,算法原理就不介绍了,只从代码层面 ...
- python:序列化与反序列化(json、pickle、shelve)
本节内容 前言 json模块 pickle模块 shelve模块 总结 一.前言 1. 现实需求 每种编程语言都有各自的数据类型,其中面向对象的编程语言还允许开发者自定义数据类型(如:自定义类),Py ...
- spring mvc ajaxfileupload文件上传返回json下载问题
问题:使用spring mvc ajaxfileupload 文件上传在ie8下会提示json下载问题 解决方案如下: 服务器代码: @RequestMapping(value = "/ad ...
- python 读取mysql存储的文件路径下载文件,内容解析,上传七牛云,内容入es
#!/usr/bin/env python # -*- coding: utf-8 -*- import ConfigParser import json import os import re fr ...
- 疯狂Python讲义PDF高清完整版免费下载|百度网盘
百度网盘:疯狂Python讲义PDF高清完整版免费下载 提取码:uzba 内容简介 <疯狂Python讲义>既是一本适合初学者入门Python的图书(一个8岁的小朋友在未出版前已学习了本书 ...
- python Django教程 之 模型(数据库)、自定义Field、数据表更改、QuerySet API
python Django教程 之 模型(数据库).自定义Field.数据表更改.QuerySet API 一.Django 模型(数据库) Django 模型是与数据库相关的,与数据库相关的代码 ...
- paper 28 :一些常见常用数据库的下载网站集锦
做图像处理+模式识别的童鞋怎么可以没有数据库呢? 但是,如果自己做一个数据库,费时费力费钱先不说,关键是建立的数据库的公信力一般不会高,做出的算法也别人也不好比较,所以呢,下载比较权威的公共数据库还是 ...
- Python中通过cx_Oracle访问数据库遇到的问题总结
以下是Python中通过cx_Oracle操作数据库的过程中我所遇到的问题总结,感谢我们测试组的前辈朱勃给予的帮助最终解决了下列两个问题: 1)安装cx_Oracle会遇到的问题:在Windo ...
- python ssh登录linux 上传和下载文件
#!usr/bin/python# coding: utf-8 import paramikoimport jsonremotedir='/tmp/log'remotefile = 'bst_mana ...
随机推荐
- [WPF自定义控件库]自定义Expander
1. 前言 上一篇文章介绍了使用Resizer实现Expander简单的动画效果,运行效果也还好,不过只有展开/折叠而缺少了淡入/淡出的动画(毕竟Resizer模仿Expander只是附带的功能).这 ...
- vs2013类模板的修改
很多人一起写程序,往往都有规定的代码模板,比如要求每个类都有注释,说明开发者是谁,类的功能以及其他信息.如果每次建一个类,手工去复制这些信息很麻烦,也很容易遗漏.我们可以直接修改VS2013创建类的时 ...
- ubuntu环境下测试cache大小并校验
Cache存储器:电脑中为高速缓冲存储器,是位于CPU和主存储器DRAM(Dynamic Random Access Memory)之间,规模较小,但速度很高的存储器,通常由SRAM(Static R ...
- Codeforces Round #565 (Div. 3)
传送门 A. Divide it! •题意 给定一个数n, 每次可以进行下列一种操作 1.如果n可以被2整除,用n/2代替n 2.如果n可以被3整除,用2n/3代替n 3.如果n可以被5整除,用4n/ ...
- JDBC教程
JDBC代表Java与数据库的连接,这对Java编程语言和广泛的数据库之间独立于数据库的连接标准的Java API. JDBC库包含的API为每个通常与数据库的使用相关联的任务: 使得连接到数据库 创 ...
- T-SQL 恢复数据库
USE master GO ALTER DATABASE DEMO SET SINGLE_USER GO ALTER DATABASE DEMO SET EMERGENCY GO DBCC CHECK ...
- JAVA对象实例化方式总结
JAVA对象实例化的方法 New对象实例 // 直接new对象实例 Productor productor = new Productor(); 反射机制 Java反射机制是在运行状态中,对于任意一个 ...
- TCP重置报文段及RST常见场景分析
RST表示连接重置,用于关闭那些已经没有必要继续存在的连接.一般情况下表示异常关闭连接,区别与四次分手正常关闭连接. 产生RST的三个条件是: 目的地为某端口的SYN到达,然而在该端口上并没有正在监听 ...
- java 8中新的日期和时间API
java 8中新的日期和时间API 使用LocalDate和LocalTime LocalDate的实例是一个不可变对象,它只提供了简单的日期,并不含当天的时间信息.另外,它也不附带任何与时区相关的信 ...
- spark 入门教程合集
看到一篇不错的 spark 入门教程的合集,在此记录一下 http://www.cnblogs.com/shishanyuan/p/4699644.html