基于python、jupyter-notebook 的金融领域用户交易行为分析

说明：本文重在说明交易数据统计、分析方法，所有数据均为生成的数据

　　　　时间原因代码未定义成函数

统计指标：1.用户单日交易行为数据

　　　　　2.按小时为计算单位，统计用户行为数据（旨在求得一天24小时中每个小时的交易金额、交易量和后再做统计计算）

获取数据代码如下：

 #!/usr/bin/env python

 # -*- coding: utf-8 -*-

 __author__ = 'zqf'

 import pymysql

 import random

 import time

 from conf import test_conf

 con = pymysql.connect(**test_conf.con_set)

 print("连接成功")

 cur = con.cursor()

 time_start = time.time()

 for i in range(1, 100000):

     phone_random = random.randint(10000000000, 19999999999)

     transaction_amount_random = random.uniform(0, 50000)

     transaction_type_random = random.randint(1, 5)

     # sql = "select * from my_database.transcation_info"

     sql = "insert into my_database.transaction_info(user_id, name, phone, transaction_amount, transaction_type, " \

           "transaction_time) values('%d', 'name%d', '%d', '%d', '%d', '2019-05-%d %d:%d:%d')" % \

           (random.randint(1, 1000), random.randint(1, 1000), phone_random, transaction_amount_random,

            transaction_type_random, random.randint(1, 31), random.randint(0, 23), random.randint(0, 59),

            random.randint(0, 59))

     cur.execute(sql)

 print("execute完毕即将提交")

 try:

     con.commit()

     print("提交成功")

 except Exception:

     print("插入失败")

     con.rollback()

 time_stop = time.time()

 take_time = time_stop - time_start

 print("花费时间：", take_time)

 # print(cur.fetchall())

在juoyter-notebook中

导入所需包

# 导入所需包
import pandas as pd

import pymysql

from datetime import datetime

import time

from matplotlib import pyplot as plt

plt.rcParams['font.family'] = ['sans-serif']

plt.rcParams['font.sans-serif'] = ['SimHei']

# from conf import test_conf

连接sql数据库

 # 连接数据库

 con = pymysql.connect(**{

     'database': 'my_database',

     'host': '192.168.**.**',

     'port': 3306,

     'user': 'root',

     'password': '********',

     'charset': 'utf8'

 })

 print("连接成功")

 cur = con.cursor()

 sql = "select * from transaction_info"

 time_start = time.time()

 df = pd.read_sql(sql=sql, con=con)

 time_stop = time.time()

 take_time = time_stop - time_start

 print("读取十万条数据花费时间：", take_time)

 # print(df)

连接成功

读取十万条数据花费时间： 4.09512186050415

# 用户每天每小时最大交易金额

df_groupby_hour = df.groupby(['user_id', df['transaction_time'].apply(lambda item: datetime.strftime(item, '%Y-%m-%d %H'))])

# 计算每天每小时交易金额最大值， 最小值， 平均值， 交易次数， 交易金额总计

df_calculate_by_hour = df_groupby_hour['transaction_amount'].agg([["daily_max", "max"], ["daily_min", "min"], ["daily_mean", "mean"], ["daily_count", "count"], ["daily_sum", "sum"]])

# 注：每天每小时交易金额最大值为每个小时中累计金额的最大值，所以后续需对hour_sum计算相应参数，hour_max、hour_min、hour_mean的后续相应

# 计算均为以天为单位

df_calculate_by_hour

# 将user_id， transaction_time层索引设置成列索引

df_calculate_by_hour_reset_index = df_calculate_by_hour.reset_index()

df_calculate_by_hour_reset_index

# 再根据user_id、transaction_time 分组，到天

df_calculate_by_hour_reset_index_regroup = df_calculate_by_hour_reset_index.groupby(['user_id', df_calculate_by_hour_reset_index['transaction_time'].apply(lambda item: datetime.strftime(pd.to_datetime(item), '%Y-%m-%d'))])

# 聚合计算

df_finally = df_calculate_by_hour_reset_index_regroup.agg({'daily_max':['max'], 'daily_min':['min'], 'daily_mean':['mean'], 'daily_count':['sum', 'max', 'min', 'median', 'std', 'mean'], 'daily_sum':['sum', 'max', 'min', 'median', 'std', 'mean']})

# 获取用户交易信息

search_user_id = 1

get_user_message = df_finally.loc[search_user_id]

# 将user_id， transaction_time层索引设置成列索引

df_finally_reset = df_finally.reset_index()

df_finally.loc[search_user_id]

# 绘制每天参数图

plt.figure(figsize=(10, 6))

plt.xticks(rotation=45)

x = df_finally.loc[search_user_id].index

li_daily = df_finally.columns.levels[0][:-2]

colors = ['y', 'k', 'r']

for index, i in enumerate(li_daily):

    plt.plot(x, df_finally.loc[search_user_id][i][df_finally[i].columns[0]], label=f"{i}", color=colors[index])

plt.title("每天交易统计")

plt.xlabel("日期")

plt.ylabel("交易金额")

plt.legend()

plt.show()

# 绘制交易量交易图

plt.figure(figsize=(10, 6))

plt.xticks(rotation=45)

daily_count_str = df_finally.columns.levels[0][3]

li_counts = df_finally[daily_count_str].columns

x = df_finally.loc[search_user_id].index

df_finally.columns.levels[0][3]

colors = ['b', 'g', 'c', 'y', 'k', 'r']

for index, i in enumerate(li_counts):

    plt.plot(x, df_finally.loc[search_user_id][daily_count_str][i], label=f"{i}", color=colors[index])

plt.title("每天交易统计")

plt.xlabel("日期")

plt.ylabel("交易次数")

plt.legend()

plt.show()

# 绘制每天每小时交易图

plt.rcParams['font.family'] = ['sans-serif']

plt.rcParams['font.sans-serif'] = ['SimHei']

plt.figure(figsize=(10, 6))

plt.xticks(rotation=45)

x = df_finally.loc[search_user_id].index

li_daily_hour = df_finally.columns.levels[1]

daily_sum_str = df_finally.columns.levels[0][4]

colors = ['b', 'g', 'c', 'y', 'k', 'r']

for index, i in enumerate(li_daily_hour):

    plt.plot(x, df_finally.loc[search_user_id][daily_sum_str][i], label=f"{i}", color=colors[index])

plt.title("每天每小时交易统计")

plt.xlabel("日期")

plt.ylabel("交易金额")

plt.legend()

plt.show()

基于python、jupyter-notebook 的金融领域用户交易行为分析的更多相关文章

Python,Jupyter Notebook，IPython快速安装教程
0.安装环境 Windows10,Python3.5.1,IPython,jupyter notebook,and other functionality 官方安装文档Linux版3.x 官方安装文档 ...
[python] [Jupyter Notebook]
最近又要用notebook 转一篇我原来写的安装教程还是很好用的. IPython是一个 Python 的一个交互式 shell,它提供了很多内建的函数.Jupyter Notebook是IPyt ...
教你用Python Jupyter Notebook 制作代码分享 PPT
PPT 是个强大的工具,但是笔者的 PPT 制作技术不咋地,所以之前的分享习惯使用 Jupyter Notebook + RISE,这样使用简单的 markdown 格式加上代码就足够做一次代码分享了 ...
Python/Jupyter Notebook以及可视化的运用
最近陆陆续续使用Jupyter Notebook和Python可视化做了一些小工具,用于提高开发效率. 这里将其归类总结一下,作为学习的记录.
Python·Jupyter Notebook各种使用方法
PythonJupyter Notebook各种使用方法记录持续更新一 Jupyter NoteBook的安装 1 新版本Anaconda自带Jupyter 2 老版本Anacodna需自己安装Ju ...
MAC安装python jupyter notebook
介绍: Jupyter Notebook(此前被称为 IPython notebook)是一个交互式笔记本,支持运行 40 多种编程语言. Jupyter Notebook 的本质是一个 Web 应用 ...
Python·Jupyter Notebook各种使用方法记录
标签(空格分隔): Python 一 Jupyter NoteBook的安装 1 新版本Anaconda自带Jupyter 2 老版本Anacodna需自己安装Jupyter 二更改Jupyter ...
[Mac][Python][Jupyter Notebook]安装配置和使用
Jupyter 项目(以前称为 IPython 项目),提供了一套使用功能强大的交互式 shell 进行科学计算的工具,实现了将代码执行与创建实时计算文档相结合. 这些 Notebook 文件可以包含 ...
基于Python项目的Redis缓存消耗内存数据简单分析（附详细操作步骤）
目录 1 准备工作 2 具体实施 1 准备工作什么是Redis? Redis:一个高性能的key-value数据库.支持数据的持久化,可以将内存中的数据保存在磁盘中,重启的时候可以再次加载进行使 ...

随机推荐

Opencv+Zbar二维码识别（一维码校正）
一维码由一组规则排列的黑色线条.白色线条以及对应的字符组成.对倾斜的(没有严重形变)一维码的角度校正,可以根据其黑白相间.排列规则的特点,计算傅里叶频谱,通过傅里叶频谱中直线的倾斜角度计算空间域图像一 ...
[Codeforces 140C] New Year Snowmen
[题目链接] https://codeforces.com/problemset/problem/140/C [算法] 显然 , 我们每次应优先考虑数量多的雪球将雪球个数加入堆中 , 每次取出数量前 ...
4.4 Top-Down Parsing
4.4 Top-Down Parsing Top-down parsing can be viewed as the problem of constructing a parse tree for ...
TI BLE ： GAP Bond Manager
// Setup the GAP Bond Manager { uint32 passkey = 0; // passkey "000000" uint8 pairMode = G ...
VS快捷键整理
Ctrl+J 自动提示Ctrl+. 解析ctrl+e,d 格式化代码ctrl+e,s 辅助横线Ctrl+m,o 全部合闭Ctrl+m,l 全部打开Ctrl + Shift + space 方法提示调用 ...
【转载】Java - Wait & Notify
[本文转自]http://www.cnblogs.com/dolphin0520/p/3920385.html 这三个方法的文字描述可以知道以下几点信息: 1)wait().notify()和noti ...
GitHub中有关已建仓库及上传项目文件的删除
上传了项目,竟然发现找不到删除的地方,真是囧... 1. 已建仓库的删除点击 settings,进入以下界面,点击箭头指向的按钮进入以下界面 2. 某个文件的删除直接点开文件,在右上角有个删除工 ...
MySQL性能优化神器Explain
本文涉及:MySQL性能优化神器Explain的使用简介虽然使用Explain不能够马上调优我们的SQL,它也不能给予我们一些调整建议,但是它能够让我们了解MySQL 优化器是如何执行SQL 语句 ...
Android 性能优化（27）＊zipalign让apk数据对齐，运行更快。
1.zipalign 简介 zipalign is an archive alignment tool that provides important optimization to Android ...
Spring Boot (27) actuator服务监控与管理
actuaotr是spring boot项目中非常强大的一个功能,有助于对应用程序进行监控和管理,通过restful api请求来监管.审计.收集应用的运行情况,针对微服务而言它是必不可少的一个环节. ...

基于python、jupyter-notebook 的金融领域用户交易行为分析

说明：本文重在说明交易数据统计、分析方法，所有数据均为生成的数据

统计指标：1.用户单日交易行为数据

2.按小时为计算单位，统计用户行为数据（旨在求得一天24小时中每个小时的交易金额、交易量和后再做统计计算）

在juoyter-notebook中

导入所需包

连接sql数据库

基于python、jupyter-notebook 的金融领域用户交易行为分析的更多相关文章

随机推荐

热门专题

　　　　　2.按小时为计算单位，统计用户行为数据（旨在求得一天24小时中每个小时的交易金额、交易量和后再做统计计算）