与pandas初相识

　　前一阵子有个同事说，他看不懂从kibana上拉下来的日志，但是又想分析一些数据，感觉很头痛，每次都找开发给他整理一下，但是开发也很忙，要数据的频率也略高，那时候正好我跟这位需求方的项目，负责测试工作。然后，我晚上加班的时候就帮他写了一个很小的程序，帮助这位需求方同事可以随时查看数据。也不会占用任何人太多时间。

　　解决思路：

　　一、读取原始报表

　　　　这里的config.ini中放的是原始报表名称　

[filenames]

file_name=XXXXXX.csv

　　二、拆分数据

　　三、按照既定规则计算符合flag的数据

　　四、拼接数据，形成新的报表输出

'''

@create on : 20190311

@Update : 20190311

@description: 该模块可以直接获取最直观的报表

'''

import pandas as pd

import configparser

import os

import json

# 获取项目根目录

dirpath = os.path.dirname(os.path.realpath(__file__))

# 拼接时候注意一下，会从第一个带有斜杠的地址开始拼接

sencondpath = os.path.join(dirpath, "log_file")

config = configparser.ConfigParser()

config.read("config.ini")

filename = config.get("filenames", "file_name")

# 改config.ini中的文件名自动拼接

finalpath = os.path.join(sencondpath, filename)

# 读入的CSV数据对象

log_df = pd.read_csv(finalpath, encoding="utf-8")

print(log_df)

# 半成品矩阵

def mergedf():

    df_right = log_df['message']

    df_left = log_df['@timestamp']

    result_df = pd.concat([df_left, df_right], axis=1)

    return result_df

def oprate_df():

    # 计算有多少符合数据旗标

    flag = 0

    df_size = log_df.__len__()

    urlParams, jrtt_reports, convert_ids = [], [], []

    try:

        goal_df = mergedf()

        for line in range(df_size):

            data_row = json.loads(log_df.loc[line, 'message'])

            print(log_df.loc[line, '@timestamp'])

            if data_row["data"]["jrtt_report"] is not None and data_row["data"]["convert_id"] is not None:

                flag = flag + 1

            line = line + 1

            urlParams.append(data_row["data"]["urlparams"])

            jrtt_reports.append(data_row["data"]["jrtt_report"])

            convert_ids.append(data_row["data"]["convert_id"])

        print(flag)

    except Exception as e:

        print("日志文件解析出错" + str(e))

    try:

        goal_df.insert(0, 'uelParmas', urlParams)

        goal_df.insert(0, 'jrtt_repot', jrtt_reports)

        goal_df.insert(0, 'convert_id', convert_ids)

    except Exception as e:

        print("矩阵组合出错！"+str(e))

    #print(goal_df)

    return goal_df

if __name__ == '__main__':

    total_df = oprate_df()

    excelFile = "D:/anylysis/dataResult/workResult.xlsx"

    writer = pd.ExcelWriter(excelFile)

    total_df.to_excel(writer, 'FinalResult')

    writer.save()

与pandas初相识的更多相关文章

初相识｜performance_schema全方位介绍
初相识|performance_schema全方位介绍 |导语很久之前,当我还在尝试着系统地学习performance_schema的时候,通过在网上各种搜索资料进行学习,但很遗憾,学习的效果并不 ...
Pandas初体验之数据结构——Series和DataFrame
Pandas是为了解决数据分析任务而创建的,纳入了大量的库和标准数据模型,提供了高效地操作大型数据集所需的工具. 对于Pandas包,在Python中常见的导入方法如下: from pandas im ...
Pandas初体验
目录 Pandas 一.简介 1.安装 2.引用方法二.series 1.创建方法 2.缺失数据处理 2.1 什么是缺失值 2.2 NaN特性 2.3 填充NaN 2.4 删除NaN 2.5 其他方 ...
我和python的初相识
认识Python是大二的选修单纯只是想赚学分而已后来觉得越来越有趣. 一.python简介简单来说Python 是一个高层次的结合了解释性.编译性.互动性和面向对象的脚本语言.Python 的设 ...
audacity 做音频分析之－－初相识
软件介绍: Audacity是一个跨平台的声音编辑软件,用于录音和编辑音频,是自由.开放源代码的软件.可在Mac OS X.Microsoft Windows.GNU/Linux和其它操作系统上运作. ...
神经网络架构PYTORCH－初相识（3W）
who? Python是基于Torch的一种使用Python作为开发语言的开源机器学习库．主要是应用领域是在自然语言的处理和图像的识别上．它主要的开发者是Facebook人工智能研究院(FAIR)团队 ...
Java 初相识
Java是如何出现的呢?这就要回到1991年,那时候随着单片机的发展,出现了很多微型的系统,Sun公司在这个时候就成立的一个项目组,成员就有我们熟知的“Java之父” 詹姆斯·高斯林,起初的目标是为了 ...
3.Spring Cloud初相识--------Ribbon客户端负载均衡
前言: 在生产环境中,未避免单点故障,每个微服务都会做高可用部署. 通白的说,就是每一个一模一样的服务会根据需求提供多分在多台机器上. 那么在大并发的情况下,如何分配服务可以快速得到响应,就成为了我们 ...
NetworkX初相识
听说NetworkX是一个很牛的复杂网络研究的工具,就来试一下吧. import networkx as nx G= nx.Graph()#建立一个空白的图 G.add_node("node ...

随机推荐

Monkey常用操作
原文:https://www.cnblogs.com/lauren1003/p/6193277.html 一.Monkey测试原理:Monkey是Android中的一个命令行工具,可以运行在模拟器里或 ...
PO模式学习笔记
框架: 1.PO模式应用(测试对象和测试用例分离)(写到简历中) 2.引入ddt 3.深入分层:测试数据分离 4.遵循原则:测试用例的独立性 5.深入分层:元素定位分离 6.框架优化:提取basepa ...
框架-设备与驱动的拆分及实现-I2C
目录前言笔录草稿概要原理及实现方法 IIC 例子实战-驱动 1. 创建文件 2. 创建 I2C 驱动名字列表 3. 组建 I2C 驱动结构体 4. 编写-注册 I2C 驱动函数 5. 创建 I ...
kafka-伪集群搭建
一.简介 Apache Kafka是一个快速.可扩展的.高吞吐的.可容错的分布式"发布-订阅"消息系统,使用Scala与Java语言编写,能够将消息从一个端点传递到另一个端点, ...
第二章 OSI参考模型
一.产生背景 1.伴随着计算机网络的飞跃发展,各大厂商根据自己的协议生产出了不同的硬件和软件 2.为了实现网络设备间的互相通讯,ISO和IEEE相继提出了OSI参考模型及其TCP/IP模型二.OSI ...
为iOS编译FFmpeg静态库
为iOS编译FFmpeg静态库   环境:OS X Yosemite (版本10.10.5) Xcode (Version 7.1.1 (7B1005))     一.资料准备: (1)ffmpeg源 ...
设备屏幕与Size Class对应
dns配置文件的方式
1./etc/resolve.conf /etc/resolv.conf它是DNS客户机配置文件,用于设置DNS服务器的IP地址及DNS域名,还包含了主机的域名搜索顺序.该文件是由域名解析器(res ...
安卓日常开发和逆向中常用的shell命令与非shell命令
简述shell 命令与非shell命令区别 shell命令不用先adb shell进入界面执行非shell命令必须要 adb shell进入界面执行基础非shell命令 1.安装app adb ...
【CF1436B】Prime Square 题解
原题链接题意简介要求构造一个由不大于 1e5 的非负数构成的正方形矩阵,矩阵的每个元素不是质数,但每一行.每一列的数字的和都是质数. 思路分析看到样例二,我们知道数字可以重复. 于是,我们很容易 ...

与pandas初相识

与pandas初相识的更多相关文章

随机推荐

热门专题