pandas 常用清洗数据（二）

1、

df.head()

Here we import pandas using the alias 'pd', then we read in our data.

df.head - shows us the first  rows and headers - it gives us an idea what to expect. df.tail - shows us the last  rows

2、

n []: df1 = pd.DataFrame({'A': ['A0', 'A1', 'A2', 'A3'],

   ...:                     'B': ['B0', 'B1', 'B2', 'B3'],

   ...:                     'C': ['C0', 'C1', 'C2', 'C3'],

   ...:                     'D': ['D0', 'D1', 'D2', 'D3']},

   ...:                     index=[, , , ])

   ...: `

In []: df2 = pd.DataFrame({'A': ['A4', 'A5', 'A6', 'A7'],

   ...:                     'B': ['B4', 'B5', 'B6', 'B7'],

   ...:                     'C': ['C4', 'C5', 'C6', 'C7'],

   ...:                     'D': ['D4', 'D5', 'D6', 'D7']},

   ...:                      index=[, , , ])

   ...:

In []: df3 = pd.DataFrame({'A': ['A8', 'A9', 'A10', 'A11'],

   ...:                     'B': ['B8', 'B9', 'B10', 'B11'],

   ...:                     'C': ['C8', 'C9', 'C10', 'C11'],

   ...:                     'D': ['D8', 'D9', 'D10', 'D11']},

   ...:                     index=[, , , ])

In frames = [df1, df2, df3]
In [5]: result = pd.concat(frames)
result = df1.append([df2, df3])

2、copy and value_counts

df2 = df.copy()

df2.DATE.value_counts().sort_index() //sort by index

data_print = data['vote_count'].value_counts().sort_index()

df['Amount'] = pd.to_numeric(df['Amount'])

3, add del

del df2['column_name']

del df2['column_name']

del df2['column_name']

df.insert(loc=, column='Country', value='UK')
data.insert(0, '性别', data.pop('gender'))#pop返回删除的列，插入到第0列，并取新名为'性别'

4、筛选：

bool = dt.str.contains   # df 是Series类型，不是DataFrame类型

                                   #返回的是True，False

#获取筛选数据

xuan_data =dt[bool]  #True的

pandas 常用清洗数据（二）的更多相关文章

pandas 常用清洗数据（三）排序，去重
1.排序 DataFrame 按照Index排序 Series.order()进行排序,而DataFrame则用sort或者sort_index或者sort_values 2.去重, dt = dt. ...
pandas 常用清洗数据（一）
数据源获取: https://www.kaggle.com/datasets 1. Look at the some basic stats for the ‘imdb_score’ column: ...
【转】Pandas学习笔记（二）选择数据
Pandas学习笔记系列: Pandas学习笔记(一)基本介绍 Pandas学习笔记(二)选择数据 Pandas学习笔记(三)修改&添加值 Pandas学习笔记(四)处理丢失值 Pandas学 ...
Python3 Pandas的DataFrame数据的增、删、改、查
Python3 Pandas的DataFrame数据的增.删.改.查一.DataFrame数据准备增.删.改.查的方法有很多很多种,这里只展示出常用的几种. 参数inplace默认为False,只 ...
Pandas常用操作方法
Pandas pandas 是基于NumPy 的一种工具,该工具是为了解决数据分析任务而创建的. Pandas 纳入了大量库和一些标准的数据模型,提供了高效地操作大型数据集所需的工具. pandas提 ...
Python数据分析与挖掘所需的Pandas常用知识
Python数据分析与挖掘所需的Pandas常用知识前言Pandas基于两种数据类型:series与dataframe.一个series是一个一维的数据类型,其中每一个元素都有一个标签.series ...
NumPy和Pandas常用库
NumPy和Pandas常用库 1.NumPy NumPy是高性能科学计算和数据分析的基础包.部分功能如下: ndarray, 具有矢量算术运算和复杂广播能力的快速且节省空间的多维数组. 用于对整组数 ...
Python数据分析之Pandas读写外部数据文件
1 引言数据分析.数据挖掘.可视化是Python的众多强项之一,但无论是这几项中的哪一项都必须以数据作为基础,数据通常都存储在外部文件中,例如txt.csv.excel.数据库.本篇中,我们来捋一捋 ...
Pandas常用数据结构
Pandas 概述 Pandas(Python Data Analysis Library)是基于NumPy 的一种工具,该工具是为了解决数据分析任务而创建的.Pandas 纳入了大量库和一些标准的数 ...

随机推荐

蓝桥杯Java真题解析
上个月参加蓝桥杯省赛拿了个省一,自从比赛完之后就一直没怎么写代码了,还有一个多月就要国赛了,从现在开始准备下国赛,但是我也不想学什么算法,而且我还在准备考研,所以就打算只做下历年的真题,争取国赛拿个国 ...
sqlserver 导入导出
待写 excel 导入数字日期等导入为文本,在excel设置类型为文本再导入即可. Excel数字.文本混合列导入SQL Server出现的问题&解决办法 Excel文件: 序号姓名内部 ...
使用uni-app开发微信小程序之登录模块
从微信小程序官方发布的公告中我们可获知:小程序体验版.开发版调用 wx.getUserInfo 接口,将无法弹出授权询问框,默认调用失败,需使用 <button open-type=" ...
centos7扩展根分区
参考网站:http://www.360doc.com/content/18/0128/11/52410512_725728162.shtml VirtualBox中安装了CentOS 7,给同事用来做 ...
Shell 编程（实例二）
创建一个脚本,为指定硬盘创建分区 1.列出当前系统所有磁盘,让用户选择,如果选择quit则退出脚本:如果选择错误,则重新选择 2.当用户选择完成后,询问是否继续 3.抹除选择磁盘上的分区,为其创建三个 ...
Swap Nodes in Pairs LeetCode题解
做完这个题目,感觉LeetCode的题目出的真好... 这种题,如果让我在面试时候纸上写代码,肯定会挂的. 我昨天晚上看的题目,昨天脑子是懵的,放下了.今天早上来做. 一开始做,提交,果然错了.写的代 ...
linux下安装Tomcat7.0
1.下载安装文件:Download apache-tomcat-7.0.14.tar.gz 下载1 下载 2.输入命令解压文件:tar - zxvf apach ...
data型怎么转换格式
data型如何转换格式01-1月 -03 如何转成 YYYY-MM-DD 的格式本来就是date了 ------解决方案--------------------to_char ...
Spring+Quartz 实现定时任务的配置方法
Spring+Quartz 实现定时任务的配置方法整体介绍一.Quartz介绍在企业应用中,我们经常会碰到时间任务调度的需求,比如每天凌晨生成前天报表,每小时生成一次汇总数据等等.Quartz是 ...
MyBatis基础-1
1.Mybatis简介 2.Mybatis环境搭建 3.Mybatis的开发方式一.什么框架框架其本质是半成品程序,提供相关规范,并且提供大量可重用的组件. 目的:让开发者开发出结构比较良好,可读 ...

pandas 常用清洗数据（二）

pandas 常用清洗数据（二）的更多相关文章

随机推荐

热门专题