dataframe 列名重新排序

在用list包含多个dict的模式生成dataframe时，由于dict的无序性，而uci很多数据的特征名直接是1,2,3...，生成的dataframe和原生的不一样，

为了方便观看和使用，我们将其列名排序：

有以下两种方法（都不包含y列的情况下）：

1、（我的）：

df.columns = df.columns.astype(int)

df.sort_index(axis=1,inplace=True)

先将列名从字符串转为int型，然后再对列名排序。

2、（网上看到的）：

对于这样的数据： ['Q1.3','Q6.1','Q1.2','Q1.1',......]

要变为这样的： ['Q1.1','Q1.2','Q1.3',.....'Q6.1',......]

df.reindex_axis(sorted(df.columns), axis=1)

这样的话，似乎对于字符串型数据也可以排序（但如果要解决我那个问题，也要先进行数据类型的转换）

最后，附上完整的从uci.txt文本数据类型转换为dataframe表格式的numerical类型代码：

X,y = [],[]

with open("ionosphere_scale.txt") as f:

    lines = f.readlines()

    for line in lines:

        line = line.split()

        y.append(line[0])

        X.append({i.split(":")[0]:i.split(":")[1] for i in line[1:]})

df = pd.DataFrame(X,dtype="float")

n_feat = len(df.columns)

df.columns = df.columns.astype(int)

df.sort_index(axis=1,inplace=True)

df["y"] = np.array(y,dtype=float)

print(df.info())

df.to_excel("ionosphere_scale.xlsx",index=None)

最后，mark一篇关于数据类型转换的文章：https://vimsky.com/article/3694.html

dataframe 列名重新排序的更多相关文章

pandas 修改 DataFrame 列名
问题: 有一个DataFrame,列名为:['$a', '$b', '$c', '$d', '$e'] 现需要改为:['a', 'b', 'c', 'd', 'e'] 有何办法? import pan ...
Pandas——修改DataFrame列名
#生成一个数据框 import pandas as pd a = pd.DataFrame({'a':[1,2,3], 'b':[4,5,6], 'c':[7,8,9]}) #直接修改:缺点必须写明每 ...
获取DataFrame列名的3种方法
df= pd.DataFrame({'a': range(10, 20), 'b': range(20, 30)}) df 1.链表推倒式 [column for column in df][a,b] ...
datatable 列名重新排序
1. DataTable.Columns["MONEY"].SetOrdinal[4]; 2.dt = dt.DefaultView.ToTable(false, listarr. ...
R dataframe 列名包含减号，列名自动变为点
d<- data.frame(x = c(0, 1)) d<- data.frame(d, y = c(0,1)) names(d)[2]<- "a.-5" d ...
大数据入门到精通11-spark dataframe 基础操作
// dataframe is the topic 一.获得基础数据.先通过rdd的方式获得数据 val ny= sc.textFile("data/new_york/")val ...
R 语言的Dataframe常用操作
上节我们简单介绍了Dataframe的定义,这节我们具体来看一下Dataframe的操作首先,数据框的创建函数为 data.frame( ),参考R语言的帮助文档,我们来了解一下data.frame ...
『Kaggle』分类任务_决策树&集成模型&DataFrame向量化操作
决策树这节中涉及到了很多pandas中的新的函数用法等,所以我单拿出来详细的理解一下这些pandas处理过程,进一步理解pandas背后的数据处理的手段原理. 决策树程序数据载入 pd.read_c ...
pandas基础(1)_Series和DataFrame
1:pandas简介 Python Data Analysis Library 或 pandas 是基于NumPy 的一种工具,该工具是为了解决数据分析任务而创建的.Pandas 纳入了大量库和一些标 ...

随机推荐

在java中public void与public static void有什么区别 ?
public void 修饰是非静态方法,该类方法属于对象,在对象初始化(new Object())后才能被调用:public static void 修饰是静态方法,属于类,使用类名.方法名直接调用 ...
Instagram发布动态自动裁剪照片说明
发布Ins时,照片总是被截取一截,感觉很不爽...然后就仔细了解了Ins是如何限制图片大小的. 官方帮助说的很清楚,https://help.instagram.com/163182164042672 ...
JAVA 集合相关整理和学习
一.Set接口实现类二.List接口实现类三.Queue接口实现类四.Map接口实现类五.上面的图片截自附件: 附件列表
Debug技巧：条件断点和远程Debug
一.断点: 1.条件断点本以为条件断点很难,其实就这样. 二.远程Debug 1.首先看服务器是不是在Debug模式下工作不是则进行(tomcat/bin/catalina.sh)配置. -Xde ...
Grammar Rules
Grammar Rules Here are 20 simple rules and tips to help you avoid mistakes in English grammar. For m ...
Powershell运行Invoke-Sqlcmd命令的先决条件
运行Invoke-Sqlcmd命令,使用这个命令需满足如下条件: 1.在运行服务器中安装SQL Server 2008 R2 Management ObjectsI 2.在运行命令 invoke-sq ...
跳出NSDate
感觉任何语言关于时间的格式化处理,时区的处理都是多的,最近被NSDate的各种问题坑了好久先看看关于NSDate自己的问题 1.NSDate NSDate获取当前时间 NSDate *date=[N ...
hdu 3047 Zjnu Stadium 并查集高级应用
Zjnu Stadium Time Limit: 2000/1000 MS (Java/Others) Memory Limit: 32768/32768 K (Java/Others) Tot ...
Gson 解析多层嵌套JSON数据
http://stackoverflow.com/questions/14139437/java-type-generic-as-argument-for-gson
CCCallFunc, CCCallFuncN, CCCallFuncND 三者的区别
今天学习过程中,自己敲了一个例子,结果在执行Action的时候出现了错误.经排查发现是CCCallFunc使用的问题,应该使用CCCallFuncN,然后搜了下他们的区别,才知道,是因为有一个参数的问 ...

dataframe 列名重新排序

dataframe 列名重新排序的更多相关文章

随机推荐

热门专题