python--文件处理1

1. 读取文件

方法： all_the_text = open('thefile.txt').read()

但是为了安全起见还是给打开的文件对象指定一个名字，这样在完成之后可以迅速关掉，防止无用文件对象占用内存；

例子：

file_object = open('thefile.txt',r)

try:

     all_the_text = file_object.read()            #read()将文件中所以字符都读到all_the_text中去变成了一个巨大的字符串，

finally:

     file_object.close()

不一定要加try，finally语句，但是加了更好，可以保证文件对象被关闭即使在读取中发生了严重错误；

如果要读入100个字符也可以直接:

text=file.read(100),

如要一行行处理还可以：

ff = file_object.readlines()

　　#读出来是 list 类型，而且每行末尾都有'\n'符号；既然是一行行的，那么打印也要一行行的显示：

　　for line in ff:

　　print line #此时line类型是string，而ff依然是list类型

　　#这样打印出来不会乱，而如果直接 print ff 则会一次性打印整个ff序列，而汉子在序列里面是ASCII，会导致汉子打印不出来，而且特别乱；所以要一行行的打印’

而最简单方法：

for line in file_object:

     line = line.rstrip('\n')

     print line

此时line是string类型，但每行末尾都有'\n'符号；可以再for主体部分加一句：line = line.rstrip('\n') 在每行末尾去掉'\n'符号，而line.restrip()则默认去掉空白符；

2. 写入文件

最方便的一个方法：

open('thefile.txt','w'）.write(all_the_text)

但是最好还是给文件对象指定一个名字，这样方便关闭文件对象

file_object = open('thefile.txt','w')

file_object.write(all_the_text)

file_object.close()

实际上用‘w’或者'wb'打开的文件，都是空文件；哪怕是这个文件不是空文件，用这两种方式打开后，也会被清空；这种情况，就要用到‘a’或者‘ab’来打开则不会清空；

如果用'a+'这种方式来打开的话不能写的时候文件不会被清空，而且还可以读取文件呢；

注意：无论读还是写，文件打开之后游标会一直往后走，直到关闭；当然也可以使用seek()函数来控制游标

3. 搜索和替换文件中的文本

replace(search_text,replace_text),用于字符串的替换；

4. 从文件中读取指定的行

enumerate():遍历序列中的元素以及下标

>>> for i,j in enumerate(['a','b','c']):

...     print i,j

...

0 a

1 b

2 c

函数模块：

def getline(thefilepath,desired_line_number):

     if desired_line_number < 1:

          return ' '

     for current_line_number,line in enumerate(open(thefilepath,'ru')):

          if current_line_number == desired_line_number-1:

                    return line

     return ''

库文件 linecache

当对文件进行多次读取时，linecache,特别有用，它读取并缓存指定文件里的所有文本；用clearcache()来释放被用作缓存的内存，checkcache()来确保缓存中的存储是最新的；

import linecache

theline = linecache.getline(thefilepath,desired_line_number)

#简单一句就可以得到文件指定行的文本了，方便吧；

5. 处理文件中的每一个单词

首先看一个函数split（）

Python split()通过指定分隔符对字符串进行切片，如果参数num 有指定值，则仅分隔 num 个子字符串

实例：

#!/usr/bin/python

str = "Line1-abcdef \nLine2-abc \nLine4-abcd";print str.split( );print str.split(' ', 1 );

以上实例输出结果如下：

['Line1-abcdef', 'Line2-abc', 'Line4-abcd']['Line1-abcdef', '\nLine2-abc \nLine4-abcd']

对每一个词做一些处理，最好的就是两重循环，一个用于处理行，一个用于处理单词

for line in open(thefilepath):

     for word in line.split():

          dosometingwith(word)

6. 处理zip数据

6.1 从zip文件中读取数据

任务检查一个zip文档中所有子项，并打印子项名称，以及大小；

#!/usr/bin/env python

#encoding:utf-8

import zipfile

#以’r‘打开zip文件，

z = zipfile.ZipFile("text.txt.zip","r")

#从zip文件列表中读取子项名并读取出来计算其字节数

for filename in z.namelist():

        print 'File:',filename

        byte = z.read(filename)

        print 'has',len(byte),'byte'

python--文件处理1的更多相关文章

Linux下Python 文件内容替换脚本
Linux下Python 文件替换脚本 import sys,os if len(sys.argv)<=4: old_text,new_text = sys.argv[1],sys.argv[2 ...
【Python文件处理】递归批处理文件夹子目录内所有txt数据
因为有个需求,需要处理文件夹内所有txt文件,将txt里面的数据筛选,重新存储. 虽然手工可以做,但想到了python一直主张的是自动化测试,就想试着写一个自动化处理数据的程序. 一.分析数据格式需 ...
Python文件使用“wb”方式打开，写入内容
Python文件使用"wb"方式打开,写入字符串会报错,因为这种打开方式为:以二进制格式打开一个文件只用于写入.如果该文件已存在则将其覆盖.如果该文件不存在,创建新文件. 所以写入 ...
Python 文件操作函数
这个博客是 Building powerful image classification models using very little data 的前期准备,用于把图片数据按照教程指示放到规定的文 ...
python文件I/O（转）
Python 文件I/O 本章只讲述所有基本的的I/O函数,更多函数请参考Python标准文档. 打印到屏幕最简单的输出方法是用print语句,你可以给它传递零个或多个用逗号隔开的表达式.此函数把你 ...
python 文件操作总结
Python 文件I/O 本章只讲述所有基本的的I/O函数,更多函数请参考Python标准文档. 打印到屏幕最简单的输出方法是用print语句,你可以给它传递零个或多个用逗号隔开的表达式.此函数把你 ...
Python基础篇【第2篇】: Python文件操作
Python文件操作在Python中一个文件,就是一个操作对象,通过不同属性即可对文件进行各种操作.Python中提供了许多的内置函数和方法能够对文件进行基本操作. Python对文件的操作概括来说 ...
python文件和元组
python文件操作相较于java,Python里的文件操作简单了很多 python 获取当前文件所在的文件夹: os.path.dirname(__file__) 写了一个工具类,用来在当前文件夹 ...
Python文件基础
===========Python文件基础========= 写,先写在了IO buffer了,所以要及时保存关闭.关闭会自动保存. file.close() 读取全部文件内容用read,读取一行用 ...
python文件打包格式，pip包管理
1..whl是python文件的一种打包格式, 在有些情况下,可以将文件的后缀名改为.zip并解压 2.cmd中,提示pip版本太低,先升级pip pip install --upgrade pi ...

随机推荐

loadView、viewDidLoad及viewDidUnload的关系(转)
本文目录一.loadView 二.viewDidLoad 三.viewDidUnload 四.三个方法的关系标题中所说的3个方法,都是UIViewController的方法,跟UIViewCont ...
ACM-ICPC 2018 沈阳赛区网络预赛 F. Fantastic Graph(有源上下界最大流模板)
关于有源上下界最大流: https://blog.csdn.net/regina8023/article/details/45815023 #include<cstdio> #includ ...
水题：51Nod1432-独木舟
1432 独木舟基准时间限制:1 秒空间限制:131072 KB 分值: 10 难度:2级算法题 Problem Description n个人,已知每个人体重.独木舟承重固定,每只独木舟最多坐两 ...
ubuntu12.04ppa安装emacs24
ppa地址:https://launchpad.net/~cassou/+archive/emacs 因为debian版本的emacs-snapshot维护者停止更新,所有ubuntu上的也停止了. ...
Linux学习-什么是登录档
CentOS 7 登录档简易说明登录档的重要性为什么说登录文件很重要, 解决系统方面的错误: 用 Linux 这么久了,你应该偶而会发现系统可能会出现一些错误,包括硬件捉不到或者是某些系统服务无 ...
强大的with语句
上下文管理器对象存在的目的是管理 with 语句,就像迭代器的存在是为了管理 for 语句一样. with 语句的目的是简化 try/finally 模式.这种模式用于保证一段代码运行完毕后执行某项操 ...
python基础学习笔记——类空间问题以及类之间的关系
一. 类的空间问题 1.1 何处可以添加对象属性 class A: def __init__(self,name): self.name = name def func(self,sex): self ...
关于dispatch_sync死锁问题
首先,我们来看下下面一个例子: 代码:(串行队列里同步线程嵌套) NSLog(@"haha"); dispatch_queue_t queue = dispatch ...
Ubuntu搭建Http服务器用于下载Ubuntu文件
首先安装Apache $ sudo apt-get install apache2 Apache2的默认访问端口为80,当端口被占用时需要更改其访问端口进入apache2的安装目录 /etc/ap ...
实现chrome多用户独立cookie
2018-02-08 10:58:57 在浏览器设置中添加一个用户并创建桌面快捷方式,属性中我们可以发现 "C:\Program Files (x86)\Google\Chrome\Appl ...

python--文件处理1

python--文件处理1的更多相关文章

随机推荐

热门专题