笔记-python-lib-re

1.      re模块简介

re模块提供了与perl类似的正则匹配功能。

要搜索的模式和字符串都可以是Unicode字符串(str)以及8位字符串(bytes)。但是,不能混合Unicode字符串和8位字符串:也就是说,不能将Unicode字符串与字节模式匹配,反之亦然。

反斜杠:正则表达式使用了\表示转义,如果要匹配一个反斜杠,需要写成\\\\作为模式字符串。

另一种办法是声明字符串中的\不会以特殊方式处理,在字符串前加r,r’\n’是两个字符,而不是换行;

2.      模块内容

2.1.    compile

re.compile(pattern, flags=0)

compile 函数用于编译正则表达式,生成一个正则表达式( Pattern )对象,供 match() 和 search() 这两个函数使用。

参数:

pattern:一个字符串形式的正则表达式

flags:可选,表示匹配模式,比如忽略大小写,多行模式等,具体参数为:

re.I 忽略大小写

re.L 表示特殊字符集 \w, \W, \b, \B, \s, \S 依赖于当前环境

re.M 多行模式,影响^和$

re.S 意为' . '包括换行符在内的任意字符(一般' . '不包括换行符)

re.U 表示特殊字符集 \w, \W, \b, \B, \d, \D, \s, \S 依赖于 Unicode 字符属性数据库

re.X 为了增加可读性,忽略空格和' # '后面的注释

example:

pattern = re.compile(r’\d+?’)

2.2.  match

re.match(pattern, string, flags=0)

判断RE是否在字符串刚开始的位置匹配,返回match object。

注意:只要字符串开始部分满足匹配即成功,如果想要整串匹配可加$符。

example:

s = re.match('[a-z]+', str1)

2.3.    search

re.search(pattern, string, flags=0)

在字符串内查找模式匹配,只要找到第一个匹配然后返回一个match object对象,如果没有则返回None。

<_sre.SRE_Match object; span=(0, 5), match='eoorg'>

2.4.    split

split(pattern, string, maxsplit=0, flags=0)

以模式匹配的字符串的为界拆分字符串;

如果使用(),则模式组也包含在结果中;

str1 = 'eoorg943443g382\jgdo 349po\oer g34 345364 sfwe fwegre ewfwe fwef'

s = re.split(r'\d+', str1, 4)

['eoorg', 'g', '\\jgdo ', 'po\\oer g', ' 345364 sfwe fwegre ewfwe fwef']

s = re.split(r'(\d+)', str1, 4)

['eoorg', '943443', 'g', '382', '\\jgdo ', '349', 'po\\oer g', '34', ' 345364 sfwe fwegre ewfwe fwef']

maxsplit指定最大拆分次数,达到次数后,剩余字符串作为列表元素添加到列表尾部。

2.5.    findall

findall(pattern, string, flags=0)

遍历匹配,获取字符串中所有匹配的字符串,返回一个列表;如果模式有多个组,返回元组列表。

2.6.    sub

sub(pattern, repl, string, count=0, flags=0)

替换匹配的子串,返回替换后的字符串。

str1 = 'JGOOD is a handome boy, he is cool, clever, and so on...'

s = re.sub('\s+', '-', str1)

print(s)

参数count指替换个数,默认为0,表示每个匹配项都替换。

2.7.    subn

subn(pattern, repl, string, count=0, flags=0)

与sub所做操作一样,但返回一个元组,(new_string, number_of_sub_made)。

2.8.    match objects

上面讲过search,match会返回一个match object

str1 = 'JGOOD is a handome boy, he is cool, clever, and so on...'

s = re.search('[a-z]+', str1)

print(s)

<_sre.SRE_Match object; span=(6, 8), match='is'>

match objects支持以下方法和属性:

match.group([group1]) 可以不带参数,表示所有匹配项;带参数则表示参数所对应的项;

str1 = 'JGOOD is a handome boy, he is cool, clever, and so on...'

pattern = re.compile(r'\s+')

s = re.match('(\w+)\s(\w+)', str1)

print(s)

<_sre.SRE_Match object; span=(0, 8), match='JGOOD is'>

>>> s.group()

'JGOOD is'

>>> s.group(1)

'JGOOD'

>>> s.group(2)

'is'

>>>

match.groups() 返回一个tuple,包含所有子组

match.start()

match.end() 返回匹配结果开始结束字符的下标

match.span() 与上文同义,返回匹配结果开始结束下标,格式是元组;

match.re      以re.compile('(\\w+)\\s(\\w+)')格式返回该对象使用的正则表达式

笔记-python-lib-re的更多相关文章

  1. 笔记-python -asynio

    笔记-python -asynio 1.      简介 asyncio是做什么的? asyncio is a library to write concurrent code using the a ...

  2. 笔记-python操作mysql

    笔记-python操作mysql 1.      开始 1.1.    环境准备-mysql create database db_python; use db_python; create tabl ...

  3. 笔记-python异常信息输出

    笔记-python异常信息输出 1.      异常信息输出 python异常捕获使用try-except-else-finally语句: 在except 语句中可以使用except as e,然后通 ...

  4. 笔记-python lib-pymongo

    笔记-python lib-pymongo 1.      开始 pymongo是python版的连接库,最新版为3.7.2. 文档地址:https://pypi.org/project/pymong ...

  5. 笔记-python tutorial-9.classes

    笔记-python tutorial-9.classes 1.      Classes 1.1.    scopes and namespaces namespace: A namespace is ...

  6. MongoDB学习笔记:Python 操作MongoDB

    MongoDB学习笔记:Python 操作MongoDB   Pymongo 安装 安装pymongopip install pymongoPyMongo是驱动程序,使python程序能够使用Mong ...

  7. 机器学习实战笔记(Python实现)-08-线性回归

    --------------------------------------------------------------------------------------- 本系列文章为<机器 ...

  8. 机器学习实战笔记(Python实现)-05-支持向量机(SVM)

    --------------------------------------------------------------------------------------- 本系列文章为<机器 ...

  9. 机器学习实战笔记(Python实现)-04-Logistic回归

    --------------------------------------------------------------------------------------- 本系列文章为<机器 ...

  10. 机器学习实战笔记(Python实现)-03-朴素贝叶斯

    --------------------------------------------------------------------------------------- 本系列文章为<机器 ...

随机推荐

  1. Unity C# 反射

    什么是反射 在.NET中的反射也可以实现从对象的外部来了解对象(或程序集)内部结构的功能,哪怕你不知道这个对象(或程序集)是个什么东西,另外.NET中的反射还可以运态创建出对象并执行它其中的方法. 反 ...

  2. ajax post方式表单提交的注意事项。

    当我们创建一个异步对象XMLHttpRequest同时post方式向后台传输数据的时候. 我们要设置异步对象的xhr.setRequestHeader成员的值为 XMLHttpRequest.setR ...

  3. 在数据绑定控件(如:Repeater)中使用if判断

    方法: target="<%# DataBinder.Eval(Container.DataItem, "数据库字段").ToString() == "t ...

  4. ConcurrentHashMap源码刨析(基于jdk1.7)

    看源码前我们必须先知道一下ConcurrentHashMap的基本结构.ConcurrentHashMap是采用分段锁来进行并发控制的. 其中有一个内部类为Segment类用来表示锁.而Segment ...

  5. cms-后台eazyui搭建

    1.引入eazyUi需要的js 2.布局:上.下.左.中 <%@ page language="java" contentType="text/html; char ...

  6. 使用CreateProcess函数运行其他程序

    为了便于控制通过脚本运行的程序,可以使用win32process模块中的CreateProcess()函数创建一个运行相应程序的进程.其函数原型如下.CreateProcess(appName, co ...

  7. c++指针二维数组

    ; int** G; //初始化 G = new int*[N]; ; i < N; i++) G[i] = new int[N]: //删除 ; i < N; i++) delete[] ...

  8. linux 命令——35 ln(转)

    ln 是linux中又一个非常重要命令,它的功能是为某一个文件在另外一个位置建立一个同步的链接.当我们需要在不同的目录,用到相同的文件时,我们不需要在每一个需要的目录下都放一个必须相同的文件,我们只要 ...

  9. 小记:iOS 中一般对于 view 不依赖 model 的的两种代码书写形式

    一. 前言 对于在 MVC 的定义中,view 层是不引用 model 层,view 和 model 是不相往来的 一般开发中,我们都写过 在自定义 view 中增加一个 model 的属性,外接直接 ...

  10. 免费的freedns实现动态域名和url转发

    路由器的固件是dd-wrt 到freedns.afraid.org上注册一个动态域名,如果默认的端口无法使用80,需要配置二级域名的url转发功能. 实测2个月很稳定. 另外为了防止主机ip地址更新频 ...