python（re 模块）

1.re.match()

尝试从字符串的起始位置匹配一个模式，如果不是起始位置匹配成功的话，match()就返回none。
- group()　　以str形式返回对象中match的元素
- start()　　返回开始位置
- end()　　返回结束位置
- span()　　以tuple形式返回范围

import re
print(re.match('www', 'www.duoceshi.com').span())  # 在起始位置匹配
print(re.match('www', 'www.duoceshi.com').start())  # 在起始位置匹配
print(re.match('www', 'www.duoceshi.com').end())  # 在起始位置匹配
print(re.match('www', 'www.duoceshi.com').group())  # 在起始位置匹配
print(re.match('duo', 'www.duoceshi.com'))  # 不在在起始位置匹配
print(re.match('com', 'www.duoceshi.com'))  # 不在在起始位置匹配
 
#结果如下
(0, 3)
0
3
www
None
None

2.re.search()

扫描整个字符串并返回第一个成功的匹配

import re
 
print(re.search('www', 'www.duoceshi.com').span())  # 在起始位置匹配
print(re.search('com', 'www.duoceshi.com').span())  # 不在起始位置匹配
 
#结果如下
(0, 3)
(13, 16)

3.re.findall()

在字符串中找到正则表达式所匹配的所有子串，并返回一个列表，如果没有找到匹配的，则返回空列表。

import re
 
print(re.findall("\d","asd123adasd"))   #查找匹配的数字
 
#结果如下
['', '', '']

4.re.finditer()

和 findall 类似，在字符串中找到正则表达式所匹配的所有子串，并把它们作为一个迭代器返回。

import re
 
for i in re.finditer("\d","asd123adasd"):   #查找匹配的数字
    print(i.group())
 
#结果如下
1
2
3

5.re.split()

split 方法按照能够匹配的子串将字符串分割后返回列表

import re
 
print(re.split("a","asd123adasd")) 
 
#结果如下
['', 'sd123', 'd', 'sd']

模式	描述
^	匹配字符串的开头
	import re print(re.findall("^t","python")) print(re.findall("^p","python")) #结果如下 [] ['p']
$	匹配字符串的末尾。
	import re print(re.findall("t$","python")) print(re.findall(".n$","python")) #结果如下 [] ['on']
.	匹配任意字符，除了换行符，当re.DOTALL标记被指定时，则可以匹配包括换行符的任意字符。
	import re print(re.findall(".","python")) print(re.findall("t.","python")) #匹配t + 后面的任意字符 #结果如下 ['p', 'y', 't', 'h', 'o', 'n'] ['th']
[...]	用来表示一组字符,单独列出：[amk] 匹配 'a'，'m'或'k'
	import re print(re.findall("a.","asd123adasd")) print(re.findall("a..","asd123adasd")) print(re.findall("a...","asd123adasd")) print(re.findall("[^a]","asd123adasd")) #结果如下 ['as', 'ad', 'as'] ['asd', 'ada'] ['asd1', 'adas'] ['s', 'd', '', '', '', 'd', 's', 'd']
[^...]	不在[]中的字符：[^abc] 匹配除了a,b,c之外的字符。
	import re print(re.findall("[^th]","python")) #匹配除 th 以外的所有字符 #结果如下 ['p', 'y', 'o', 'n']
re*	匹配0个或多个的表达式。
re+	匹配1个或多个的表达式。
re?	匹配0个或1个由前面的正则表达式定义的片段，非贪婪方式
re{ n}	精确匹配 n 个前面表达式。例如， o{2} 不能匹配 "Bob" 中的 "o"，但是能匹配 "food" 中的两个 o。
re{ n,}	匹配 n 个前面表达式。例如， o{2,} 不能匹配"Bob"中的"o"，但能匹配 "foooood"中的所有 o。"o{1,}" 等价于 "o+"。"o{0,}" 则等价于 "o*"。
re{ n, m}	匹配 n 到 m 次由前面的正则表达式定义的片段，贪婪方式
a\| b	匹配a或b
	import re print(re.findall("y\|a","python")) #匹配 y 或 a #结果如下 ['y']
(re)	对正则表达式分组并记住匹配的文本
(?imx)	正则表达式包含三种可选标志：i, m, 或 x 。只影响括号中的区域。
(?-imx)	正则表达式关闭 i, m, 或 x 可选标志。只影响括号中的区域。
(?: re)	类似 (...), 但是不表示一个组
(?imx: re)	在括号中使用i, m, 或 x 可选标志
(?-imx: re)	在括号中不使用i, m, 或 x 可选标志
(?#...)	注释.
(?= re)	前向肯定界定符。如果所含正则表达式，以 ... 表示，在当前位置成功匹配时成功，否则失败。但一旦所含表达式已经尝试，匹配引擎根本没有提高；模式的剩余部分还要尝试界定符的右边。
(?! re)	前向否定界定符。与肯定界定符相反；当所含表达式不能在字符串当前位置匹配时成功
(?> re)	匹配的独立模式，省去回溯。
\w	匹配字母数字及下划线
\W	匹配非字母数字及下划线
\s	匹配任意空白字符，等价于 [\t\n\r\f].
\S	匹配任意非空字符
\d	匹配任意数字，等价于 [0-9].
\D	匹配任意非数字
\A	匹配字符串开始
\Z	匹配字符串结束，如果是存在换行，只匹配到换行前的结束字符串。
\z	匹配字符串结束
\G	匹配最后匹配完成的位置。
\b	匹配一个单词边界，也就是指单词和空格间的位置。例如， 'er\b' 可以匹配"never" 中的 'er'，但不能匹配 "verb" 中的 'er'。
\B	匹配非单词边界。'er\B' 能匹配 "verb" 中的 'er'，但不能匹配 "never" 中的 'er'。
\n, \t, 等.	匹配一个换行符。匹配一个制表符。等
\1...\9	匹配第n个分组的内容。
\10	匹配第n个分组的内容，如果它经匹配。否则指的是八进制字符码的表达式。

参考：https://www.cnblogs.com/shenjianping/p/11647473.html

python（re 模块）的更多相关文章

Python标准模块--threading
1 模块简介 threading模块在Python1.5.2中首次引入,是低级thread模块的一个增强版.threading模块让线程使用起来更加容易,允许程序同一时间运行多个操作. 不过请注意,P ...
Python的模块引用和查找路径
模块间相互独立相互引用是任何一种编程语言的基础能力.对于“模块”这个词在各种编程语言中或许是不同的,但我们可以简单认为一个程序文件是一个模块,文件里包含了类或者方法的定义.对于编译型的语言,比如C#中 ...
Python Logging模块的简单使用
前言日志是非常重要的,最近有接触到这个,所以系统的看一下Python这个模块的用法.本文即为Logging模块的用法简介,主要参考文章为Python官方文档,链接见参考列表. 另外,Python的H ...
Python标准模块--logging
1 logging模块简介 logging模块是Python内置的标准模块,主要用于输出运行日志,可以设置输出日志的等级.日志保存路径.日志文件回滚等:相比print,具备如下优点: 可以通过设置不同 ...
python基础-模块
一.模块介绍 ...
python 安装模块
python安装模块的方法很多,在此仅介绍一种,不需要安装其他附带的pip等,python安装完之后,配置环境变量,我由于中英文分号原因,环境变量始终没能配置成功汗. 1:下载模块的压缩文件解压到任意 ...
python Queue模块
先看一个很简单的例子 #coding:utf8 import Queue #queue是队列的意思 q=Queue.Queue(maxsize=10) #创建一个queue对象 for i in ra ...
python logging模块可能会令人困惑的地方
python logging模块主要是python提供的通用日志系统,使用的方法其实挺简单的,这块就不多介绍.下面主要会讲到在使用python logging模块的时候,涉及到多个python文件的调 ...
Python引用模块和查找模块路径
模块间相互独立相互引用是任何一种编程语言的基础能力.对于"模块"这个词在各种编程语言中或许是不同的,但我们可以简单认为一个程序文件是一个模块,文件里包含了类或者方法的定义.对于编译 ...
Python Paramiko模块与MySQL数据库操作
Paramiko模块批量管理:通过调用ssh协议进行远程机器的批量命令执行. 要使用paramiko模块那就必须先安装这个第三方模块,仅需要在本地上安装相应的软件(python以及PyCrypto), ...

随机推荐

Pytest系列（14）- 配置文件pytest.ini的详细使用
如果你还想从头学起Pytest,可以看看这个系列的文章哦! https://www.cnblogs.com/poloyy/category/1690628.html 前言 pytest配置文件可以改变 ...
String 对象-->fromCharCode() 方法
1.定义和用法将ASCII码转换成对应的字符语法: String.fromCharCode(n1, n2, ..., nX) 参数: n1, n2, ..., nX:一个或多个 Unicode 值 ...
关于SQLAlchemy ORM框架
SQLAlchemy 1.介绍 SQLAlchemy是一个基于Python实现的ORM框架.该框架建立在 DB API之上,使用关系对象映射进行数据库操作,简言之便是:将类和对象转换成SQL,然后使用 ...
Vm安装虚拟机并使用net模式连接外网
Vm安装虚拟机并使用net模式连接外网最近想搭建一个maven私服和阿波罗配置中心一切准备就绪时发现本地vm虚拟机无法连接外网,嗯 ~ ~ ,一句cnm不由从嘴里崩了出来.没办法,只能配置一下了接 ...
Git敏捷开发--常用别名
前言在Unix下终端开发时,经常会搭配 oh-my-zsh 来使用. oh-my-zsh 中默认内置 git 插件,且支持许多 git alias 的命令,这里对常见的命令进行总结,以供查阅. 常用 ...
[YII2] 增删改查2
一.新增使用model::save()操作进行新增数据 $user= new User; $user->username =$username; $user->password =$pa ...
linux--配置开发环境 --Nginx篇
安装: 安装好了话,我们的nginx的目录在: /etc/nginx 启动: sudo service nginx start 然后访问我们的页面就可以看到了我们的界面然后我们配置我们的域名: 我 ...
python学习18类4之静态类
'''''''''类的静态方法.普通方法.类方法静态方法: 用 @staticmethod 装饰的不带 self 参数的方法叫做静态方法,类的静态方法可以没有参数,可以直接使用类名调用. 普通方法: ...
[Batch脚本] if else 的格式
必须写成一行 ) else (,否则报错. if %abc%=="yes" ( ... ) else ( ... )
JDK 15 JAVA 15的新特性展望
目录 JEP 371: Hidden Classes JEP 372: 删除 Nashorn JavaScript Engine JEP 377: 新的垃圾回收器ZGC正式上线了 JEP 378: T ...

python（re 模块）

python（re 模块）的更多相关文章

随机推荐

热门专题