PHP中的正则表达式的使用
PHP中的正则表达式基础知识
1.正则表达式就是描述字符串排列模式的一种自定义语法规则
2.如果可以使用字符串处理函数完成的任务,就不使用正则表达式
3.有一些复杂的操作,只能使用正则表达式完成
4.正则表达式也称为一种模式表达式
5.正则表达式就是通过构建具有特定规则的模式,与输入的字符信息比较,在进行分割、匹配、查找、替换等工作
例:"/\<img\s*src=\".*?\"\/\>/"
a.正则表达式也是一个字符串
b.由具有特殊意义的字符串组成的字符串
c.具有一定编写规则,也是一种模式
d.看作是一种编程语言(是用一些特殊字符,按规则编写出一个字符串,形成一种模式---正则表达式)
注意:如果正则表达式,不和函数一起使用,则它就是一个字符串,只有将正则表达式放到某个函数中使用,才能发挥出正则表达式的作用。
在PHP中给我们提供两套正则表达式函数库
POSIX扩展正则表达式函数库
Perl兼容正则表达式函数库
这两个函数功能一样,找一个处理字符串效率高的
注意:由于功能一样,所以推荐使用Perl兼容正则表达式函数库
正则表达式的模式如何编写
例:"/\<img\s*src=\".*?\"\/\>/iU"
语法:
1.定界符 //
除了字母、数字和正斜线\以外的任一字符都可以是定界符
| |
/ /
{ }
! !
我们一般使用//
2.原子。 img \s .
注意:原子是正则表达式的最基本组成单位,而且必须至少要包含一个原子
只要一个正则表达式可以单独使用的字符,就是原子
1.所有打印(所有可以用键盘在屏幕上输出的字符串)和非打印字符(看不到的)
2.* + ? ( . < 如果所有有意义的字符,想要作为原子使用,统统使用“\”转义字符转义
在无特殊意义的字符前使用转义字符时还是把它看成普通字符来看
转义字符可以将有意义的字符转成没意义的字符,还可以将没意义的字符转成有意义的字符
3.在正则表达式中可以直接使用一些代表范围的原子
\d :表示任意一个十进制的数字 [0-9]
\D :表示任意一个除了数字外的字符 [^0-9]
\s :表示任意一个空白字符。空格、\n\r\t\f [\n\r\t\f ]
\S :表示任意一个非空白字符 [^\n\r\t\f ]
\w :表示任意一个字。a-zA-Z0-9_ [a-zA-Z0-9_]
\W :表示任意一个非字。除了a-zA-z0-9_ [^a-zA-Z0-9_]
4.自己定义一个原子表[],可以匹配方括号中的任何一个原子
例:[0-5p-z]
3.元字符 * ?
元字符是一种特殊的字符,是用来修饰原子用的,不可以单独使用
* :表示其前面原子可以出现的次数 0次、1次、或多次 {0,}
+ :表示其前面的原子出现1次或多次,不能没有至少一次 {1,}
? :表示其前面的原子出现0次或1次,有只能一次,要么没有 {0,1}
{} :用于自己定义前面的原子出现的次数
{m} m表示一个整数, {5}表示前面的原子出现5次
{m,n} m和n表示整数,{2,5}表示前面的原子出现2-5次
{m,} 表示前面的原子至少出现m次
. :默认情况下,表示除换行符外的任意一字符
^ :直接在一个正则表达式的第一个字符出现,则表示字符串必须以这个正则表达式开始
$ :直接在一个正则表达式的最后字符出现,则表示字符串必须以这个正则表达式结尾
| :表示或的关系,它的优先级是最低的,最后考虑它
\b :表示一个边界
\B :表示一个非边界
重点 () :
1.()作用:是作为大原子使用
2.改变优先级
3.作为子模式使用,正则表达式不光对一个字符串匹配一次,全部匹配作为一个大模式,放在数组的第一个元素中,每个()是一个子模式按顺序放到数组的其他元素中去
4.可以取消子模式,就将()作为大原子或改变优先级使用,在大括号中最前面使用?:就可以取消这个()表示的子模式
5.反向引用,可以在模式中直接将子模式取出来,再作为正则表达式模式的一部分,如果是在正则表达式像替换函数preg_replace函数中,可以将子模式取出,在被替换的字符串中使用
\1取第一个子模式 \2取第二个子模式。。。。。
<?php
$pattren="/((?:\d{4})\W\d{2}\W\d{2})\s+((\d{2})\W\d{2}\W\d{2})\s+(am|pm)/";
$string="today is 2016-08-09 15:30:00 pm...";
if(preg_match($pattren,$string,$arr)){
echo "正则表达式<b>{$pattren}<b>和字符串<b>{$string}<b>匹配成功<br>";
echo '<pre>';
print_r($arr);
echo '</pre>';
}else{
echo "<font color='red'>正则表达式{$pattren}和字符串{$string}匹配失败</font>";
}
?>
4.模式修正符号 i u
"//模式修正符号"
1.可以一次使用一个,每一个都具有一定的意义,也可以连续使用多个
2.是对整个正则表达式的调优使用,也可以说是对正则表达式功能的扩展
例;"/abc/" 只能匹配小写字母 abc
"/abc/i" 可以不区分大小写的匹配
i :表示在和模式进行匹配时不区分大小写
m :默认情况下,PCRE 将目标字符串作为单一的一“行”字符所组成的(甚至其中包含有换行符也是如此)。“行起始”元字符(^)仅仅匹配字符串的起始,“行结束”元字符($)仅仅匹配字符串的结束,或者最后一个字符是换行符时其前面(除非设定了 D 修正符)
当设定了此修正符,“行起始”和“行结束”除了匹配整个字符串开头和结束外,还分别匹配其中的换行符的之后和之前。这和 Perl 的 /m 修正符是等效的。如果目标字符串中没有“\n”字符或者模式中没有 ^ 或 $,则设定此修正符没有任何效果
s :如果没有使用这个模式修正符时,元字符中的“.”就不能匹配换行符,使用后就可以了。
x :表示模式中的空白忽略不计
e : 如果设定了此修正符,preg_replace() 在替换字符串中对逆向引用作正常的替换,将其作为 PHP 代码求值,并用其结果来替换所搜索的字符串。
只有 preg_replace() 使用此修正符,其它 PCRE 函数将忽略之。
A :如果设定了此修正符,模式被强制为“anchored”,即强制仅从目标字符串的开头开始匹配。此效果也可以通过适当的模式本身来实现
Z :
U :本修正符反转了匹配数量的值使其不是默认的重复,而变成在后面跟上“?”才变得重复。这和 Perl 不兼容。也可以通过在模式之中设定 (?U) 修正符或者在数量符之后跟一个问号(如 .*?)来启用此选项。
/原子核元字符/模式修正符号 /为定界符
PHP中的正则表达式的使用的更多相关文章
- PHP中有关正则表达式的函数集锦
之前学正则表达式的目的是想从网上抓取点小说啊,文档啊,还有获取相应的视频连接然后批量下载.当时初学PHP根本不知道PHP有专门抓包的工具,就像Simple_html_dom.php(在我的其他博文中有 ...
- JavaScript中的正则表达式(终结篇)
JavaScript中的正则表达式(终结篇) 在之前的几篇文章中,我们了解了正则表达式的基本语法,但那些语法不是针对于某一个特定语言的.这篇博文我们将通过下面几个部分来了解正则表达式在JavaScri ...
- Coursera-Getting and Cleaning Data-week4-R语言中的正则表达式以及文本处理
博客总目录:http://www.cnblogs.com/weibaar/p/4507801.html Thursday, January 29, 2015 补上第四周笔记,以及本次课程总结. 第四周 ...
- 9.JAVA中的正则表达式
一.JAVA中的正则表达式 1.概念:以某种特定的方式描述字符串 1.Java中正则表达式的规则 ? #{0,1}-?有一个-或者没有 \\ #表示一个" ...
- Python::re 模块 -- 在Python中使用正则表达式
前言 这篇文章,并不是对正则表达式的介绍,而是对Python中如何结合re模块使用正则表达式的介绍.文章的侧重点是如何使用re模块在Python语言中使用正则表达式,对于Python表达式的语法和详细 ...
- 工作随笔——UIButton的EdgeInsets + Swift中的正则表达式;
1.UIButton的EdgeInsets UIButton的EdgeInsets方法,是用来设置title和image对于上左下右四个方向的偏移,但是很奇怪的是,刚开始只有Image,titile也 ...
- Javascript中的正则表达式
Javascript中的正则表达式 刚开始接触正则表达式的时候,觉得这是个很死板的东西(没办法,计算机不能像人眼一样能很快的辨认出我们需要的结果,它需要一定的规则来对它进行限制),了解的越多,发现这个 ...
- 在Visual Studio中使用正则表达式匹配换行和批量替换
系统环境:Windows 8.1 Enterprise Update 2 x64 开发环境:Mircosoft Visual Studio Ultimate 2013 Update 2 RC 问题:如 ...
- 浅谈JavaScript中的正则表达式
引言 对于正则表达式我想作为程序员肯定使用过它,那天书般的表达方式,我用一次就记住它了.这篇博客先介绍一些正则表达式的内容,然后介绍JavaScript中对正则表达式特有的改进.下面开始介绍正则表达式 ...
- 任督二脉之Shell中的正则表达式
VBird说学习Linux,掌握了Shell和正则就相当于打通了任督二脉,此后能力的成长才会突飞猛进. Shell的基础学习之前已经总结了一篇博客:http://www.cnblogs.com/jyz ...
随机推荐
- hdu 4081 Qin Shi Huang's National Road System (次小生成树)
Qin Shi Huang's National Road System Time Limit: 2000/1000 MS (Java/Others) Memory Limit: 32768/3 ...
- 循环语句while与for的穷举迭代
循环语句while while当...的时候 int n=1; while(n<6)//在括号内直接限制逻辑关系 {//需要在大括号内给出改变方式,否则将进入死循环 console.WriteL ...
- backbonejs mvc框架的增删查改实例
一:开发环境 coffeescript和nodejs需要先安装,没装网上自己查安装步骤. 代码编写环境及esp框架下载: esp框架下载地址:https://github.com/nonocast/e ...
- long型转日期型
//时分秒格式//不知为何,出来的时间有点差别 public class Test { public static void main(String[] args) throws Exception ...
- 西天取经第一步——制作自己的HTML5游戏
废话不说,直入主题:这是一个休闲益智类游戏,与愤怒的小鸟类似采用Box2dWeb引擎.再开发游戏之前,首先我要把Box2dWeb给总结一下方便以后调用 大家可以在http://code.google. ...
- hdu 4612 Warm up
http://acm.hdu.edu.cn/showproblem.php?pid=4612 将原图进行缩点 变成一个树 树上每条边都是一个桥 然后加一条边要加在树的直径两端才最优 代码: #incl ...
- C++定义构造函数必须使用初始化列表的场合
明其理,而知其然也. 先给理论.1. 初始化 != 赋值. a.初始化代表为变量分配内存. 变量在其定义处被编译器初始化(编译时). 在函数中, 函数参数初始化发生在函数调用时(运行时). b.赋值代 ...
- 常州培训 day5 解题报告
第一题:(贪心) 题目大意:给出N*M的矩形,要用正方形将它铺满(正方形之间不能重叠),相邻的正方形颜色不能相同,颜色用ABCD表示.要求从上到下从左到右字典序最小. N,M<=100 解题过程 ...
- 神奇的Noip模拟试题 T3 科技节 位运算
3 科技节 (scifest.pas/.c/.cpp) [问题描述] 一年一度的科技节即将到来.同学们报名各项活动的名单交到了方克顺校长那,结果校长一看皱了眉头:这帮学生热情竟然如此高涨,每个人都报那 ...
- C#操作Access数据库(创建&修改结构)
本文转自:http://www.cnblogs.com/liyugang/archive/2012/11/17/2775393.html 想要在程序中控制Access,不是数据,而是Access数据库 ...