`

正则表达式

阅读更多
正则表达式的一般格式:/正则表达式/ 
注:其中位于“/”定界符之间的部分就是将要在目标对象中进行匹配的模式 
规则: 
①较为常用的元字符包括: “+”, “*”,以及 “?”。 
“+”元字符规定其前导字符必须在目标对象中连续出现一次或多次。 
“*”元字符规定其前导字符必须在目标对象中出现零次或连续多次。 
“?”元字符规定其前导对象必须在目标对象中连续出现零次或一次。 
. :用于匹配除换行符之外的所有字符。 


\b 匹配一个单词边界,也就是指单词和空格间的位置。例如, 'er\b' 可以匹配"never" 中的 'er',但不能匹配 "verb" 中的 'er'。 
\B 匹配非单词边界。'er\B' 能匹配 "verb" 中的 'er',但不能匹配 "never" 中的 'er'。 
\cx 匹配由x指明的控制字符。例如, \cM 匹配一个 Control-M 或回车符。 x 的值必须为 A-Z 或 a-z 之一。否则,将 c 视为一个原义的 'c' 字符。 
\d 匹配一个数字字符。等价于 [0-9]。 
\D 匹配一个非数字字符。等价于 [^0-9]。 
\f 匹配一个换页符。等价于 \x0c 和 \cL。 
\n 匹配一个换行符。等价于 \x0a 和 \cJ。 
\r 匹配一个回车符。等价于 \x0d 和 \cM。 
\s 匹配任何空白字符,包括空格、制表符、换页符等等。等价于 [ \f\n\r\t\v]。 
\S 匹配任何非空白字符,除单个空格符之外的所有字符。等价于 [^ \f\n\r\t\v]。 
\t 匹配一个制表符。等价于 \x09 和 \cI。 
\v 匹配一个垂直制表符。等价于 \x0b 和 \cK。 
\w 匹配匹配字母,数字或下划线字符。等价于'[A-Za-z0-9_]'。 
\W 匹配所有与\w不匹配的字符。等价于 '[^A-Za-z0-9_]'。 
\xn 匹配 n,其中 n 为十六进制转义值。十六进制转义值必须为确定的两个数字长。例如, '\x41' 匹配 "A"。'\x041' 则等价于 '\x04' & "1"。正则表达式中可以使用 ASCII 编码。. 
\num 匹配 num,其中 num 是一个正整数。对所获取的匹配的引用。例如,'(.)\1' 匹配两个连续的相同字符。 
\n 标识一个八进制转义值或一个后向引用。如果 \n 之前至少 n 个获取的子表达式,则 n 为后向引用。否则,如果 n 为八进制数字 (0-7),则 n 为一个八进制转义值。 
\nm 标识一个八进制转义值或一个后向引用。如果 \nm 之前至少有is preceded by at least nm 个获取得子表达式,则 nm 为后向引用。如果 \nm 之前至少有 n 个获取,则 n 为一个后跟文字 m 的后向引用。如果前面的条件都不满足,若 n 和 m 均为八进制数字 (0-7),则 \nm 将匹配八进制转义值 nm。 
\nml 如果 n 为八进制数字 (0-3),且 m 和 l 均为八进制数字 (0-7),则匹配八进制转义值 nml。 
\un 匹配 n,其中 n 是一个用四个十六进制数字表示的 Unicode 字符。例如, \u00A9 匹配版权符号 (?)。 

/\s+/ 上述正则表达式可以用于匹配目标对象中的一个或多个空格字符。 
/\d000/ 多用于财务。 
\cx 匹配由x指明的控制字符。例如, \cM 匹配一个 Control-M 或回车符。 x 的值必须为 A-Z 或 a-z 之一。否则,将 c 视为一个原义的 'c' 字符。 

②重复次数X{N}:X重复N次数 
x{n} n 是一个非负整数。匹配确定的 n 次。 
x{n,} n 是一个非负整数。至少匹配 n 次。 'o{1,}' 等价于 'o+'。'o{0,}' 则等价于 'o*' 
x{n,m} m 和 n 均为非负整数,其中n <= m。最少匹配 n 次且最多匹配 m 次。 'o{0,1}' 等价于 'o?' 
③范围选择[]: 
指定某一个范围而不局限于具体的字符。例如: 
/[A-Z]/  上述正则表达式将会与从A到Z范围内任何一个大写字母相匹配。 
/[a-z]/  上述正则表达式将会与从a到z范围内任何一个小写字母相匹配。 
/[0-9]/  上述正则表达式将会与从0到9范围内任何一个数字相匹配。 
/([a-z][A-Z][0-9])+/  上述正则表达式将会与任何由字母和数字组成的字符串, 
/[^A-C]/ 上述字符串将会与目标对象中除A,B,和C之外的任何字符相匹配 
④ 较为常用的定位符包括: “^”, “$”, “\b” 以及 “\B”。 
“^”定位符规定匹配模式必须出现在目标字符串的开头 
“$”定位符规定匹配模式必须出现在目标对象的结尾 
“\b”定位符规定匹配模式必须出现在目标字符串的开头或结尾的两个边界之一 
“\B”定位符则规定匹配对象必须位于目标字符串的开头和结尾两个边界之内,即匹配对象既不能作为目标字符串的开头,也不能作为目标字符串的结尾。 
⑤全部和其一 
全部:/([a-z][A-Z][0-9])+/  上述正则表达式将会与任何由字母和数字组成的字符串 
其一:xx/(ab|cd)/ 只能选择ab或者cd 


正则表达式的优先级: 
可以从左至右并按照一个优先级顺序来求值。优先级如下: 
1.\ 转义符 
2.(), (?:), (?=), [] 圆括号和方括号 
3.*, +, ?, {n}, {n,}, {n,m} 限定符 
4.^, $, \anymetacharacter 位置和顺序 
5.|“或”操作 &&并且 

 

分享到:
评论

相关推荐

    qt使用正则表达式限制lineEdit的输入,对正则表达式进行了封装,可以直接引入,工程编译正常

    在Qt框架中,正则表达式(Regular Expression)是一种强大的文本处理工具,它允许程序员以结构化的方式匹配、查找、替换或验证字符串。本项目针对Qt的lineEdit组件,通过正则表达式实现了输入限制功能,使得lineEdit...

    正则表达式转换工具

    正则表达式(Regular Expression,简称regex)是一种强大的文本处理工具,它用于匹配、查找、替换等操作,涉及字符串处理的各个领域。正则表达式转换工具是专门针对这一需求而设计的,它能帮助用户将输入的内容转换...

    PB实现的正则表达式

    在IT领域,正则表达式(Regular Expression,简称regex)是一种强大的文本处理工具,它能够进行复杂的模式匹配、查找、替换等操作。在本话题中,我们将探讨如何使用PowerBuilder 11.5这一经典的开发环境来实现正则...

    易语言正则表达式文本替换

    例如,"子程序_正则文本替换"可能就是一个易语言中用于执行正则表达式替换的子程序,它接收输入的文本、正则表达式模式和替换字符串,然后返回经过替换操作的新文本。 1. **正则表达式基础** - **元字符**:如`.`...

    pb 使用正则表达式源码pbregexp

    标题中的“pb 使用正则表达式源码pbregexp”指的是在PowerBuilder(简称pb)环境中,利用名为“pbregexp”的正则表达式组件来实现源代码级别的正则表达式操作。PowerBuilder是一款流行的可视化的、面向对象的软件...

    易语言正则表达式匹配中文

    在易语言中,正则表达式是进行文本处理、数据提取和搜索的关键工具,尤其在处理中文字符时显得尤为重要。本文将深入探讨易语言中的正则表达式匹配中文的原理、方法以及应用。 正则表达式(Regular Expression)是一...

Global site tag (gtag.js) - Google Analytics