`

RegExp

阅读更多

14.2.2 正则表达式的两个构成部分
简写模式:
var 正则对象:RegExp = /匹配模式/标志位
构造函数模式:
var 正则对象:RegExp = new RegExp(匹配模式,标志位)
匹配模式就是正则表达式,标志位包括五个字母 gimsx
14.3 正则表达式语法
14.3.1 正则表达式中的文字符号
普通文字和符号:A-Z a-z 0-9 以及不是元字符的其它符号
输入Unicode字符时,同String一样,使用\uXXXX
元字符:三三二三个一(记忆口诀)
三个括号: {[(
三个匹配次数: *+? 星加问
两个断言: ^$ 定头定尾
三个一: | 选择符 . 模糊匹配 \ 转义
三个括号:
{定义匹配次数
[字符集
(子模式
三个匹配次数:
* 匹配出现0次或多次
+ 匹配出现至少1次或多次
? 匹配出现0次最多1次
两个断言:
^ 在/后出现时为左端断言, /^
$ 在/前出现时为右端断言, $/
三个独立元字符:
| 选择符,匹配时兼容匹配选择符两边的字符
. 模糊匹配,可以代替
不可见字符:比较一些转义的控制字符
14.3.2 正则表达式中的字符集
1.字符集的概念和最简单的字符集形式
[字符集]
字符集用中括号括起来
Unicode字符请使用\uXXXX 四位十六进制Unicode代码输入
如:/g[eo]t,分别匹配get和got,但不会匹配geot,因为字符集只能匹配一个字符
2.连字符在字符集中的运用
[字符-字符]
如:[a-z][A-Z],就是匹配英文字母字符集了
3.取反符号在字符集中的运用
[^字符集]
添加取反符号后,匹配时将忽略字符集中的所有元素
4.字符集中需要转义的特殊字符
\转义符号
常见要转义的字符有三类:
1.字符串: 双引号” 单引号 ‘ 反斜杠 \
2.正则表达式的源字符
3.字符集中的: [\^-
尽可能将会产生歧义的字符转义
14.3.3 特殊的点号(.)
.号可以替代任意单个字符,作为正则表达式中的模糊匹配字符
1.点号不匹配新行符(\n)
多行字符的模糊匹配中,.号不能匹配\n换行符,要匹配换行符,必须在标志位中使用s
2.尽量少使用点号“.”
只在明确不会模糊匹配时出错的情况下才用.模糊匹配,点号匹配所有的Unicode字符。
14.3.4 选择符
| 对选择符两边的元素作任意匹配。
使用|选择符时,尽可能使用括号将两边的操作数括起来,以方便区别。
14.3.5 括号与分组
() 圆括号将表达式的一部分括起来,就会将这部分定交成组,一旦命名了组,就可以通过“向后引用”来调用它。
它所括起的部分一般用于:
1.和选择符搭配,规定作用于选择符的范围,如/he(got|get)it/
2.和限定符搭配使用,指定匹配的重复次数,如/(get)*/
14.3.6 用正则表达式描述字符串的重复
使用{}定义匹配的重复次数,跟在要重复的表达式或字符后面
{最小出现次数[,最多出现次数]}
还有常用的三个 非显式限定符
*+? 星加问
* 出现0次或多次 等同 {0,}
+ 出现1次或多次 等同 {1,}
? 出现0次或最多1次 等同 {0,1}
14.3.7 注意正则表达式的贪婪性和懒惰性
使用*+?{}的时候,正则表达式总是尽可能向右搜寻尽可能多的匹配结果,如果想禁止此贪婪性,可在操作符后加上 ?,迫使程序运行时使用懒惰模式,优先使用左边匹配的第一个结果。
14.3.8 用正则表达式来定位
断言:指定匹配发生的位置
^ 匹配字符串起始的位置,一般跟在起始/后,组合成 /^
$ 匹配字符串结尾的位置,一般跟在结束/前,组合成$/
\b 匹配字符边界
\B 匹配非字符边界
字符边界指空格的位置,可跟在要匹配的表达式左边或右边
14.3.9 正则表达式的5个标志位。
g global 全局匹配,尽可能匹配全部结果
i ignoreCase 不区分大小写匹配
m multiline 断言控制符,使用后 ^$两个断言符才能生效
s dotall 匹配换行符标志
x extended 令正则表达式支持空格,但编译时会自动忽略,增加可视的友好度
14.3.10 正则表达式元字符优先线
优先级顺序从高到低排列
\ 转义符
(),(?:),(?=),[] 分级定义符号,字符集定义符号
*,+,?,{n},{n,},{n,m} 限定符
^,$,\位置定义 位置和顺序
| 选择符
14.4 正则表达式与字符串的结合使用详解
14.4.1 RegExp的exec()和test()
test方法
var RegExp对象:RegExp = /正则表达式/ 或 new RegExp(正则式,标志位)
var String对象:String = 字符;
RegExp对象.test(String对象)
RegExp对象.exec(正则表达式):Array
exec返回一个匹配后的数组
14.4.3 String类的replace()与正则表达式向后引用
()使用子表达式括起的表达式,可以在后边引用 ,使用\n n为索引 从1至99
/\b([a-z]+) \1\b/gi 其中的\1就是引用前面第一个([a-z])
可在处理函数中用 $n 来引用子模式


本文来源于 冰山上的播客 http://xinsync.xju.edu.cn ,

原文地址:http://xinsync.xju.edu.cn/index.php/archives/5086

分享到:
评论

相关推荐

    Oracle通过正则表达式分割字符串 REGEXP_SUBSTR的代码详解

    REGEXP_SUBSTR函数格式如下: function REGEXP_SUBSTR(string, pattern, position, occurrence, modifier) string :需要进行正则处理的字符串 pattern :进行匹配的正则表达式 position :起始位置,从第几个...

    Oracle分析函数基本概念和语法总结及Regexp_***用法

    关于`REGEXP_***`系列函数,它们是正则表达式的相关函数,用于在字符串中进行模式匹配和操作: 1. `REGEXP_SUBSTR`:返回匹配正则表达式的子串。 2. `REGEXP_INSTR`:返回匹配正则表达式的位置索引。 3. `REGEXP_...

    ant-apache-regexp.jar.zip

    《Ant与Apache Regexp库:深入理解jar.zip包》 在Java开发中,Ant和Apache Regexp库是两个至关重要的工具。Ant是一个基于Java的构建工具,它允许开发者通过XML描述构建过程,使得项目构建自动化。Apache Regexp库则...

    MySQL中使用replace、regexp进行正则表达式替换的用法分析

    MySQL数据库作为最流行的开源数据库之一,提供了多种工具来执行这类操作,其中replace函数和regexp正则表达式是强大的工具。replace函数可以通过简单的字符串替换来更新数据,而regexp则可以使用复杂的正则表达式...

    一个java正则表达式工具类源代码.zip(内含Regexp.java文件)

    原文如下: 以前写了一个java的正规表达式的java工具类,分享一下,有用到的欢迎下载使用。 如果你有常用的定义好的,且测试通过的正规表达式,欢迎跟贴,也让我享用一下 . 类中用到了 jakarta-oro-2.0.jar 包,请...

    regexp正则表达式正则表达式正则表达式

    ### 正则表达式(Regexp)基础知识及高级应用 #### 一、正则表达式的概念与作用 正则表达式(Regular Expression),通常简称为“regex”或“regexp”,是一种用于模式匹配的强大工具,广泛应用于文本处理领域,如...

    jakarta-regexp-1.5 正则表达式库

    Jakarta Regexp 1.5 是一个专门为Java开发者设计的开源正则表达式库,它提供了强大的文本匹配和处理功能。这个库源自Apache软件基金会,是许多Java项目中广泛使用的正则表达式实现之一。在Java标准库中,虽然内置了`...

    c语言windows版regexp

    标题中的“c语言windows版regexp”指的是在Windows操作系统环境下,使用C语言进行正则表达式处理的方法。C语言本身并不内置正则表达式库,但可以通过第三方库来实现这一功能。这里提到了 `<regex.h>` 头文件,这通常...

    oracle_10g正则表达式_REGEXP_LIKE_用法

    其中,`REGEXP_LIKE`是最常用的函数之一,它允许用户通过正则表达式来匹配字符串中的模式,从而实现更复杂的查询需求。下面将详细介绍`REGEXP_LIKE`的用法以及如何在Oracle 10g中使用正则表达式进行数据筛选。 ### ...

    mysql_regexp_replace.zip_oracle

    标题"mysql_regexp_replace.zip_oracle"表明我们关注的是如何在 MySQL 中实现类似于 Oracle 的 `REGEXP_REPLACE` 函数的功能。Oracle 的 `REGEXP_REPLACE` 函数允许用户使用正则表达式进行复杂的字符串替换操作,而 ...

    基于Bootstrap 3 JQuery及RegExp的表单验证功能

    Bootstrap 3、JQuery、RegExp 表单验证功能的实现知识点: Bootstrap 3 是一款广泛使用的前端框架,提供了一套响应式的栅格系统、预设的样式和基于HTML的模板,使得网页设计更加简洁和高效。Bootstrap 3 默认包含了...

    regexptest 正则测验工具

    《regexptest:强大的正则表达式测试工具》 在信息技术领域,正则表达式(Regular Expression,简称regex)是一种强大的文本处理工具,广泛应用于数据验证、搜索与替换、数据分析等场景。为了帮助开发者和测试人员...

    正则表达式库gnu.regexp-1.1.4

    正则表达式库GNU.regexp-1.1.4是一个用于处理文本模式匹配的开源库,主要用于Java编程语言。这个库提供了对标准正则表达式语法的支持,使得开发者能够高效地进行字符串查找、替换和分割等操作。在本文中,我们将深入...

    Atom-atom-align-regexp,基于regexp的atom对齐。对danhper/atom的贡献.zip

    "Atom-atom-align-regexp" 是一个专门为Atom编辑器设计的插件,其主要功能是实现基于正则表达式(regexp)的代码对齐。这个插件是针对danhper/atom项目的一个贡献,旨在提高开发者的代码整洁性和可读性。 在编程...

    ant-apache-regexp-1.6.5.jar.zip

    《Ant Apache Regexp库详解与应用》 Apache Ant是一个Java库和命令行工具,其任务是驱动构建过程,它是Java应用程序开发中的一个关键组件。在我们的主题中,我们聚焦于"ant-apache-regexp-1.6.5.jar.zip"这个压缩包...

    jakarta-regexp-1.4.zip

    Jakarta Regexp是Apache软件基金会的一个项目,它提供了一个强大的正则表达式库,用于Java平台。这个"jakarta-regexp-1.4.zip"压缩包包含的是Jakarta Regexp库的1.4版本,它是Lucene项目的依赖之一,用于处理和分析...

    ant-jakarta-regexp.jar.zip

    《AntJakarta-regexp.jar——构建Java项目的利器》 在Java开发过程中,自动化构建工具起着至关重要的作用,其中Apache Ant是广泛使用的工具之一。而"ant-jakarta-regexp.jar.zip"这个压缩包,正是与Apache Ant相关...

    ant-jakarta-regexp-1.6.1.jar.zip

    《Ant Jakarta Regexp库详解与应用》 在Java开发领域,Apache Ant是一个广泛使用的构建工具,它基于XML来定义项目构建过程。而Jakarta Regexp是Ant中的一个关键组件,用于处理正则表达式相关任务。本文将深入探讨...

    regexp-1.3.jar

    regexp-1.3.jar 是RegExp 对象表示正则表达式,它是对字符串执行模式匹配的强大工具所使用jar,已经测验过,欢迎下载!

Global site tag (gtag.js) - Google Analytics