一、正则基础知识点

1、元字符

万物皆有元,正则表达式也是如此,元字符是构造正则表达式的一种基本元素

元字符 说明
. 匹配除换行符意外的任意字符
\w 匹配字母或下划线或汉字
\s 匹配任意的空白字符
\d 匹配数字
\b 匹配单词的开始或结束
^ 匹配字符串的开始
$ 匹配字符串的结束

image.png

2、重复限定符

有了元字符就可以写不少的正则表达式了,但细心的你们可能会发现:别人写的正则简洁明了,而上面写的正则一堆乱七八糟而且重复的元字符组成的。正则没提供办法处理这些重复的元字符吗?
答案是有的。
为了处理这些重复的数据,正则表达式中有一些重复限定符,把重复部分用使用合适的限定符代替,下面我们来看一下限定符

语法 说明
* 重复零次或更多次
+ 重复一次或更多次
? 重复零次或一次
{n} 重复n次
{n,} 重复n次或更多次
{n,m} 重复n到m次

image.png
重复限定符一般与元字符搭配使用,作用于字符前面

3、分组

从上面的例子(4)中看到,限定符是作用在与他左边最近的一个字符,那么问题来了,如果我想要ab同时被限定那怎么办呢?
正则表达式中用小括号()来做分组,也就是括号中的内容作为一个整体。

语法 说明
() 括号中的内容作为一个整体

image.png

4、转移

我们看到正则表达式用小括号来做分组,那么问题来了:
如果要匹配的字符串中本身就包含小括号,那是不是冲突?应该怎么办?

针对这种情况,正则提供了转义的方式,也就是要把这些元字符、限定符或者关键字转义成普通的字符,做法很简单,就是在要转义的字符前面加个斜杠,也就是\即可。
语法 说明
\ 需要转义的字符前面加个斜杠
\\ java中,转移字符需要使用\\

image.png
匹配/字符与-字符

2、 [\\/\\-]

5、条件

回到我们刚才的手机号匹配,我们都知道:国内号码都来自三大网,它们都有属于自己的号段,比如联通有130/131/132/155/156/185/186/145/176等号段,假如让我们匹配一个联通的号码,那按照我们目前所学到的正则,应该无从下手的,因为这里包含了一些并列的条件,也就是“或”,那么在正则中是如何表示“或”的呢?

正则用符号 | 来表示或,也叫做分支条件,当满足正则里的分支条件的任何一种条件时,都会当成是匹配成功。

image.png

6、区间

image.png