正则 | 
待匹配字符 | 
匹配结果 | 
说明 | 
[0123456789] | 
8 | 
True | 
在一个字符组里枚举合法的所有字符,字符组里的任意一个字符和"待匹配字符"相同都视为可以匹配 | 
[0123456789] | 
a | 
False | 
由于字符组中没有"a"字符,所以不能匹配 | 
[0-9] | 
7 | 
True | 
也可以用-表示范围,[0-9]就和[0123456789]是一个意思 | 
[a-z] | 
s | 
True | 
同样的如果要匹配所有的小写字母,直接用[a-z]就可以表示了 | 
[A-Z] | 
B | 
True | 
[A-Z]就表示所有的大写字母 | 
[0-9a-fA-F] | 
e | 
True | 
可以匹配数字,大小写形式的a-f,用来验证十六进制字符 | 
元字符 | 
匹配内容 | 
\w | 
匹配字母或数字或下划线 | 
\s | 
匹配任意的空白符 | 
\d | 
匹配数字 | 
\n | 
匹配一个换行符 | 
\t | 
匹配一个制表符(TAB) | 
\b | 
匹配一个单词的结尾 | 
^ | 
匹配字符串的开始 | 
$ | 
匹配字符串的结尾 | 
\W | 
匹配非字母或数字或下划线 | 
\S | 
匹配非空白符 | 
\D | 
匹配非数字 | 
a|b | 
匹配字符a或字符b | 
() | 
匹配括号内的表达式,也表示一个组 | 
[...] | 
匹配字符组中的字符 | 
[^...] | 
匹配除了字符组中字符的所有字符 | 
. | 
匹配除换行符以外的任意字符 | 
量词 | 
用法说明 | 
* | 
重复零次或更多次 | 
+ | 
重复一次或更多次 | 
? | 
重复零次或一次 | 
{n} | 
重复n次 | 
{n,} | 
重复n次或更多次 | 
{n,m} | 
重复n到m次 | 
正则 | 
待匹配字符 | 
匹配结果 | 
说明 | 
海. | 
海燕海角海东 | 
海燕海角海东 | 
匹配所有"海."的字符 | 
^海 | 
海燕海角海东 | 
海燕 | 
只从开头匹配"海." | 
海.$ | 
海燕海角海东 | 
海东 | 
只匹配结尾的"海.$" | 
正则 | 
待匹配字符 | 
匹配结果 | 
说明 | 
李.? | 
李安和李莲英和李大傻子 | 
李安李莲李大 | 
?表示重复零次或一次,即只匹配"李"后面一个任意字符 | 
李.* | 
李安和李莲英和李大傻子 | 
李安和李莲英和李大傻子 | 
*表示重复零次或多次,即匹配"李"后面0或多个任意字符 | 
李.+ | 
李安和李莲英和李大傻子 | 
李安和李莲英和李大傻子 | 
+表示重复一次或多次,即只匹配"李"后面1一个或多个任意字符 | 
李.{1,2} | 
李安和李莲英和李大傻子 | 
李安和李莲英李大傻 | 
{1,2}匹配1到2次任意字符 | 
正则 | 
待匹配字符 | 
匹配结果 | 
说明 | 
李[杰莲英二棍子]* | 
李杰和李莲英和李二棍子 | 
李杰李莲英李二棍子 | 
表示匹配"李"字后面[杰莲英二棍子]的字符任意次 | 
李[^和]* | 
李杰和李莲英和李二棍子 | 
李杰李莲英李二棍子 | 
表示匹配一个不是"和"的字符任意次 | 
[\d] | 
456bdha3 | 
4563 | 
表示匹配任意一个数字,匹配到4个结果 | 
[\d]+ | 
456bdha3 | 
4563 | 
表示匹配任意个数字,匹配到2个结果 | 
正则 | 
待匹配字符 | 
匹配结果 | 
说明 | 
^[1-9]\d{13,16}[0-9x]$ | 
110101198001017032 | 
110101198001017032 | 
表示可以匹配一个正确的身份证号 | 
^[1-9]\d{13,16}[0-9x]$ | 
1101011980010170 | 
110101198001017032 | 
表示也可以匹配这串数字,但这并不是一个正确的 身份证号,他是一个16位的数字 | 
^[1-9]\d{14}(\d{2}[0-9x])?$ | 
1101011980010170 | 
False | 
现在不会匹配错误的身份证号了()表示分组,将\d{2}[0-9x]分成一组,就可以整体约束他们出现的次数为0-1次 | 
^([1-9]\d{16}[0-9x]|[1-9]\d{14})$ | 
110105199812067023 | 
110105199812067023 | 
表示先匹配[1-9]\d{16}[0-9x]如果没有匹配上就匹配[1-9]\d{14} | 
正则 | 
待匹配字符 | 
匹配结果 | 
说明 | 
\d | 
\d | 
False | 
因为在正则表达式中\是由特殊意义的字符,所以要匹配\d本身,用表达式\d无法匹配 | 
\\d | 
\d | 
True | 
转义\之后变成\\,即可匹配 | 
"\\\\d" | 
"\\d" | 
True | 
如果python中,字符串中的"\"也需要转移,所以每一个字符串"\"又需转义一次 | 
r"\\d" | 
r"\d" | 
True | 
在字符串之前加r,让整个字符串不转义 | 
正则 | 
待匹配字符 | 
匹配结果 | 
说明 | 
<.*> | 
<script>...<script> | 
<script>...<script> | 
默认为贪婪匹配模式,会匹配尽量长的字符串 | 
<.*?> | 
r"\d" | 
<script><script> | 
加上? 为将贪婪匹配模式转为非贪婪匹配模式,会匹配尽量短的字符串 | 
原文:https://www.cnblogs.com/qicun/p/9488712.html