Python学习——正则表达式

时间:2022-11-11 14:56:56

https://www.cnblogs.com/tina-python/p/5508402.html

上面这个网站最全面了

 

‘[ ] ’ 能够多个同时匹配

 

'.'     默认匹配除\n之外的任意一个字符,若指定flag DOTALL,则匹配任意字符,包括换行

'^'      匹配字符开头,若指定flags MULTILINE,这种也可以匹配上(r "^a" , "\nabc\neee" ,flags = re.MULTILINE)
'$'      匹配字符结尾,或e.search( "foo$" , "bfoo\nsdfsf" ,flags = re.MULTILINE).group()也可以
'*'      匹配 * 号前的字符 0 次或多次,re.findall( "ab*" , "cabb3abcbbac" )  结果为[ 'abb' 'ab' 'a' ]
'+'      匹配前一个字符 1 次或多次,re.findall( "ab+" , "ab+cd+abb+bba" ) 结果[ 'ab' 'abb' ]
'?'      匹配前一个字符 1 次或 0
'{m}'    匹配前一个字符m次
'{n,m}'  匹配前一个字符n到m次,re.findall( "ab{1,3}" , "abb abc abbcbbb" ) 结果 'abb' 'ab' 'abb' ]
'|'      匹配|左或|右的字符,re.search( "abc|ABC" , "ABCBabcCD" ).group() 结果 'ABC'
'(...)'  分组匹配,re.search( "(abc){2}a(123|456)c" "abcabca456c" ).group() 结果 abcabca456c
 
 
'\A'     只从字符开头匹配,re.search( "\Aabc" , "alexabc" ) 是匹配不到的
'\Z'     匹配字符结尾,同$
'\d'     匹配数字 0 - 9
'\D'     匹配非数字
'\w'     匹配[A - Za - z0 - 9 ]
'\W'     匹配非[A - Za - z0 - 9 ]
's'      匹配空白字符、\t、\n、\r , re.search( "\s+" , "ab\tc1\n3" ).group() 结果  '\t'
 
'(?P<name>...)'  分组匹配 re.search( "(?P<province>[0-9]{4})(?P<city>[0-9]{2})(?P<birthday>[0-9]{4})" , "371481199306143242" ).groupdict( "city" ) 结果{ 'province' '3714' 'city' '81' 'birthday' '1993' }

 

re.match 从头开始匹配

re.search 匹配包含
re.findall 把所有匹配到的字符放到以列表中的元素返回
re.findall('[*-]', str) # ( ) 括号里面,前面的部分,以[ ]的形式,可以自动把*符号和-符号一起找出

OP = re.findall("[*/]",str) #找出所有*和/号
re.split 以匹配到的字符当做列表分隔符,并且返回列表
  
calc = re.split("[*/]",str)   #用*/分割公式
 
re.sub      匹配字符并替换

 

str = str.strip("()") # 去掉最外面的括号