python_ re模块学习
admin
2023-07-24 08:41:44
0

字符匹配(普通字符,元字符):

  1. 普通字符:大多数字符和字母都会和自身匹配

    re.findall('alvin','yuanaleSxalexwupeiqi')
    ['alvin']

  2. 元字符:. ^ $ * + ? { } [ ] | ( ) \

元字符之. ^ $ * + ? { }

import re

ret=re.findall('a..in','helloalvin')
print(ret)#['alvin']

ret=re.findall('^a...n','alvinhelloawwwn')
print(ret)#['alvin']

ret=re.findall('a...n$','alvinhelloawwwn')
print(ret)#['awwwn']

ret=re.findall('a...n$','alvinhelloawwwn')
print(ret)#['awwwn']

ret=re.findall('abc*','abcccc')#贪婪匹配[0,+oo]  
print(ret)#['abcccc']

ret=re.findall('abc+','abccc')#[1,+oo]
print(ret)#['abccc']

ret=re.findall('abc?','abccc')#[0,1]
print(ret)#['abc']

ret=re.findall('abc{1,4}','abccc')
print(ret)#['abccc'] 贪婪匹配

ret=re.findall('abc*?','abcccccc')
print(ret)#['ab']

元字符之字符集[]:

#--------------------------------------------字符集[]
ret=re.findall('a[bc]d','acd')
print(ret)#['acd']

ret=re.findall('[a-z]','acd')
print(ret)#['a', 'c', 'd']

ret=re.findall('[.*+]','a.cd+')
print(ret)#['.', '+']

#在字符集里有功能的符号: - ^ \

ret=re.findall('[1-9]','45dha3')
print(ret)#['4', '5', '3']

ret=re.findall('[^ab]','45bdha3')
print(ret)#['4', '5', 'd', 'h', '3']

ret=re.findall('[\d]','45bdha3')
print(ret)#['4', '5', '3']

元字符之转义符\

反斜杠后边跟元字符去除特殊功能,比如.
反斜杠后边跟普通字符实现特殊功能,比如\d

\d 匹配任何十进制数;它相当于类 [0-9]。
\D 匹配任何非数字字符;它相当于类 [^0-9]。
\s 匹配任何空白字符;它相当于类 [ \t\n\r\f\v]。
\S 匹配任何非空白字符;它相当于类 [^ \t\n\r\f\v]。
\w 匹配任何字母数字字符;它相当于类 [a-zA-Z0-9]。
\W 匹配任何非字母数字字符;它相当于类 [^a-zA-Z0-9
]
\b 匹配一个特殊字符边界,比如空格 ,&,#等

ret=re.findall('I\b','I am LIST')
print(ret)#[]
ret=re.findall(r'I\b','I am LIST')
print(ret)#['I']

import re
ret=re.findall('c\l','abc\le')
print(ret)#[]
ret=re.findall('c\\l','abc\le')
print(ret)#[]
ret=re.findall('c\\\\l','abc\le')
print(ret)#['c\\l']
ret=re.findall(r'c\\l','abc\le')
print(ret)#['c\\l']

#-----------------------------eg2:
#之所以选择\b是因为\b在ASCII表中是有意义的
m = re.findall('\bblow', 'blow')
print(m)
m = re.findall(r'\bblow', 'blow')
print(m)

元字符之分组()

m = re.findall(r'(ad)+', 'add')
print(m)

ret=re.search('(?P\d{2})/(?P\w{3})','23/com')
print(ret.group())#23/com
print(ret.group('id'))#23

元字符之|

ret=re.search('(ab)|\d','rabhdg8sd')
print(ret.group())#ab
re模块下的常用方法

import re
#1
re.findall('a','alvin yuan')    #返回所有满足匹配条件的结果,放在列表里
#2
re.search('a','alvin yuan').group()  #函数会在字符串内查找模式匹配,只到找到第一个匹配然后返回一个包含匹配信息的对象,该对象可以
                                     # 通过调用group()方法得到匹配的字符串,如果字符串没有匹配,则返回None。

#3
re.match('a','abc').group()     #同search,不过尽在字符串开始处进行匹配

#4
ret=re.split('[ab]','abcd')     #先按'a'分割得到''和'bcd',在对''和'bcd'分别按'b'分割
print(ret)#['', '', 'cd']

#5
ret=re.sub('\d','abc','alvin5yuan6',1)
print(ret)#alvinabcyuan6
ret=re.subn('\d','abc','alvin5yuan6')
print(ret)#('alvinabcyuanabc', 2)

#6
obj=re.compile('\d{3}')
ret=obj.search('abc123eeee')
print(ret.group())#123

import re
ret=re.finditer('\d','ds3sy4784a')
print(ret)        #

print(next(ret).group())
print(next(ret).group())
注意:

import re

ret=re.findall('www.(baidu|oldboy).com','www.oldboy.com')
print(ret)#['oldboy']     这是因为findall会优先把匹配结果组里内容返回,如果想要匹配结果,取消权限即可

ret=re.findall('www.(?:baidu|oldboy).com','www.oldboy.com')
print(ret)#['www.oldboy.com']

相关内容

热门资讯

相比高考590分,那个扛起被褥... 6月26日,“扛被褥出考场的贵州女孩考了590分”上了热搜。“扛得起被褥,也扛得起未来。”一则跟帖引...
天下苦话费贵久矣 “刚申请销户,套餐立刻便宜50元;坚持要销户,又便宜50元。”家住深圳的向生(化名),用了四年中国电...
网传济宁“某商城火锅店艾滋病人... 6月25日,一则关于“我市某区一商城内自助小火锅店有艾滋病患者在餐具内故意留下血迹,且疾控中心控制6...
冰箱恒温不制冷是什么原因造成的 原因可能是冰箱内一次性放入了太多东西,东西太多有可能堵住冰箱的进风口和出风口,冰箱内的冷空气不能循环...
冰箱压缩机不启动是什么原因造成... 1、可以看看是不是因为电源线路接触不良,磨损,松动的现象,从而出现了短路的,或者是此台冰箱的年限太长...
半自动洗衣机电机不转是什么原因 1、可能是插座板的接触不良引起的。2、可能是电机本身出现了故障问题,或者是其它的零件出现了问题,比如...
空调内机喷水是什么原因造成的 出现此类问题首先可以考虑是因为空调的挡水板老化变形或者是松动脱落造成的,还可以考虑是空调冷凝器破裂导...
空调打不开是什么原因造成的 首先可能是空调电源插座没有电,需要重新连接;如果电源正常,遥控器打不开的话,需要更换遥控器;可以通过...
特斯拉宣布为员工子女设立奖学金... 6月26日,特斯拉宣布为员工子女设立奖学金,包括高等教育入学奖学金和科学素养类竞赛/论文发布奖学金,...
新加坡籍货船遭袭,伊方:不走指... 据新华社援引美国《华尔街日报》25日报道称,伊朗伊斯兰革命卫队当天在霍尔木兹海峡袭击了一艘新加坡籍货...