（2018-04-16.Python从Zero到One）五、正则表达式__5.1.7匹配分组

上一篇文章为:→5.1.6表示边界

匹配分组

字符	功能
		匹配左右任意一个表达式
(ab)	将括号中字符作为一个分组
`\num`	引用分组num匹配到的字符串
`(?P<name>)`	分组起别名
(?P=name)	引用别名为name分组匹配到的字符串

示例1：|

需求：匹配出0-100之间的数字

#coding=utf-8

import re

ret = re.match("[1-9]?\d","8")
ret.group()

ret = re.match("[1-9]?\d","78")
ret.group()

# 不正确的情况
ret = re.match("[1-9]?\d","08")
ret.group()

# 修正之后的
ret = re.match("[1-9]?\d$","08")
ret.group()

# 添加|
ret = re.match("[1-9]?\d$|100","8")
ret.group()

ret = re.match("[1-9]?\d$|100","78")
ret.group()

ret = re.match("[1-9]?\d$|100","08")
ret.group()

ret = re.match("[1-9]?\d$|100","100")
ret.group()

运行结果：

day21_正则表达式-01.png

示例2：( )

需求：匹配出163、126、qq邮箱之间的数字

#coding=utf-8

import re

ret = re.match("\w{4,20}@163\.com", "test@163.com")
ret.group()

ret = re.match("\w{4,20}@(163|126|qq)\.com", "test@126.com")
ret.group()

ret = re.match("\w{4,20}@(163|126|qq)\.com", "test@qq.com")
ret.group()

ret = re.match("\w{4,20}@(163|126|qq)\.com", "test@gmail.com")
ret.group()

运行结果：

day21_正则表达式-02.png

练习：

>>> ret = re.match("([^-]*)-(\d+)","010-12345678")
>>> ret.group()
'010-12345678'
>>> ret.group(1)
'010'
>>> ret.group(2)
'12345678'

示例3：\

需求：匹配出<html>hh</html>

#coding=utf-8

import re

# 能够完成对正确的字符串的匹配
ret = re.match("<[a-zA-Z]*>\w*</[a-zA-Z]*>", "<html>hh</html>")
ret.group()

# 如果遇到非正常的html格式字符串，匹配出错
ret = re.match("<[a-zA-Z]*>\w*</[a-zA-Z]*>", "<html>hh</htmlbalabala>")
ret.group()

# 正确的理解思路：如果在第一对<>中是什么，按理说在后面的那对<>中就应该是什么

# 通过引用分组中匹配到的数据即可，但是要注意是元字符串，即类似 r""这种格式
ret = re.match(r"<([a-zA-Z]*)>\w*</\1>", "<html>hh</html>")
ret.group()

# 因为2对<>中的数据不一致，所以没有匹配出来
ret = re.match(r"<([a-zA-Z]*)>\w*</\1>", "<html>hh</htmlbalabala>")
ret.group()

运行结果：

day21_正则表达式-03.png

示例4：\number

需求：匹配出<html><h1>www.itcast.cn</h1></html>

#coding=utf-8

import re

ret = re.match(r"<(\w*)><(\w*)>.*</\2></\1>", "<html><h1>www.itcast.cn</h1></html>")
ret.group()

ret = re.match(r"<(\w*)><(\w*)>.*</\2></\1>", "<html><h1>www.itcast.cn</h2></html>")
ret.group()

运行结果：

day21_正则表达式-04.png

示例5：`(?P<name>)` `(?P=name)`

需求：匹配出<html><h1>www.itcast.cn</h1></html>

#coding=utf-8

import re

ret = re.match(r"<(?P<name1>\w*)><(?P<name2>\w*)>.*</(?P=name2)></(?P=name1)>", "<html><h1>www.itcast.cn</h1></html>")
ret.group()

ret = re.match(r"<(?P<name1>\w*)><(?P<name2>\w*)>.*</(?P=name2)></(?P=name1)>", "<html><h1>www.itcast.cn</h2></html>")
ret.group()

注意：`(?P<name>)`和`(?P=name)`中的字母p大写

运行结果：

day21_正则表达式-05.png

下一篇文章为:→5.1.8re模块的高级用法

最后编辑于：2018.04.24 19:05:03

©著作权归作者所有,转载或内容合作请联系作者
【社区内容提示】社区部分内容疑似由AI辅助生成，浏览时请结合常识与多方信息审慎甄别。
平台声明：文章内容（如有图片或视频亦包括在内）由作者上传并发布，文章内容仅代表作者本人观点，简书系信息发布平台，仅提供信息存储服务。

（2018-04-16.Python从Zero到One）五、正则表达式__5.1.7匹配分组

（2018-04-16.Python从Zero到One）五、正则表达式__5.1.7匹配分组

上一篇文章为:→5.1.6表示边界

匹配分组

示例1：|

示例2：( )

练习：

示例3：\

示例4：\number

示例5：`(?P<name>)` `(?P=name)`

注意：`(?P<name>)`和`(?P=name)`中的字母p大写

下一篇文章为:→5.1.8re模块的高级用法

相关阅读更多精彩内容

友情链接更多精彩内容

（2018-04-16.Python从Zero到One）五、正则表达式__5.1.7匹配分组

上一篇文章为:→5.1.6表示边界

匹配分组

示例1：|

示例2：( )

练习：

示例3：\

示例4：\number

示例5：(?P<name>) (?P=name)

注意：(?P<name>)和(?P=name)中的字母p大写

下一篇文章为:→5.1.8re模块的高级用法

相关阅读更多精彩内容

友情链接更多精彩内容

示例5：`(?P<name>)` `(?P=name)`

注意：`(?P<name>)`和`(?P=name)`中的字母p大写