正则表达式

正则表达式

正则表达式是对字符串操作的一种逻辑公式,就是用实现定义好的一些特定字符、及这些特定字符的组合,组成一个“规则字符串”,这个“规则字符串”用来表达对字符串的一种过滤逻辑。

不是Python所独有,需要通过re模块加载。
正则表达式测试网站:开源中国

常用匹配字符:

re.match

re.match尝试从字符串的起始位置匹配一个模式,如果不是起始位置匹配成功的话,match()就返回none.

re.match(patter,string,flags=0)

实例

  • 常规匹配
import re
content = 'Hello 123 4537 World This is Regex Demo'
print(len(content))
result = re.match('^Hello\s\d\d\d\s\d{4}\s.*Demo$',content)
print(result)
print(result.group()) # 匹配的结果
print(result.span()) # 匹配字符的长度
  • 泛匹配: .*
import re
content = 'Hello 123 4537 World_This is Regex Demo'
result = re.match('^Hello.*Demo$',content)
print(result)
  • 匹配目标:小括号,然后用goup(1),group(2)
import re
content = 'Hello 1234537 World_This is Regex Demo'
result = re.match('^Hello\s(\d+)\sWorld.*Demo$',content)
print(result.group(1))
  • 贪婪匹配:匹配尽可能多的字符
import re
content = 'Hello 1234537 World_This is Regex Demo'
result = re.match('^He.*(\d+).*Demo$',content)
#这里小括号内只会匹配到7
  • 非贪婪匹配
import re
content = 'Hello 1234537 World_This is Regex Demo'
result = re.match('He.*?(\d+).*Demo$',content)
# 这里会匹配完整的数字
  • 匹配模式
import re
content = ''''''Hello 1234537 World_This
is Regex Demo''''''
result1 = re.match('He.*?(\d+).*Demo$',content)
result2 = re.match('He.*?(\d+).*Demo$',content,re.S)
  • 转义字符 ""
import re
content="This is $5.00"
result1 = re.match("This is $5.00",content)
result2 = re.match("This is \$5\.00)

小结:尽量使用泛匹配,使用括号得到匹配目标,尽量使用非贪婪模式,有换行符就用re.S,有特殊字符用转义

re.search

re.search扫描整个字符串并返回第一个成功的匹配

import re
content = "Extra strings Hello 1234657 World_This is a Regex Demo Extra strings"
result_re_match = re.match("He.*?(\d+).*Demo$",conent)
resutl_re_search = re.search("He.*?(\d+).*Demo$",content)

小结:为方便匹配,能用search,就不用match

re.findall

搜索字符串,以列表形式返回全部匹配的子串。

小括号既可以作为整体,又可以作为分组。

re.sub

替换字符串中每一个匹配的子串后返回替换后的字符串。

import re
content = "Extra strings Hello 1234657 World_This is a Regex Demo Extra strings"
# 替换
content1 = re.sub('\d+','',content)
content2 = re.sub('\d+','Replacement',content)
# 增加内容
content3 = re.sub('(\d+),r'\1 8910',content)

可以采用sub先进行替换,然后再用findall。
ps:使用strip()方法去除空格

re.compile

将正则表达式编译成正则表达式对象,以便复用匹配模式。

import re
content = '''Hello 1234567 World_This
is a Regex Demo'''
pattern = re.compile("Hello.*Demo',re.S)
result = re.match(pattern,content)
print(result)
最后编辑于
©著作权归作者所有,转载或内容合作请联系作者
  • 序言:七十年代末,一起剥皮案震惊了整个滨河市,随后出现的几起案子,更是在滨河造成了极大的恐慌,老刑警刘岩,带你破解...
    沈念sama阅读 212,332评论 6 493
  • 序言:滨河连续发生了三起死亡事件,死亡现场离奇诡异,居然都是意外死亡,警方通过查阅死者的电脑和手机,发现死者居然都...
    沈念sama阅读 90,508评论 3 385
  • 文/潘晓璐 我一进店门,熙熙楼的掌柜王于贵愁眉苦脸地迎上来,“玉大人,你说我怎么就摊上这事。” “怎么了?”我有些...
    开封第一讲书人阅读 157,812评论 0 348
  • 文/不坏的土叔 我叫张陵,是天一观的道长。 经常有香客问我,道长,这世上最难降的妖魔是什么? 我笑而不...
    开封第一讲书人阅读 56,607评论 1 284
  • 正文 为了忘掉前任,我火速办了婚礼,结果婚礼上,老公的妹妹穿的比我还像新娘。我一直安慰自己,他们只是感情好,可当我...
    茶点故事阅读 65,728评论 6 386
  • 文/花漫 我一把揭开白布。 她就那样静静地躺着,像睡着了一般。 火红的嫁衣衬着肌肤如雪。 梳的纹丝不乱的头发上,一...
    开封第一讲书人阅读 49,919评论 1 290
  • 那天,我揣着相机与录音,去河边找鬼。 笑死,一个胖子当着我的面吹牛,可吹牛的内容都是我干的。 我是一名探鬼主播,决...
    沈念sama阅读 39,071评论 3 410
  • 文/苍兰香墨 我猛地睁开眼,长吁一口气:“原来是场噩梦啊……” “哼!你这毒妇竟也来了?” 一声冷哼从身侧响起,我...
    开封第一讲书人阅读 37,802评论 0 268
  • 序言:老挝万荣一对情侣失踪,失踪者是张志新(化名)和其女友刘颖,没想到半个月后,有当地人在树林里发现了一具尸体,经...
    沈念sama阅读 44,256评论 1 303
  • 正文 独居荒郊野岭守林人离奇死亡,尸身上长有42处带血的脓包…… 初始之章·张勋 以下内容为张勋视角 年9月15日...
    茶点故事阅读 36,576评论 2 327
  • 正文 我和宋清朗相恋三年,在试婚纱的时候发现自己被绿了。 大学时的朋友给我发了我未婚夫和他白月光在一起吃饭的照片。...
    茶点故事阅读 38,712评论 1 341
  • 序言:一个原本活蹦乱跳的男人离奇死亡,死状恐怖,灵堂内的尸体忽然破棺而出,到底是诈尸还是另有隐情,我是刑警宁泽,带...
    沈念sama阅读 34,389评论 4 332
  • 正文 年R本政府宣布,位于F岛的核电站,受9级特大地震影响,放射性物质发生泄漏。R本人自食恶果不足惜,却给世界环境...
    茶点故事阅读 40,032评论 3 316
  • 文/蒙蒙 一、第九天 我趴在偏房一处隐蔽的房顶上张望。 院中可真热闹,春花似锦、人声如沸。这庄子的主人今日做“春日...
    开封第一讲书人阅读 30,798评论 0 21
  • 文/苍兰香墨 我抬头看了看天上的太阳。三九已至,却和暖如春,着一层夹袄步出监牢的瞬间,已是汗流浃背。 一阵脚步声响...
    开封第一讲书人阅读 32,026评论 1 266
  • 我被黑心中介骗来泰国打工, 没想到刚下飞机就差点儿被人妖公主榨干…… 1. 我叫王不留,地道东北人。 一个月前我还...
    沈念sama阅读 46,473评论 2 360
  • 正文 我出身青楼,却偏偏与公主长得像,于是被迫代替她去往敌国和亲。 传闻我的和亲对象是个残疾皇子,可洞房花烛夜当晚...
    茶点故事阅读 43,606评论 2 350

推荐阅读更多精彩内容

  • re模块手册 本模块提供了和Perl里的正则表达式类似的功能,不关是正则表达式本身还是被搜索的字符串,都可以...
    喜欢吃栗子阅读 3,993评论 0 13
  • 1.正则表达式概述 正则表达式,又称正规表示式、正规表示法、正规表达式、规则表达式、常规表示法(英语:Regula...
    TENG书阅读 838评论 0 1
  • 本文介绍了Python对于正则表达式的支持,包括正则表达式基础以及Python正则表达式标准库的完整介绍及使用示例...
    Python程序媛阅读 1,347评论 0 22
  • 月光透过稀疏的树叶斑驳的洒在床前,调皮的随着风儿波动,似乎在我的床上捉迷藏。夜,很静。。静得能听到枕边人均匀的呼吸...
    爬上屋顶看星星阅读 853评论 6 50
  • 白色的灯光下,我坐在桌子跟前,翻看着一个叫朋友圈的东西,我老了,我想,已经不懂得年轻人在想些什么。 今天,又和儿子...
    翩翩小念阅读 440评论 0 0