正则表达式+Python re模块详解-巨人网络通讯

正则表达式+Python re模块详解

正则表达式（Regluar Expressions）又称规则表达式，在代码中常简写为REs，regexes或regexp（regex patterns）。它本质上是一个小巧的、高度专用的编程语言。通过正则表达式可以对指定的文本实现
匹配测试、内容查找、内容替换、字符串分割等功能。

re模块介绍

Python中的re模块提供了一个正则表达式引擎接口，它允许我们将正则表达式编译成模式对象，然后通过这些模式对象执行模式匹配搜索和字符串分割、子串替换等操作。re模块为这些操作分别提供了模块级别的函数以及相关类的封装。

正则表达式一些小规则

①元字符

②量词

③贪婪和非贪婪匹配

    总是在量词范围内尽量多匹配 - 贪婪
    总是在量词范围内尽量少匹配 - 惰性
    .*?x 匹配任意内容任意次数遇到x就停止
    .+?x 匹配任意内容至少1次遇到x就停止

④转义符问题

    . 有特殊的意义,取消特殊的意义\
    取消一个元字符的特殊意义有两种方法
    在这个元字符前面加 \
     对一部分字符生效,把这个元字符放在字符组里
    [.()+?*]

Python --> re模块

findall
        会优先显示分组内的内容
        *****取消优先显示(?:正则)
search
        只能返回第一个符合条件的项
        得到的结果需要.group取值
        默认获取完整的匹配结果
        通过group(n)取第n个分组中的内容

# search 还是按照完整的正则进行匹配,显示也显示匹配到的第一个内容,但是我们可以通过给group方法传参数
# 来获取具体文组中的内容
ret = re.search('9(\d)(\d)','19740ash93010uru')
print(ret) # 变量 -- > re.Match object; span=(1, 4), match='974'>
if ret:
  print(ret.group()) # --> 974
  print(ret.group(1)) # --> 7
  print(ret.group(2)) # --> 4

# findall
  # 取所有符合条件的,优先显示分组中的
# search 只取第一个符合条件的,没有优先显示这件事儿
  # 得到的结果是一个变量
    # 变量.group() 的结果 完全和 变量.group(0)的结果一致
    # 变量.group(n) 的形式来指定获取第n个分组中匹配到的内容

# 加上括号 是为了对真正需要的内容进行提取
ret = re.findall('\w+>(\w+)/\w+>','h1>askh930s02391j192agsj/h1>')
print(ret) # --> ['askh930s02391j192agsj']

其他的内容在代码中有详细的注释，大家可以复制我的代码一步一步运行然后实验

以下的内容有：split sub subn math,compile,finditer

# split sub subn math,compile,finditer
# split
res = re.split('\d+', "cyx123456cyxx")
print(res) # --> ['cyx', 'cyxx']
res = re.split('(\d+)', "cyx123456cyxx") # 保留分组
print(res) # --> ['cyx', '123456', 'cyxx']
# sub 替换
res = re.sub('\d+', '我把数字替换了',
       "cyx123456cyxxx123456") # 默认全部替换，当然也可以替换一次re.sub('\d+','我把数字替换了',"cyx123456cyxxx123456"，1)
print(res) # --> cyx我把数字替换了cyxxx我把数字替换了
# subn 替换了并显示替换的次数
res = re.subn('\d+', '我把数字替换了', "cyx123456cyxxx123456")
print(res) # --> ('cyx我把数字替换了cyxxx我把数字替换了', 2)
# match 这个就相当与加了个^ (和search差不多) --> 主要用来规定这个字符号必须是什么样的
res = re.match('\d+', 'cyx123456cyxxx')
print(res) # --> None
res = re.match('\d+', '123cyx456cyxxx')
print(res.group()) # --> 123
# compile -- 节省代码的时间的工具
# 假如同一个正则表达式要被使用多次
# 节省了多次解析同一个正则表达式的时间
ret = re.compile("\d+")
res = ret.search("cyx12456cyxXX123")
print(res.group()) # --> 12456
# finditer --> 节省空间
ret = re.finditer("\d+", "cyx123456cyxxx125644")
for r in ret:
  print(r.group()) # --> 123456
  # 125644
# 怎么又节省时间又节省空间呢？
ret = re.compile('\d+')
res = ret.finditer("cyx222231fddsf45746sdf2123sdf56456sdf10123sdf123132sdf")
for r in res:
  print(r.group())
"""
222231
45746
2123
56456
10123
123132
"""
# 分组命名(?P组名>正则) (?P=组名)
# 有的时候我们要匹配的内容是包含在不想要的内容之中的,
# 只能先把不想要的内容匹配出来,然后再想办法从结果中去掉
# 分组命名的用法 (找两个组里面是一样的内容)
exp = 'abc>asdasf54545645698asdasd/abc>00545sdfsdf/abd>'
ret = re.search('(?Ptag>\w+)>.*?/(?P=tag)', exp)
print(ret) # -- > re.Match object; span=(0, 33), match='abc>asdasf54545645698asdasd/abc'>
# exp2：
import re
ret = re.search('\d(\d)\d(\w+?)(\d)(\w)\d(\d)\d(?Pname1>\w+?)(\d)(\w)\d(\d)\d(?Pname2>\w+?)(\d)(\w)',
        '123abc45678agsf_123abc45678agsf123abc45678agsf')
print(ret.group('name1')) # -- > agsf_123abc
print(ret.group('name2')) # -- > agsf

今日小思考

当我们有一个这样的列表：

lis = ['', 'z', 'c', 'asd', 'sdf', '', 'asd']

那么我们如何将里面的空字符删除呢？

ret = filter(lambda n: n, lis)
print(list(ret)) # --> ['z', 'c', 'asd', 'sdf', 'asd']

总结

到此这篇关于正则表达式+Python re模块详解的文章就介绍到这了,更多相关正则表达式 python re模块内容请搜索脚本之家以前的文章或继续浏览下面的相关文章希望大家以后多多支持脚本之家！

您可能感兴趣的文章:

Python之re模块案例详解
python re模块匹配贪婪和非贪婪模式详解
python的re模块使用方法详解
详解Python正则表达式re模块
python re模块的高级用法详解
python正则表达式re模块详解
Python之re模块详解

上一篇：解析正则表达式中的.*，.*?，.+?的含义
下一篇：js正则匹配table,img及去除各种标签问题

正则表达式+Python re模块详解

正则表达式（Regluar Expressions）又称规则表达式，在代码中常简写为REs，regexes或regexp（regex patterns）。它本质上是一个小巧的、高度专用的编程语言。通过正则表达式可以对指定的文本正则,表达式,+Python,模块,...

呼叫中心语音系统云呼_电话机器人

提高转化率就是让我们的营销更加有效，避免大量无效的营销，避免营销方面的浪费。...

锦州运输服务监督电话“12328”呼叫中心将开通

建设统一的12328交通运输服务监督电话系统，是交通运输部门落实党的群众路线的重要...

云外呼系统质量（阿里云外呼系统）

本文目次一览： 1、外呼零碎怎样？好用么？ 2、外呼零碎真的很不错吗？ 3、哪家的外...

linux如何mount挂载磁盘并设置开机自动mount的实现

知道大家时间都很宝贵，我直接把流程命令写下来，大家配置完即可，想研究原理的话...

租用电话外呼系统（电话外呼系统设备）

本文目次一览： 1、外呼零碎怎样操持？ 2、电销外呼零碎几何钱一个月？ 3、智能外呼...

400电话代理助力企业“快”发展

产品上市慢一步，被其他企业生产的同款产品抢了市场先机，服务速度慢一拍，被客户...

400电话办理如今是带给我们最美好的影响

事实上来说，我们都感觉到一些电话的办理能够带给我们一定的贡献与作用，其实在当...

机遇是物联网产业发展中的导火索

物联网是“天”“人”合一的产物，即“天然”与“人工”双重组合之物。追溯“物”...

企业使用400电话办理可以有更好服务体验

施耐德电气推出产品保修延长服务，实现与客户关系长期有效的维护。企业办理400电话...

哈尔滨餐饮加盟外呼系统怎么办理,外呼线路-服务周到

哈尔滨餐饮加盟外呼系统怎么办理,外呼线路这将提高你的可信度，并给你的对手接受你...

适合打电销的电话卡的特点

适合打电销的电话卡的特点发货要你企业资料报备，投诉有罚款的卡才是最稳的，不放...

400号码接听要钱吗400电话办理费用会受哪些因素影响

作为企业的专属客户服务电话，400电话采用主被称分享的方式。无论是用户打电话还是...

地图标注-河南发现日侵华时期中国地图标注有矿藏地

中新社新乡5月23日电董飞)记者23日自河南省新乡市博物馆了解到近日该市一位年近百岁...

所有400电话是免费的吗400是免费的电话吗怎么收费标准

(所有400电话是免费的吗)(400是免费的电话吗怎么收费标准)以下内容400电话加盟由巨人小...

中国移动加快转型流量经营集团层面首次启动策

数据流量爆炸式增长虽然给中国移动带来了一定的收入，但更多的是网络投资压力。中...

正则表达式+Python re模块详解

全 部 栏 目

正则表达式一些小规则

①元字符

②量词

③贪婪和非贪婪匹配

④转义符问题

Python --> re模块

全部栏目