python 正则表达式如何实现重叠匹配

 更新时间:2022年07月14日 12:01:28   作者:Dragon水魅  
这篇文章主要介绍了python 正则表达式如何实现重叠匹配,具有很好的参考价值,希望对大家有所帮助。如有错误或未考虑完全的地方,望不吝赐教
(福利推荐:【腾讯云】服务器最新限时优惠活动,云服务器1核2G仅99元/年、2核4G仅768元/3年,立即抢购>>>:9i0i.cn/qcloud

(福利推荐:你还在原价购买阿里云服务器?现在阿里云0.8折限时抢购活动来啦!4核8G企业云服务器仅2998元/3年,立即抢购>>>:9i0i.cn/aliyun

正则表达式实现重叠匹配

import regex
string = '100101010001'
str_re = '101'
print(regex.findall(str_re, string, overlapped=True))

普通的re库匹配,只能匹配一个’101’。

正则表达式与正则匹配

正则表达式

正则表达式可理解为对数据筛选的表达式,是有限个原子和元字符组成。

原子:基本组成单位,每个表达式至少有一个原子

普通字符组成原子 

非打印字符组成原子

(不打印在输出台的字符)

\n:换行

\t:tab退格符

通用字符组成原子

\w:匹配任意字母、数字、下划线

\W:与\w相反

\d:匹配任意十进制数

\D:与\d相反

\s:匹配任意空白字符,如空格、换行、缩进

\S:与\s相反

原子表组成原子

一组原子组成一个表,由[]声明

表内原子优先级相等,但内容只出现依次

若原子表以 ^ 开头,则表示取反

#普通字符组成原子
pat1 = "abcd"
 
#非打印字符组成原子
pat2 = "\n"
 
#通用字符做原子
pat3 = "\w"
 
#原子表组成原子
pat4 = "py[abc]"
#可以匹配pya,pyb,pyc,但匹配pyab等原子表重复出现的情况失败
 
#原子表开头带 ^ 表示取反
pat5 = "py[^abc]"
#第三个位置匹配除了a,b,c外的任意一个字符

元字符:正则表达式中具有特殊含义的字符

.匹配任意字符,除了换行符
^匹配字符串开始的位置
$匹配字符串结束的位置,当出现多组符合的匹配时,返回字符串最后的那组匹配
*匹配 0,1,n 次前面的原子【贪婪模式:尽可能多的匹配】
?匹配 0,1 次前面的原子【懒惰模式:精确匹配】
+匹配 1,n 次前面的原子
{ j }前面的原子出现 j 次
{ j , }前面的原子至少出现 j 次
{ j , k }前面的原子至少出现 j 次,至多出现 k 次
i | j匹配 i 或 j ,若 i 与 j 同时出现,匹配 i
( )组,限制这组数据的组合如()内所描述一样,只返回符合括号内描述的内容

模式修正符

即函数中 flag 位置的参数,在不改变正则表达式的情况下改变其含义,调整匹配结果。

re.I匹配时忽略大小写
re.M多行匹配
re.L本地化识别匹配
re.U根据unicon字符匹配,影响\w \W
re.S匹配包括换行符

正则匹配

正则表达式是对字符串进行模糊匹配,其中一个应用为正则匹配。正则匹配是python爬虫的一个使用技术,用于在爬取的文本信息中提取目标信息。

正则匹配常用的函数:(调用正则表达式模块re)

  • re.search(pat, str[, flag]):扫描字符串str,返回pat的位置(第一次成功匹配的),flag用于控制正则表达式的匹配方式
import re
str = 'python'
pat = 'pytho[a-n]'
print(re.search(pat, str))
  • re.match(pat, str[, flag]):扫描字符串str开始的位置,返回pat的位置(第一次成功匹配的),flag用于控制正则表达式的匹配方式【若开始就不符合则结束,返回none】
import re
str_1 = 'hello world'
str_2 = 'world hello'
pat = 'world'
print(re.match(pat, str_1))
print(re.match(pat, str_2))
  • re.complie(pat[, flag]):编译正则表达式pat,返回正则表达式对象
  • findall(str[, pos[, endpos]]):匹配所有,用列表返回string中所有匹配到的子串【不止第一次】,pos和endpos可指定在string中的起始位置
  • re.complie(pat).findall(str):全局匹配函数,匹配str中所有符合pat的子串,装入一个列表返回结果
import re
str = "hello world hello world hello world"
pat = "hello"
print(re.complie(pat).findall(str))
print(re.complie(pat).findall(str, 5, 15))
  • re.sub(pat, repl, str[, count[, flag]]):替换字符串中的匹配项【清洗数据】,可用count指定最大替换次数
import re
str = "400-823-823"
pat = "-"
#短横改空格,最大替换次数2
str_new = re.sub(pat, " ", str, count=2)

以上为个人经验,希望能给大家一个参考,也希望大家多多支持程序员之家。

相关文章

  • Python从list类型、range()序列简单认识类(class)【可迭代】

    Python从list类型、range()序列简单认识类(class)【可迭代】

    这篇文章主要介绍了Python从list类型、range()序列简单认识类(class),结合实例形式分析了list、range及自定义类等可迭代数据类型相关使用技巧,需要的朋友可以参考下
    2019-05-05
  • Python中你应该知道的一些内置函数

    Python中你应该知道的一些内置函数

    python提供了内联模块buidin,该模块定义了一些软件开发中常用的函数,这些函数实现了数据类型的转换,数据的计算,序列的处理等功能。下面这篇文章主要给大家介绍了Python中一些大家应该知道的内置函数,文中总结的非常详细,需要的朋友们下面来一起看看吧。
    2017-03-03
  • 解决python logging遇到的坑 日志重复打印问题

    解决python logging遇到的坑 日志重复打印问题

    这篇文章主要介绍了解决python logging遇到的坑 日志重复打印问题,具有很好的参考价值,希望对大家有所帮助。一起跟随小编过来看看吧
    2021-03-03
  • Python Socket编程详解

    Python Socket编程详解

    这篇文章主要介绍了Python Socket编程的相关资料,帮助大家更好的理解和学习使用python,感兴趣的朋友可以了解下
    2021-04-04
  • Python数学建模学习模拟退火算法多变量函数优化示例解析

    Python数学建模学习模拟退火算法多变量函数优化示例解析

    模拟退火算法借鉴了统计物理学的思想,是一种简单、通用的启发式优化算法,并在理论上具有概率性全局优化性能,因而在科研和工程中得到了广泛的应用
    2021-10-10
  • 使用Python计算偏导数

    使用Python计算偏导数

    偏导数在数学、物理、工程等领域中都有广泛的应用,特别是在描述多变量系统的变化率、梯度、最小值和最大值等方面,下面我们就来看看如何利用Python计算偏导数吧
    2024-01-01
  • Python光学仿真学习处理高斯光束分布图像

    Python光学仿真学习处理高斯光束分布图像

    这篇文章主要为大家介绍了Python光学仿真学习之如何处理高斯光束的分布图像,有需要的朋友可以借鉴参考下,希望能够有所帮助,祝大家多多进步
    2021-10-10
  • Python?hashlib模块详细讲解使用方法

    Python?hashlib模块详细讲解使用方法

    hashlib?是一个提供了一些流行的hash算法的?Python?标准库.其中所包括的算法有?md5,?sha1,?sha224,?sha256,?sha384,?sha512.?另外,模块中所定义的?new(name,?string=”)?方法可通过指定系统所支持的hash算法来构造相应的hash对象
    2022-11-11
  • Python嵌套循环的使用

    Python嵌套循环的使用

    本文主要介绍了Python嵌套循环的使用,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友们下面随着小编来一起学习学习吧<BR>
    2023-02-02
  • torchxrayvision包安装过程(附pytorch1.6cpu版安装)

    torchxrayvision包安装过程(附pytorch1.6cpu版安装)

    这篇文章主要介绍了torchxrayvision包安装过程(附pytorch1.6cpu版安装),文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友们下面随着小编来一起学习学习吧
    2020-08-08

最新评论

?


http://www.vxiaotou.com