Python 正则表达式(匹配多个字符)- 寻找香烟smoke的故事

本文主要是介绍Python 正则表达式(匹配多个字符)- 寻找香烟smoke的故事,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

仅供学习,转载请注明出处

匹配多个字符

思考

  • 场景:胖子老板在写字板写了一大堆东西,判断是否存在smoke的语句,判断正确就可以送你一包烟。

前面篇章讲到了如何匹配单个字符,但是却不能完美解决胖子老板提出的这个问题。那么当然就要继续增加技能点,来解决这个问题啦。

匹配多个字符的相关格式

字符功能
*匹配前一个字符出现0次或者无限次,即可有可无
+匹配前一个字符出现1次或者无限次,即至少有1次
?匹配前一个字符出现1次或者0次,即要么有1次,要么没有
{m}匹配前一个字符出现m次
{m,n}匹配前一个字符出现从m到n次

匹配前一个字符出现0次或者无限次,即可有可无: *

# 首先匹配一个单字符大写M来热热身
In [8]: re.match("M","M").group()                                              
Out[8]: 'M'# 当小写m来匹配大写M字符的时候,淡定报错
In [9]: re.match("m","M").group()                                              
---------------------------------------------------------------------------
AttributeError                            Traceback (most recent call last)
<ipython-input-9-a22cd8e2da84> in <module>
----> 1 re.match("m","M").group()AttributeError: 'NoneType' object has no attribute 'group' # 使用 [] 的方法,来同时匹配大小写m
In [10]: re.match("[mM]","M").group()                                          
Out[10]: 'M'In [11]:    # 再来匹配大小写 a到z 的字母,当然这也是匹配一个字符而已,那么怎么匹配多个字符呢?
In [11]: re.match("[a-zA-Z]","M").group()                                      
Out[11]: 'M'In [12]: # 增加一个 * 号,那样就可以匹配出多个大小写字母了。
In [13]: re.match("[a-zA-Z]*","Mmasd").group()                                 
Out[13]: 'Mmasd'# 如果不用 * 号,那么一个 [] 只能匹配一个字符,这里写了两个 [] ,那么当然就是匹配出两个字符了。
In [14]: re.match("[a-zA-Z][a-zA-Z]","Mmasd").group()                          
Out[14]: 'Mm'In [15]:     # 那么来想一下,使用大小写字母来匹配数字,肯定会报错。那么加个 * 号 会不会报错呢?
In [15]: re.match("[a-zA-Z]","123456").group()                                 
---------------------------------------------------------------------------
AttributeError                            Traceback (most recent call last)
<ipython-input-15-68dd0d7f6c8c> in <module>
----> 1 re.match("[a-zA-Z]","123456").group()AttributeError: 'NoneType' object has no attribute 'group'# 从结果来看,是没有报错的。因为 * 号的原因就是匹配前面的字符是否存在0次,或者多次的情况。这次匹配就是0次,那么直接就返回空字符串了。
In [16]: re.match("[a-zA-Z]*","123456").group()                                
Out[16]: ''In [17]:     

匹配前一个字符出现1次或者无限次,即至少有1次: +

# 上面用 * 号的时候,匹配不到直接返回空字符串,则没有报错。
# 那么换成 + 号就报错了,因为 + 号是一定至少需要有一个字母来匹配的。
In [17]: re.match("[a-zA-Z]+","123456").group()                                
---------------------------------------------------------------------------
AttributeError                            Traceback (most recent call last)
<ipython-input-17-c8ba700cee8c> in <module>
----> 1 re.match("[a-zA-Z]+","123456").group()AttributeError: 'NoneType' object has no attribute 'group'# 那么改成 * 号,允许0次字母匹配。再加 \d 至少一个或者多个数字匹配,淡定OK
In [19]: re.match("[a-zA-Z]*\d+","123456").group()                             
Out[19]: '123456'In [20]:   

匹配前一个字符出现1次或者0次,即要么有1次,要么没有:?

有时候匹配一个字符不知道到底有没有的时候,就可以使用 ? 号处理,如下:

# 再最后增加一个下划线来匹配,淡定发现报错。
In [20]: re.match("[a-zA-Z]*\d+_","123456").group()                            
---------------------------------------------------------------------------
AttributeError                            Traceback (most recent call last)
<ipython-input-20-5266a50cf59d> in <module>
----> 1 re.match("[a-zA-Z]*\d+_","123456").group()AttributeError: 'NoneType' object has no attribute 'group'# 在下划线后面增加一个 ? 号,来设置不知道有没有下划线
In [21]: re.match("[a-zA-Z]*\d+_?","123456").group()                           
Out[21]: '123456'# 那么如果有下划线,就会把下划线匹配出来
In [22]: re.match("[a-zA-Z]*\d+_?","123456_").group()                          
Out[22]: '123456_'In [23]: re.match("[a-zA-Z]*\d+_?","123456_12312").group()                     
Out[23]: '123456_'In [24]:  

匹配一个 0 至 99 的数字:

# 如果直接匹配两个字符 [] [] ,那当然会报错
In [24]: re.match("[0-9][0-9]","1").group()                                    
---------------------------------------------------------------------------
AttributeError                            Traceback (most recent call last)
<ipython-input-24-b9459313bc26> in <module>
----> 1 re.match("[0-9][0-9]","1").group()AttributeError: 'NoneType' object has no attribute 'group'# 给第一个[] 设置 ?号,那么就可以判断可能不存在第一个字符,只有一个。
In [25]: re.match("[0-9]?[0-9]","1").group()                                   
Out[25]: '1'In [26]: re.match("[0-9]?[0-9]","11").group()                                  
Out[26]: '11'In [27]: re.match("[0-9]?[0-9]","99").group()                                  
Out[27]: '99'In [28]:   In [53]: re.match("[0-9]?\d","09").group()                                     
Out[53]: '09'

匹配前一个字符出现m次:{m}

需求:匹配出,8到20位的密码,可以是大小写英文字母、数字、下划线

# 首先匹配大小写字母,数字,下划线 使用 \w 即可
In [55]: re.match("\w","a").group()                                            
Out[55]: 'a'In [56]: re.match("\w","A").group()                                            
Out[56]: 'A'In [57]: re.match("\w","1").group()                                            
Out[57]: '1'In [58]: re.match("\w","_").group()                                            
Out[58]: '_'# 那么就是需要确定匹配多少个,这时候使用{ 8,20 } 即可匹配8到20位这个 \w  的字符了。
In [62]: re.match("\w{8,20}","123").group()                                    
---------------------------------------------------------------------------
AttributeError                            Traceback (most recent call last)
<ipython-input-62-24a5057f6d58> in <module>
----> 1 re.match("\w{8,20}","123").group()AttributeError: 'NoneType' object has no attribute 'group'In [63]:                                                                       In [63]: re.match("\w{8,20}","12345678").group()                               
Out[63]: '12345678'In [64]: re.match("\w{8,20}","12345678aAhjjhc____").group()                    
Out[64]: '12345678aAhjjhc____'In [65]:  

匹配出163的邮箱地址

@符号之前有4到20位大小写字符、数字、以及下划线,开头必须是字母,不能是下划线、数字。
正确 :fatboy@163.com
错误: 1ajsdhj@163.comm

In [68]: re.match('[a-zA-Z]\w{3,19}@163.com','fatboy@163.com').group()         
Out[68]: 'fatboy@163.com'In [69]:    In [70]: re.match('[a-zA-Z]\w{3,19}@163.com','1fatboy@163.com').group()        
---------------------------------------------------------------------------
AttributeError                            Traceback (most recent call last)
<ipython-input-70-020ba8a3bbe7> in <module>
----> 1 re.match('[a-zA-Z]\w{3,19}@163.com','1fatboy@163.com').group()AttributeError: 'NoneType' object has no attribute 'group'In [71]:     

寻找smoke的胖老板题目 - 使用findall方法

如下:

ajsdlka;sjd;lkjas;dlkujqoiueioujasldkasjlkdasdljkhalalksj;dla,msdmnas;lkdkasmdkl;amsx,.asjdklsomkeaskldjkalsjdklasmd,mxznjhsaioduoiwuasdjhkljasmnxnlkjsxhjalsdnkjlasbldkjnasdjnajsldnajlskdsmokeasjdlka;sjd;lkjasd;lkjasdsmokesmoke

问在这里面有多少个smoke?

In [86]: question = "ajsdlka;sjd;lkjas;dlkujqoiueioujasldkasjlkdasdljkhalalksj;...: dla,msdmnas;lkdkasmdkl;amsx,.asjdklsomkeaskldjkalsjdklasmd,mxznjhsaiod...: uoiwuasdjhkljasmnxnlkjsxhjalsdnkjlasbldkjnasdjnajsldnajlskdsmokeasjdlk...: a;sjd;lkjasd;lkjasdsmokesmoke"                                        In [87]: result = re.findall('smoke',question)                                 In [88]: print(len(result))                                                    
3In [89]: print(result)                                                         
['smoke', 'smoke', 'smoke']In [90]:    
13423234-562bf071aa22f9dd.gif
胖子老板:你哪里get到这个findall方法的,前面都没说啊

别着急,我后面继续写。

13423234-7907ae6344e86e8a.png

关注微信公众号,回复【资料】、Python、PHP、JAVA、web,则可获得Python、PHP、JAVA、前端等视频资料。

这篇关于Python 正则表达式(匹配多个字符)- 寻找香烟smoke的故事的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/1092188

相关文章

Python的Darts库实现时间序列预测

《Python的Darts库实现时间序列预测》Darts一个集统计、机器学习与深度学习模型于一体的Python时间序列预测库,本文主要介绍了Python的Darts库实现时间序列预测,感兴趣的可以了解... 目录目录一、什么是 Darts?二、安装与基本配置安装 Darts导入基础模块三、时间序列数据结构与

Python正则表达式匹配和替换的操作指南

《Python正则表达式匹配和替换的操作指南》正则表达式是处理文本的强大工具,Python通过re模块提供了完整的正则表达式功能,本文将通过代码示例详细介绍Python中的正则匹配和替换操作,需要的朋... 目录基础语法导入re模块基本元字符常用匹配方法1. re.match() - 从字符串开头匹配2.

Python使用FastAPI实现大文件分片上传与断点续传功能

《Python使用FastAPI实现大文件分片上传与断点续传功能》大文件直传常遇到超时、网络抖动失败、失败后只能重传的问题,分片上传+断点续传可以把大文件拆成若干小块逐个上传,并在中断后从已完成分片继... 目录一、接口设计二、服务端实现(FastAPI)2.1 运行环境2.2 目录结构建议2.3 serv

通过Docker容器部署Python环境的全流程

《通过Docker容器部署Python环境的全流程》在现代化开发流程中,Docker因其轻量化、环境隔离和跨平台一致性的特性,已成为部署Python应用的标准工具,本文将详细演示如何通过Docker容... 目录引言一、docker与python的协同优势二、核心步骤详解三、进阶配置技巧四、生产环境最佳实践

Python一次性将指定版本所有包上传PyPI镜像解决方案

《Python一次性将指定版本所有包上传PyPI镜像解决方案》本文主要介绍了一个安全、完整、可离线部署的解决方案,用于一次性准备指定Python版本的所有包,然后导出到内网环境,感兴趣的小伙伴可以跟随... 目录为什么需要这个方案完整解决方案1. 项目目录结构2. 创建智能下载脚本3. 创建包清单生成脚本4

Python实现Excel批量样式修改器(附完整代码)

《Python实现Excel批量样式修改器(附完整代码)》这篇文章主要为大家详细介绍了如何使用Python实现一个Excel批量样式修改器,文中的示例代码讲解详细,感兴趣的小伙伴可以跟随小编一起学习一... 目录前言功能特性核心功能界面特性系统要求安装说明使用指南基本操作流程高级功能技术实现核心技术栈关键函

Java实现字节字符转bcd编码

《Java实现字节字符转bcd编码》BCD是一种将十进制数字编码为二进制的表示方式,常用于数字显示和存储,本文将介绍如何在Java中实现字节字符转BCD码的过程,需要的小伙伴可以了解下... 目录前言BCD码是什么Java实现字节转bcd编码方法补充总结前言BCD码(Binary-Coded Decima

python获取指定名字的程序的文件路径的两种方法

《python获取指定名字的程序的文件路径的两种方法》本文主要介绍了python获取指定名字的程序的文件路径的两种方法,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要... 最近在做项目,需要用到给定一个程序名字就可以自动获取到这个程序在Windows系统下的绝对路径,以下

使用Python批量将.ncm格式的音频文件转换为.mp3格式的实战详解

《使用Python批量将.ncm格式的音频文件转换为.mp3格式的实战详解》本文详细介绍了如何使用Python通过ncmdump工具批量将.ncm音频转换为.mp3的步骤,包括安装、配置ffmpeg环... 目录1. 前言2. 安装 ncmdump3. 实现 .ncm 转 .mp34. 执行过程5. 执行结

Python实现批量CSV转Excel的高性能处理方案

《Python实现批量CSV转Excel的高性能处理方案》在日常办公中,我们经常需要将CSV格式的数据转换为Excel文件,本文将介绍一个基于Python的高性能解决方案,感兴趣的小伙伴可以跟随小编一... 目录一、场景需求二、技术方案三、核心代码四、批量处理方案五、性能优化六、使用示例完整代码七、小结一、