在python中使用正则表达式

正则表达式是什么?就是要寻找的数据的规律,使用正则表达式的步骤有三

第一,寻找规律,第二使用正则符号表示规律,第三,提取信息

看下面的代码

python 复制代码
import re
wenzhang = ('小草偷偷地从土里钻出来,嫩嫩的,绿绿的。园子里,田野里,瞧去,密码是:200073215,一大片一大片满是的。'
            '坐着,躺着,打两个滚,踢几脚球,赛几趟跑:27329915,一,捉几回迷藏。风轻悄悄的,草软绵绵的。')
paqumima= re.findall(':(.*),',wenzhang)
paquzhunque = re.findall(':(.*?),',wenzhang)
print(paqumima,len(paqumima))
print(paquzhunque,len(paquzhunque))

输出效果为

python 复制代码
['200073215,一大片一大片满是的。坐着,躺着,打两个滚,踢几脚球,赛几趟跑:27329915,一,捉几回迷藏。风轻悄悄的'] 1
['200073215', '27329915'] 2

相关知识:

第一行 import re

python中正则表达式的模块就是re,所以第一行先导入模块re

第二行:wenzhang=('巴拉巴拉巴巴拉拉')

就是把要提取的文本源文件赋值给一个叫wenzhang的变量,当然这个变量名可以自己随便起。

第三行:paqumima= re.findall(':(.*),',wenzhang)

re是导入的模块,

点,findall是re模块中的一个方法,findall的使用格式是

re.findall('正则表达式',这是里源文本变量)

'正则表达式'的格式是

'要爬取文字前面的字符(.*)要爬取文字后面的字符'

返回的值就是按正则表达式描述的内容。

这里的正则表达式是**':(.*),'**

意思就是,从源文本中找以**:开头的,以,结尾的部分,这一部分就是用(.*)**表示

其中.表示除换行符以外的任何一个字符。

*表示它前面的一个表达式0次到无限次。

但是第三行的正则表达式有个缺点就是以:开头,以最后一个,结尾,中间还爬取了好多没用的信息,所以我们用了第四行的正则表达式

第四行代码:paquzhunque = re.findall(':(.*?),',wenzhang)

除了正则表达式多了一个?外,和第三行代码一模一样,从后面输出的效果来看

正则表达式(.*?)表示每一个符合正则表达式的内容。所以后面输出的效果长度也是2,也仅仅是输出了表示密码的部分。

相关推荐
JJJJ_iii35 分钟前
【机器学习12】无监督学习:K-均值聚类与异常检测
人工智能·笔记·python·学习·机器学习·均值算法·聚类
Tony Bai1 小时前
从 Python 到 Go:我们失去了什么,又得到了什么?
开发语言·后端·python·golang
赵渝强老师1 小时前
【赵渝强老师】TiDB PD集群存储的信息
数据库·mysql·tidb
wudl55661 小时前
python字符串处理与正则表达式--之八
开发语言·python·正则表达式
程序员爱钓鱼1 小时前
Python编程实战 - 面向对象与进阶语法 - 继承与多态
后端·python·ipython
程序员爱钓鱼1 小时前
Python编程实战 - 面向对象与进阶语法 - 封装与私有属性
后端·python·ipython
nvd111 小时前
python异步编程 -- 理解协程函数和协程对象
开发语言·python
木土雨成小小测试员2 小时前
简单创建一个flask项目
后端·python·flask
java1234_小锋2 小时前
PyTorch2 Python深度学习 - transform预处理转换模块
开发语言·python·深度学习·pytorch2
IT教程资源C3 小时前
(N_158)基于微信小程序学生社团管理系统
mysql·vue3·前后端分离·社团小程序·springboot社团小程序