解读python正则表达式括号问题
作者:zxdqdcxy 发布时间:2023-08-10 10:22:19
python正则表达式括号
python中re库函数的简单用法
re.findall(pattern,string)
匹配所有符合正则表达式的字符,返回一个列表
re.search(pattern,string)
查找第一个符合正则表达式的字符,返回一个Matcher对象。用group()或groups()方法取值
re.match(pattern,string)
查找第一个符合正则表达式的字符,要求完全符合,返回一个Matcher对象。用group()或groups()方法取值
正则表达式中的圆括号()的作用是对字符或元字符分组。
我错把它的作用认为是将圆括号内的字符看成一个整体。
尽管在一些正则测试网站上,进行匹配时,把括号内的字符看成一个整体来匹配也能匹配到想要的结果。测试网站如:regex101等
然而在在写python程序的时候,会出现不是我想要的结果。
如果正则表达式中多出使用了圆括号进行分组的话。
在使用findall方法匹配结果就会只有分组的结果(即括号内表达式匹配的内容),而不是整个表达式所匹配的内容。
如果使用search方法匹配,对返回的Matcher对象调用group()方法可以获取完整的结果。但是在需要匹配多个结果时,还得用findall
所以在使用正则表达式时,若像我不太熟悉的话,避免使用圆括号来把一段表达式看成一个整体。
python正则表达式入门教程括号及字符
数据分析遇到字符串处理会有两个阶段涉及到正则表达式,一个是在数据库阶段一个是Python处理阶段。作为一个小白学习正则也遇到很多弯路和难理解的点,梳理梳理学习的过程。
hive里面正则表达式可以用regexp_extract()在select里进行返回指定要求的内容,也可以用regexp在where里进行指定要求的限制条件;
python里面re.findall()或者df.str.extract()(pandas功能);
正则表达式是一个特殊的字符序列,它能帮助你方便的检查一个字符串是否与某种模式匹配。学习正则需要记住两类知识点加上实际案例的联系就能很快的理解和掌握。
正则中语法规范:
括号区别
正则表达式中存在(),[],{}
1、():匹配小括号内的字符串,可以是一个,也可以是多个,常跟“|”(或)符号搭配使用,是多选结构的。() 是为了提取匹配的字符串。表达式中有几个()就有几个相应的匹配字符串
例:
string= | ‘我正在学习python3的正则表达式,现在的日期是2019-01-22’ |
---|---|
目的 | 给定指定字符串进内容进行精准匹配获取python |
hive | select regexp_extract(string,’(python)’,1) 返回结果为:python,1代码返回正则的第几个括号中的内容 |
python | re.findall(’(python)’,string)返回结果为:python |
2、【】:匹配字符组内的字符,比如咱们常用的[0-9a-zA-Z.*?!]等,在[]内的字符都是字符,不是元字符,比如“0-9”、“a-z”这中间的“-”就是连接符号,表示范围的元字符,如果写成[-!?*(]这样的话,就是普通字符例:
string= | ‘我正在学习python3的正则表达式,现在的日期是2019-01-22’ |
---|---|
目的 | 给定字符进内容匹配获取python |
hive | select regexp_extract(string,’[a-z]’,0) 返回结果为:python,0代码返回符合正则的内容,如果有小括号可以写1(如'([a-z]+)') |
python | re.findall(’[a-z]+’,string)返回结果为:python |
目的 | 给定字符进内容匹配获取日期2019-01-22 |
hive | select regexp_extract(string,’([0-9]+.[0-9]+.[0-9]+)’,1) 返回结果为:2019-01-22 |
python | re.findall(’[0-9]+.[0-9]+.[0-9]+’,string)返回结果为:2019-01-22 |
需求增加 | 如果我要只需日期22这个部分 |
python | re.findall(’[0-9]+.[0-9]+.([0-9]+)’,string)返回结果为:22,和上面的对比发现在最后一个[0-9]+外面加了一个小括号,有小括号就返回小括号里面的内容 |
3、{ }一般用来表示匹配的长度,比如 \s{3} 表示匹配三个空格,\s{1,3}表示匹配一到三个空格例:
string= | ‘我正在学习python3的正则表达式,现在的日期是2019-01-22’ |
---|---|
目的 | 取出日期数据部分结果为2019,01,22 |
python | re.findall(’([0-9]{2,4})’,string) 返回结果为:[2019,01,22],python3中到3是一个数字,所以指定数据个数为2-4的就为日期部分的数字 |
常用正则表达式
匹配名 | 匹配表达式 | 例子 |
---|---|---|
转义符 | \ | “n”匹配字符“n”。"\n"匹配一个换行符。串行"\\"匹配"\"而"\("则匹配"(" |
开始位置 | ^ | "abc,bac"匹配b开头的bac[^b]([a-z]{3}) |
结束位置 | $ | "abce,abcd"匹配d结尾字母[a-z]+d$ |
表达式0次或多次 | * | |
表达式1次或多次 | + | |
表达式0次或1次 | ? | |
除\n任意字符 | . | |
单词边界 | \b | “er\b”可以匹配“never”中的“er”,但不能匹配“verb”中的“er” |
非单词边界 | \B | “er\B”能匹配“verb”中的“er”,但不能匹配“never”中的“er” |
换页符 | \f | |
空白行 | \n\s*\r | |
首尾空白字符 | ^\s* | \s*$ |
中文字符 | [\u4e00-\u9fa5] | |
双字节字符(包含汉子在内) | [^\x00-\xff] | |
数字 | [0-9]或\d | |
非数字 | \D | |
小写字母 | [a-z] | |
大写字母 | [A-Z] | |
大小写字母 | [a-zA-Z] | |
英文加数字 | a-z0-9 |
来源:https://blog.csdn.net/weixin_43917430/article/details/108935233
猜你喜欢
- 内容摘要:最近在做项目的时候,客户要求表格里的数据可以拖选,于是用JS写了个下面的方法。支持IE、FIREFOX等浏览器。实现对整行、整列数
- 本文实例讲述了python实现的分析并统计nginx日志数据功能。分享给大家供大家参考,具体如下:利用python脚本分析nginx日志内容
- 笔者日积月累了许多精彩、实用的Web特效的制作,这些特效几乎都是比较常用的网页特效。现在我就把这些经过
- 下面代码的功能是为了管理任务的,大家项目中有需要用到的,尽管拿去吧。 这个东西用于可以管理任务比如:今天我要做什么,做了没有,做了就打钩。&
- 升级了浏览器到IE9,今天进入公司网站后台突然发现有些页面进不去了,F12调试显示有JS错误:DOM Exception: INVALID_
- 前不久有个正要毕业的网友给我发邮件,他毕业设计需要实现锁屏的效果,但是他没有能看懂我之前发布的对话框源码,他问能不能把锁屏相关代码说明下,我
- 作为微软推出的网页与数据库解决方案,ASP由于有微软得天独厚的操作系统等技术后盾支持,因此得到了迅速的发展,并且正受到越来越多的欢迎,在目前
- facebook的信息架构设计,是目前为止互联网上我见过的最合理的信息架构。每次培训,我基本都需要拿20分钟左右的时间来解析它,包括老的、新
- 核心代码# -*- coding: utf-8 -*-'''python读取英文文件,将每个单词按照空格分开,并将每
- 关于截取字符串指定长度的自定义函数很多,各式各样!不过大多原理都是一个样,循环字符串判断每一个字符的asc码!我这里也有一个,示例函数如下:
- golang1.16也在今天正式发布了。原定计划是2月1号年前发布的,不过迟到也是golang的老传统了,正好也趁着最后的假期快速预览一下g
- 你已经在上面取出w打头记录的例子中看到了LIKE的用法。LIKE判定词是一个非常有用的符号。不过,在很多情况下用了它可能会带给你太多的数据,
- 这次讨论一下关于select元素的一个问题,其实很早以前我就碰到过关于select元素的问题,这次做网站又被问到同样的问题,就是:一般div
- 今天有业务需要制作用户头像的需求,在网上找了个可以裁剪大图制作自己希望大小的图片的方法(基于Struts2)。特此记录一下。不废话,具体的步
- 内容摘要:浏览器不兼容这个难题,一直是网页设计师们头痛的事情。ie7.0的面世,尚且不论他是否较之ie6.0进步, ie7和ie6
- 纯粹的截取字符串其实比较简单,用一个Left就搞定,但一个是全英文标题,一个是全中文标题,或中文混合排在一起,长短不一就很明显了,要考虑到中
- 首先声明,在这组里我是个绝对的菜鸟。再次声明,小爝这个菜鸟在“网页设计”这个圈里混了快1年了。 摘要:我知道我有多少底,所以我在总结我的成长
- 写了几年代码,很少谈到javascript程序的执行效率问题,今天就举几个例子看看,让大家看看程序优化是多么重要。这节来看看createEl
- 使用jmail组件发送邮件:Function JMail(Send_From,Send_To,Send_Subject,Send_
- 本文实例讲述了Python实现根据日期获取当天凌晨时间戳的方法。分享给大家供大家参考,具体如下:# -*- coding:utf-8 -*-