目录
- python正则表达式括号
- python中re库函数的简单用法
- python正则表达式入门教程括号及字符
- 括号区别
- 常用正则表达式
python正则表达式括号
python中re库函数的简单用法
re.findall(pattern,string)
- 匹配所有符合正则表达式的字符,返回一个列表
re.search(pattern,string)
- 查找第一个符合正则表达式的字符,返回一个Matcher对象。用group()或groups()方法取值
re.match(pattern,string)
- 查找第一个符合正则表达式的字符,要求完全符合,返回一个Matcher对象。用group()或groups()方法取值
正则表达式中的圆括号()的作用是对字符或元字符分组。
我错把它的作用认为是将圆括号内的字符看成一个整体。
尽管在一些正则测试网站上,进行匹配时,把括号内的字符看成一个整体来匹配也能匹配到想要的结果。测试网站如:regex101等
然而在在写python程序的时候,会出现不是我想要的结果。
如果正则表达式中多出使用了圆括号进行分组的话。
在使用findall方法匹配结果就会只有分组的结果(即括号内表达式匹配的内容),而不是整个表达式所匹配的内容。
如果使用search方法匹配,对返回的Matcher对象调用group()方法可以获取完整的结果。但是在需要匹配多个结果时,还得用findall
所以在使用正则表达式时,若像我不太熟悉的话,避免使用圆括号来把一段表达式看成一个整体。
python正则表达式入门教程括号及字符
数据分析遇到字符串处理会有两个阶段涉及到正则表达式,一个是在数据库阶段一个是Python处理阶段。作为一个小白学习正则也遇到很多弯路和难理解的点,梳理梳理学习的过程。
hive里面正则表达式可以用regexp_extract()在select里进行返回指定要求的内容,也可以用regexp在where里进行指定要求的限制条件;
python里面re.findall()或者df.str.extract()(pandas功能);
正则表达式是一个特殊的字符序列,它能帮助你方便的检查一个字符串是否与某种模式匹配。学习正则需要记住两类知识点加上实际案例的联系就能很快的理解和掌握。
正则中语法规范:
括号区别
正则表达式中存在(),[],{}
1、():匹配小括号内的字符串,可以是一个,也可以是多个,常跟“|”(或)符号搭配使用,是多选结构的。() 是为了提取匹配的字符串。表达式中有几个()就有几个相应的匹配字符串
例:
2、【】:匹配字符组内的字符,比如咱们常用的[0-9a-zA-Z.*?!]等,在[]内的字符都是字符,不是元字符,比如“0-9”、“a-z”这中间的“-”就是连接符号,表示范围的元字符,如果写成[-!?*(]这样的话,就是普通字符例:
3、{ }一般用来表示匹配的长度,比如 \s{3} 表示匹配三个空格,\s{1,3}表示匹配一到三个空格例:
常用正则表达式
以上为个人经验,希望能给大家一个参考,也希望大家多多支持自由互联。