加入收藏 | 设为首页 | 会员中心 | 我要投稿 李大同 (https://www.lidatong.com.cn/)- 科技、建站、经验、云计算、5G、大数据,站长网!
当前位置: 首页 > 百科 > 正文

正则表达式笔记

发布时间:2020-12-13 22:34:00 所属栏目:百科 来源:网络整理
导读:1.所谓组,即你查一次,可以查多种匹配的结果,每种结果即是一组 eg. import repattern = re.compile(r'div(.*?)(.*?)/div')match = pattern.match('div class="test"Hello divwa hahadivtest xxx/div/divworld/div')if match: print match.group(2) print m

1.所谓组,即你查一次,可以查多种匹配的结果,每种结果即是一组

eg.

import re
pattern = re.compile(r'<div(.*?>)(.*?)</div>')
match = pattern.match('<div class="test">Hello <div>wa haha<div>test xxx</div></div>world</div>')
if match:
  print match.group(2)
  print match.group(1)
  print match.group(0)


>>> ================================ RESTART ================================
>>> 
Hello <div>wa haha<div>test xxx
 class="test">
<div class="test">Hello <div>wa haha<div>test xxx</div>
>>> 
其中group(0)比较特殊,所有组的合集


2.查找一个文件中所有的http(url)地址

import re
import urllib2
f = open('url.txt','r')
string = ""
while 1:
    line = f.readline()
    if not line:break
    string += line

f.close()

urls = re.findall('http[s]?://(?:[a-zA-Z]|[0-9]|[$-_@.&+]|[!*(),]|(?:%[0-9a-fA-F][0-9a-fA-F]))+',string)
3.正则表达式中的空格包括trnfv等几种字符

(编辑:李大同)

【声明】本站内容均来自网络,其相关言论仅代表作者个人观点,不代表本站立场。若无意侵犯到您的权利,请及时与联系站长删除相关内容!

    推荐文章
      热点阅读