re模块用于对python的正则表达式的操作。


字符:


  . 匹配除换行符以外的任意字符
  \w 匹配字母或数字或下划线或汉字
  \s 匹配任意的空白符
  \d 匹配数字
  \b 匹配单词的开始或结束
  ^ 匹配字符串的开始
  $ 匹配字符串的结束


次数:


  * 重复零次或更多次
  + 重复一次或更多次
  ? 重复零次或一次
  {n} 重复n次
  {n,} 重复n次或更多次
  {n,m} 重复n到m次

   

、match(pattern, string, flags=0)

从起始位置开始根据模型去字符串中匹配指定内容,匹配单个

  • 正则表达式
  • 要匹配的字符串
  • 标志位,用于控制正则表达式的匹配方式
import re

obj = re.match('\d+', '123uuasf')
if obj:
    print obj.group()
 flags

2、search(pattern, string, flags=0)

根据模型去字符串中匹配指定内容,匹配单个

import re

obj = re.search('\d+', 'u123uu888asf')
if obj:
    print obj.group()

3、group和groups

复制代码
a = "123abc456"
print re.search("([0-9]*)([a-z]*)([0-9]*)", a).group()

print re.search("([0-9]*)([a-z]*)([0-9]*)", a).group(0)
print re.search("([0-9]*)([a-z]*)([0-9]*)", a).group(1)
print re.search("([0-9]*)([a-z]*)([0-9]*)", a).group(2)

print re.search("([0-9]*)([a-z]*)([0-9]*)", a).groups()
复制代码

4、findall(pattern, string, flags=0)

上述两中方式均用于匹配单值,即:只能匹配字符串中的一个,如果想要匹配到字符串中所有符合条件的元素,则需要使用 findall。

import re

obj = re.findall('\d+', 'fa123uu888asf')
print obj

5、sub(pattern, repl, string, count=0, flags=0)

用于替换匹配的字符串

content = "123abc456"
new_content = re.sub('\d+', 'sb', content)
# new_content = re.sub('\d+', 'sb', content, 1)
print new_content

相比于str.replace功能更加强大

6、split(pattern, string, maxsplit=0, flags=0)

根据指定匹配进行分组

content = "'1 - 2 * ((60-30+1*(9-2*5/3+7/3*99/4*2998+10*568/14))-(-4*3)/(16-3*2) )'"
new_content = re.split('\*', content)
# new_content = re.split('\*', content, 1)
print new_content
content = "'1 - 2 * ((60-30+1*(9-2*5/3+7/3*99/4*2998+10*568/14))-(-4*3)/(16-3*2) )'"
new_content = re.split('[\+\-\*\/]+', content)
# new_content = re.split('\*', content, 1)
print new_content
inpp = '1-2*((60-30 +(-40-5)*(9-2*5/3 + 7 /3*99/4*2998 +10 * 568/14 )) - (-4*3)/ (16-3*2))'
inpp = re.sub('\s*','',inpp)
new_content = re.split('\(([\+\-\*\/]?\d+[\+\-\*\/]?\d+){1}\)', inpp, 1)
print new_content

相比于str.split更加强大  


import re a
=re.search(r'(([01]?\d?\d|2[0-4]\d|25[0-5])\.){3}([01]?\d?\d|2[0-4]\d|25[0-5])','192.168.1.1').group() print(a)
>>> 'sdfafadfaf'.find('d')
1
>>>  'sdfafadfaf'.split('d')
SyntaxError: unexpected indent
>>> 'sdfafadfaf'.split('d')
['s', 'fafa', 'faf']
>>> import re
>>> re.findall('alex','yuanaleSxalexwupeiqi')
['alex']
>>> re.findall('alex.w','aaaalexaw')
['alexaw']
>>> 
KeyboardInterrupt
>>> re.findall('ale.x','yuanaleSxalexwupeiqi')
['aleSx']
>>> re.findall('^alex','yuanaleSxalexwiupeiqi')
[]
>>> re.findall('^alex','alexSxalexwiupeiqi')
['alex']
>>> re.findall('^alex','alexSxalexwiupalex')
['alex']
>>> re.findall('alex','alexSxalexwiupalexxxxxx')
['alex', 'alex', 'alex']
>>> re.findall('alex*','alexSxalexwiupalexxxxxx')
['alex', 'alex', 'alexxxxxx']
>>> re.findall('alex+','alexSxalexwiupalexxxxxx')
['alex', 'alex', 'alexxxxxx']
>>> re.findall('alex+','alexxxxxx')
['alexxxxxx']
>>> re.findall('alex+','exxxxxx')
[]
>>> re.findall('alex?','alexSxalexwiupalexxxxxx')
['alex', 'alex', 'alex']
>>> re.findall('alex{3-4}','alexSxalexwiupalexxxxxx')
[]
>>> re.findall('alex{3}','alexSxalexwiupalexxxxxx')
['alexxx']
>>> re.findall('alex{0}','alexSxalexwiupalexxxxxx')
['ale', 'ale', 'ale']
>>> re.findall('alex{1}','alexSxalexwiupalexxxxxx')
['alex', 'alex', 'alex']
>>> re.findall('al[xe]x','alexSxalexwiupalexxxxxx')
['alex', 'alex', 'alex']
>>> re.findall('a[bc]d','wwwwabcd')
>>> re.findall('[b-c]','wwwwabcd')
['b', 'c']
>>> re.findall('[a-d]','wwwwabcd')
['a', 'b', 'c', 'd']
>>> re.findall('^[b-c]','wwwwabcd')

 

import time
import datetime
# 时间戳
print(time.time())
# 当前年月日
print(time.ctime(time.time()-86400))
time_obj=time.gmtime(time.time()-86640)
# 字符串的格式化
print('%s-%s-%s %s:%s' %(time_obj.tm_year,time_obj.tm_mon,time_obj.tm_mday,time_obj.tm_hour,time_obj.tm_min))

 

posted on 2018-02-10 17:09  1945775622  阅读(137)  评论(0)    收藏  举报