亚洲香蕉成人av网站在线观看_欧美精品成人91久久久久久久_久久久久久久久久久亚洲_热久久视久久精品18亚洲精品_国产精自产拍久久久久久_亚洲色图国产精品_91精品国产网站_中文字幕欧美日韩精品_国产精品久久久久久亚洲调教_国产精品久久一区_性夜试看影院91社区_97在线观看视频国产_68精品久久久久久欧美_欧美精品在线观看_国产精品一区二区久久精品_欧美老女人bb

首頁 > 編程 > regex > 正文

Python正則表達式之基礎篇

2020-01-20 22:07:20
字體:
來源:轉載
供稿:網友

正則表達式是用于處理字符串的強大工具,它并不是Python的一部分。

其他編程語言中也有正則表達式的概念,區別只在于不同的編程語言實現支持的語法數量不同。

它擁有自己獨特的語法以及一個獨立的處理引擎,在提供了正則表達式的語言里,正則表達式的語法都是一樣的。

下圖展示了使用正則表達式進行匹配的流程:

1.1介紹

  正則表達式并不是Python的一部分。正則表達式是用于處理字符串的強大工具,擁有自己獨特的語法以及一個獨立的處理引擎,效率上可能不如str自帶的方法,但功能十分強大。得益于這一點,在提供了正則表達式的語言里,正則表達式的語法都是一樣的,區別只在于不同的編程語言實現支持的語法數量不同;但不用擔心,不被支持的語法通常是不常用的部分。

  正則表達式是一個特殊的字符序列,它能幫助你方便的檢查一個字符串是否與某種模式匹配。Python 自1.5版本起增加了re 模塊,它提供 Perl 風格的正則表達式模式。re 模塊使 Python 語言擁有全部的正則表達式功能。

1.2要知道的各種用法

 模式字符串使用特殊的語法來表示一個正則表達式:

  字母和數字表示他們自身。一個正則表達式模式中的字母和數字匹配同樣的字符串。多數字母和數字前加一個反斜杠時會擁有不同的含義。標點符號只有被轉義時才匹配自身,否則它們表示特殊的含義。反斜杠本身需要使用反斜杠轉義。

  由于正則表達式通常都包含反斜杠,所以你最好使用原始字符串來表示它們。模式元素(如 r'/t',等價于'//t')匹配相應的特殊字符。

  下表列出了正則表達式模式語法中的特殊元素。如果你使用模式的同時提供了可選的標志參數,某些模式元素的含義會改變。

  當然這些用法很多,待會會給出經常使用到的用法,多試試就能理解了。

模式

模式 描述
^ 匹配字符串的開頭
$ 匹配字符串的末尾。
. 匹配任意字符,除了換行符,當re.DOTALL標記被指定時,則可以匹配包括換行符的任意字符。
[...] 用來表示一組字符,單獨列出:[amk] 匹配 'a','m'或'k'
[^...] 不在[]中的字符:[^abc] 匹配除了a,b,c之外的字符。
re* 匹配0個或多個的表達式。
re+ 匹配1個或多個的表達式。
re? 匹配0個或1個由前面的正則表達式定義的片段,非貪婪方式
re{ n}
re{ n,} 精確匹配n個前面表達式。
re{ n, m} 匹配 n 到 m 次由前面的正則表達式定義的片段,貪婪方式
a| b 匹配a或b
(re) G匹配括號內的表達式,也表示一個組
(?imx) 正則表達式包含三種可選標志:i, m, 或 x 。只影響括號中的區域。
(?-imx) 正則表達式關閉 i, m, 或 x 可選標志。只影響括號中的區域。
(?: re) 類似 (...), 但是不表示一個組
(?imx: re) 在括號中使用i, m, 或 x 可選標志
(?-imx: re) 在括號中不使用i, m, 或 x 可選標志
(?#...) 注釋.
(?= re) 前向肯定界定符。如果所含正則表達式,以 ... 表示,在當前位置成功匹配時成功,否則失敗。但一旦所含表達式已經嘗試,匹配引擎根本沒有提高;模式的剩余部分還要嘗試界定符的右邊。
(?! re) 前向否定界定符。與肯定界定符相反;當所含表達式不能在字符串當前位置匹配時成功
(?> re) 匹配的獨立模式,省去回溯。
/w 匹配字母數字
/W 匹配非字母數字
/s 匹配任意空白字符,等價于 [/t/n/r/f].
/S 匹配任意非空字符
/d 匹配任意數字,等價于 [0-9].
/D 匹配任意非數字
/A 匹配字符串開始
/Z 匹配字符串結束,如果是存在換行,只匹配到換行前的結束字符串。c
/z 匹配字符串結束
/G 匹配最后匹配完成的位置。
/b 匹配一個單詞邊界,也就是指單詞和空格間的位置。例如, 'er/b' 可以匹配"never" 中的 'er',但不能匹配 "verb" 中的 'er'。
/B 匹配非單詞邊界。'er/B' 能匹配 "verb" 中的 'er',但不能匹配 "never" 中的 'er'。
/n, /t, 等. 匹配一個換行符。匹配一個制表符。等
/1.../9 匹配第n個分組的子表達式。
/10 匹配第n個分組的子表達式,如果它經匹配。否則指的是八進制字符碼的表達式。

字符類

實例 描述
[Pp]ython 匹配 "Python" 或 "python"
rub[ye] 匹配 "ruby" 或 "rube"
[aeiou] 匹配中括號內的任意一個字母
[0-9] 匹配任何數字。類似于 [0123456789]
[a-z] 匹配任何小寫字母
[A-Z] 匹配任何大寫字母
[a-zA-Z0-9] 匹配任何字母及數字
[^aeiou] 除了aeiou字母以外的所有字符
[^0-9] 匹配除了數字外的字符

特殊字符類

實例 描述
. 匹配除 "/n" 之外的任何單個字符。要匹配包括 '/n' 在內的任何字符,請使用象 '[./n]' 的模式。
/d 匹配一個數字字符。等價于 [0-9]。
/D 匹配一個非數字字符。等價于 [^0-9]。
/s 匹配任何空白字符,包括空格、制表符、換頁符等等。等價于 [ /f/n/r/t/v]。
/S 匹配任何非空白字符。等價于 [^ /f/n/r/t/v]。
/w 匹配包括下劃線的任何單詞字符。等價于'[A-Za-z0-9_]'。
/W 匹配任何非單詞字符。等價于 '[^A-Za-z0-9_]'。

1.3re.match函數

  re.match 嘗試從字符串的起始位置匹配一個模式,如果不是起始位置匹配成功的話,match()就返回none。

  re.match(pattern, string, flags = 0)

  pattern 正則表達式

  string 匹配的字符串

  flags 標志位,用來控制匹配方式,下文會講

  直接上程序:

import string,rer = "abc" #正則表達式if re.match(r,"abc"): #匹配print 'done' else:print 'defeat' 

結果:

  done

可以根據上面各表給出的用法,多練練:

import string,rer = "a.c" #正則表達式 . 匹配任意字符,除了換行符,當re.DOTALL標記被指定時,則可以匹配包括換行符的任意字符。if re.match(r,"abc"): print re.match(r,"abc")print 'done' else:print 'defeat' 

結果:

<_sre.SRE_Match object at 0x01dd6158>

done

  注意這里不是顯示匹配成功的字符串,re.match() 返回的是一個對象,不成功返回的是none.

  我們可以通過group(num)或groups()匹配對象函數來獲取匹配表達式。 

匹配對象方法 描述
group(num=0) 匹配的整個表達式的字符串,group() 可以一次輸入多個組號,在這種情況下它將返回一個包含那些組所對應值的元組。
groups() 返回一個包含所有小組字符串的元組,從 1 到 所含的小組號。

程序:   

 import string,re r = "a.c"  if re.match(r,"abc"):  line = re.match(r,"abc") print line.group() else: print 'defeat' 

結果:

  abc

1.3re.search函數

re.search() 掃描整個字符串并返回第一個成功的匹配

  re.search(pattern, string, flags=0)

  pattern 正則表達式

  string 匹配的字符串

  flags 標志位,用于控制匹配方式

  和re.match()一樣,匹配成功re.search方法返回一個匹配的對象,否則返回None。

  直接上程序:

import string,rer = "abc" s = 'aacawcabc'if re.search(r,s): line = re.search(r,s)print line.group() 

結果:

abc

注意:

re.match()和re.search()的區別:

  re.match只匹配字符串的開始,如果字符串開始不符合正則表達式,則匹配失敗,函數返回None;而re.search匹配整個字符串,直到找到一個匹配。

1.4re.sub函數

  re.sub()函數用于替換匹配項。

  re.sub(pattern,repl,string,max = 0)

  pattern 正則表達式

  repl 替換 項

  string 匹配的字符串

  count 替換的最大次數 缺省值是0 表示替換所有的匹配

  返回的字符串是在字符串中用 RE 最左邊不重復的匹配來替換。如果模式沒有發現,字符將被沒有改變地返回。

  程序:

import string,repattern = '/d' repl = "!" s = 'abcdefg' line = re.sub(pattern,repl,s)print line 

結果:

!!!!!!!!!abcdefg

1.5正則表達式修飾符 - 可選標志

我們來說說什么是標志位:

正則表達式可以包含一些可選標志修飾符來控制匹配的模式。修飾符被指定為一個可選的標志。多個標志可以通過按位 OR(|) 它們來指定。如 re.I | re.M 被設置成 I 和 M 標志:

修飾符 描述
re.I 使匹配對大小寫不敏感
re.L 做本地化識別(locale-aware)匹配
re.M 多行匹配,影響 ^ 和 $
re.S 使 . 匹配包括換行在內的所有字符
re.U 根據Unicode字符集解析字符。這個標志影響 /w, /W, /b, /B.
re.X 該標志通過給予你更靈活的格式以便你將正則表達式寫得更易于理解。

程序: 

import string,repattern = '[Aa][Bb][Cc][Dd]' s = 'AbCd' if re.match(pattern,s):line = re.match(pattern,s)print line.group() 

結果:

AbCd

上面程序可以通過選擇標志位來實現:

import string,repattern = 'abcd' s = 'AbCd' if re.match(pattern,s,re.I):line = re.match(pattern,s,re.I)print line.group() 

結果;

AbCd

1.6re.compile函數

  使用re的一般步驟是先使用re.compile()函數,將正則表達式的字符串形式編譯為Pattern實例,然后使用Pattern實例處理文本并獲得匹配結果(一個Match實例),最后使用Match實例獲得信息,進行其他的操作。

程序:

import string,repattern = re.compile('/d+') s = 'aabbccdd' if pattern.match(s):line = pattern.match(s)print line.group()

結果:

11223344

發表評論 共有條評論
用戶名: 密碼:
驗證碼: 匿名發表
亚洲香蕉成人av网站在线观看_欧美精品成人91久久久久久久_久久久久久久久久久亚洲_热久久视久久精品18亚洲精品_国产精自产拍久久久久久_亚洲色图国产精品_91精品国产网站_中文字幕欧美日韩精品_国产精品久久久久久亚洲调教_国产精品久久一区_性夜试看影院91社区_97在线观看视频国产_68精品久久久久久欧美_欧美精品在线观看_国产精品一区二区久久精品_欧美老女人bb
欧美日韩精品中文字幕| 国产成人精品一区| 欧美高清一级大片| 欧美成人黑人xx视频免费观看| 亚洲精品一区二区三区不| 国内外成人免费激情在线视频| 精品欧美激情精品一区| 亚洲国产精品va在线观看黑人| 色婷婷亚洲mv天堂mv在影片| 欧美日韩成人网| 日韩在线高清视频| 中文字幕亚洲一区二区三区| 亚洲香蕉av在线一区二区三区| 欧美极品少妇全裸体| 中文字幕久久久av一区| www.亚洲成人| 欧美乱人伦中文字幕在线| 久久精品视频中文字幕| 欧美专区中文字幕| 欧美激情视频在线免费观看 欧美视频免费一| 日本人成精品视频在线| 欧美午夜久久久| 欧美成人精品激情在线观看| 日韩精品极品视频| 欧美黑人狂野猛交老妇| 中文字幕亚洲欧美一区二区三区| 国产视频精品久久久| 久久福利视频导航| 亚洲欧美精品一区二区| 亚洲精品欧美一区二区三区| 国产精品久久网| 国产精品高潮呻吟久久av无限| 日韩av在线影院| 国产精品啪视频| 国产精品视频公开费视频| 国产成人一区二区在线| 欧美大片在线免费观看| 懂色av中文一区二区三区天美| 久久精品久久精品亚洲人| 欧美在线精品免播放器视频| 亚洲尤物视频网| 国产精品久久久av久久久| 国产视频精品免费播放| 久久久久九九九九| 欧美日韩视频免费播放| 久久久久国色av免费观看性色| 日本不卡视频在线播放| 久久伊人免费视频| 一区二区三区无码高清视频| 欧美日韩一区二区精品| 欧美夫妻性视频| 精品毛片网大全| 韩国精品美女www爽爽爽视频| 国产精品海角社区在线观看| 午夜精品一区二区三区在线播放| 日韩有码在线播放| 这里只有精品视频| www.久久草.com| 欧美丰满少妇xxxxx| 欧美激情欧美狂野欧美精品| 久久精品人人做人人爽| 国产精品视频1区| 夜夜嗨av一区二区三区免费区| 成人免费在线视频网站| 久久综合免费视频| 亚洲欧美综合区自拍另类| 国产噜噜噜噜久久久久久久久| 久久精品视频在线观看| 国产一区二区欧美日韩| 欧美极品美女视频网站在线观看免费| 2019国产精品自在线拍国产不卡| 日韩欧美在线视频日韩欧美在线视频| 国产午夜精品视频| 日韩一区二区久久久| 日韩精品免费在线| 久久人91精品久久久久久不卡| 久久久久久久影院| 日韩电影大片中文字幕| 欧美制服第一页| 亚洲视频一区二区三区| 欧美自拍大量在线观看| 国产成人av在线| 国产日产久久高清欧美一区| 日韩av影院在线观看| 亚洲福利视频二区| 国产精品第三页| 亚洲国产精品久久久久久| 国产精品观看在线亚洲人成网| 日韩一中文字幕| 精品女同一区二区三区在线播放| 国内精品国产三级国产在线专| 欧美成人精品在线观看| 久久久国产精品亚洲一区| 超在线视频97| 亚洲一区二区三区xxx视频| 亚洲精品一区久久久久久| 久久香蕉国产线看观看网| 亚洲国产免费av| 国产精品高潮在线| 欧洲s码亚洲m码精品一区| 欧美视频中文在线看| 国产一区红桃视频| 91精品久久久久久久久不口人| 91成人精品网站| 欧美日韩中文在线观看| 欧美午夜激情视频| 欧美成人一二三| 大伊人狠狠躁夜夜躁av一区| 色偷偷av亚洲男人的天堂| 国产精品aaaa| 日韩视频在线一区| 中文字幕精品在线| 国产精品欧美一区二区三区奶水| 亚洲图片欧美午夜| 国产色视频一区| 欧美色xxxx| 久久九九有精品国产23| 91影视免费在线观看| 在线观看91久久久久久| 韩剧1988免费观看全集| 国产成人精品国内自产拍免费看| 91精品国产沙发| 日韩欧美在线中文字幕| 奇米4444一区二区三区| 国产精品嫩草影院久久久| 日韩风俗一区 二区| 亚洲天堂开心观看| 国内精品小视频在线观看| 久久精品影视伊人网| 亚洲丁香久久久| 国产99久久精品一区二区永久免费| 国产精品扒开腿做爽爽爽男男| 日韩精品视频在线观看网址| 日韩精品免费观看| 精品欧美激情精品一区| 精品成人国产在线观看男人呻吟| 91精品视频一区| 午夜精品久久久久久久男人的天堂| 中文字幕欧美精品日韩中文字幕| 亚洲欧美国产精品久久久久久久| 国产成人精品久久二区二区91| 久久精品影视伊人网| 午夜精品久久久久久99热软件| 国产欧美在线看| 亚洲国产欧美精品| 久久久久久高潮国产精品视| 中文字幕亚洲综合久久| 国产精品视频资源| 国产精品一区二区久久久久| 欧美午夜美女看片| 97色在线视频| 91免费精品国偷自产在线| 欧美激情中文字幕在线| 91在线视频精品| 欧美性在线视频| 欧美日韩性视频| 中文字幕日韩电影| 日本成人精品在线| 亚洲欧美中文字幕在线一区| 久久精品久久久久电影| www.久久草.com| 欧美激情亚洲自拍| 欧美日韩国产成人在线观看| 韩国欧美亚洲国产|