摘要:正則表達式關閉或可選標志。如果所含正則表達式,以表示,在當前位置成功匹配時成功,否則失敗。否則指的是八進制字符碼的表達式。
正則表達式是個很牛逼的東西,不管是在javascript,還是在Python web開發(http://www.maiziedu.com/course/python-px...)中,我們都會遇到正則表達式,雖然javascript和Python的正則表達式區別不大,但是正則表達式是Python中必不可少的一部分,所以今天就跟大家一起討論一下python中的re模塊。
re模塊包含對正則表達式的支持。
什么是正則:
正則表達式是可以匹配文本片段的模式。
正則表達式’Python’可以匹配’python’
通配符
.表示匹配任何字符:
‘.ython’可以匹配’python’和’fython’
對特殊字符進行轉義:
‘python.org’匹配‘python.org’
字符集
‘[pj]ython’能夠匹配’python’和’jython’
反轉字符集
‘1’可以匹配除了abc之外的任何字符
選擇符
使用管道符號|
可選項
加上問好就變為了可選項:
r’(http://)?(www.)?python.org‘只能匹配下面幾種:
"http://www.python.org"
"http://python.org"
"www.python.org"
"python.org"
重復子模式
*:允許模式重復0次或多次
+:允許模式重復1次或多次
{m, n}允許模式重復m-n次
當然,正則語法規則很多,遠不止上面的這些。但是我們只能點到為止了,因為這篇博客的目的是介紹Python中的模塊,re模塊。
re 模塊使 Python 語言擁有全部的正則表達式功能。
compile 函數根據一個模式字符串和可選的標志參數生成一個正則表達式對象。該對象擁有一系列方法用于正則表達式匹配和替換。
re 模塊也提供了與這些方法功能完全一致的函數,這些函數使用一個模式字符串做為它們的第一個參數。
re中重要的函數:
compile(pattern[, flags]) 根據包含正則表達式的字符串創建模式對象
search(pattern, string[, flags]) 在字符串中尋找模式
match(pattern, string[, flags]) 在字符串的開始處匹配模式split(pattern, string[, maxsplit=0]) 根據匹配項分割字符串
findall(pattern, string) 列出字符串中模式的所有匹配項sub(pat, rep, string[, count=0]) 字符串中所有pat的匹配項用repl替換
escape(string) 將字符串中所有特殊表達式字符轉義
下面就進行簡單的應用:
使用match
import re
print(re.match("www", "www.runoob.com").span()) # 在起始位置匹配
print(re.match("com", "www.runoob.com")) # 不在起始位置匹配
使用search
import reprint(re.search("www", "www.runoob.com").span()) # 在起始位置匹配print(re.search("com", "www.runoob.com").span()) # 不在起始位置匹配
這時候需要停一下,match和search的區別呢?
看看結果先:
match例子中結果:
(0, 3)None
search例子中結果:
(0, 3)
(11, 14)
match()函數只檢測RE是不是在string的開始位置匹配,search()會掃描整個string查找匹配;
也就是說match()只有在0位置匹配成功的話才有返回,如果不是開始位置匹配成功的話,match()就返回none。
search()會掃描整個字符串并返回第一個成功的匹配。
使用sub
Python 的re模塊提供了re.sub用于替換字符串中的匹配項。
phone = "2004-959-559 # This is Phone Number"
Delete Python-style commentsnum = re.sub(r"#.*$", "", phone)print "Phone Num : ", num
Remove anything other than digitsnum = re.sub(r"D", "", phone) print "Phone Num : ", num
結果:
Phone Num : 2004-959-559
Phone Num : 2004959559
最后獻上菊花:
^ 匹配字符串的開頭
$ 匹配字符串的末尾。
. 匹配任意字符,除了換行符,當re.DOTALL標記被指定時,則可以匹配包括換行符的任意字符。
[...] 用來表示一組字符,多帶帶列出:[amk] 匹配 "a","m"或"k"
2 不在[]中的字符:1 匹配除了a,b,c之外的字符。
re* 匹配0個或多個的表達式。
re+ 匹配1個或多個的表達式。
re? 匹配0個或1個由前面的正則表達式定義的片段,非貪婪方式
re{ n}
re{ n,} 精確匹配n個前面表達式。
re{ n, m} 匹配 n 到 m 次由前面的正則表達式定義的片段,貪婪方式
a| b 匹配a或b
(re) G匹配括號內的表達式,也表示一個組
(?imx) 正則表達式包含三種可選標志:i, m, 或 x 。只影響括號中的區域。
(?-imx) 正則表達式關閉 i, m, 或 x 可選標志。只影響括號中的區域。
(?: re) 類似 (...), 但是不表示一個組
(?imx: re) 在括號中使用i, m, 或 x 可選標志
(?-imx: re) 在括號中不使用i, m, 或 x 可選標志
(?#...) 注釋.
(?= re) 前向肯定界定符。如果所含正則表達式,以 ... 表示,在當前位置成功匹配時成功,否則失敗。但一旦所含表達式已經嘗試,匹配引擎根本沒有提高;模式的剩余部分還要嘗試界定符的右邊。
(?! re) 前向否定界定符。與肯定界定符相反;當所含表達式不能在字符串當前位置匹配時成功
(?> re) 匹配的獨立模式,省去回溯。
w 匹配字母數字
W 匹配非字母數字
s 匹配任意空白字符,等價于 [
f].
S 匹配任意非空字符
d 匹配任意數字,等價于 [0-9].
D 匹配任意非數字
A 匹配字符串開始
匹配字符串結束,如果是存在換行,只匹配到換行前的結束字符串。c
z 匹配字符串結束
G 匹配最后匹配完成的位置。
匹配一個單詞邊界,也就是指單詞和空格間的位置。例如, "er" 可以匹配"never" 中的 "er",但不能匹配 "verb" 中的 "er"。
B 匹配非單詞邊界。"erB" 能匹配 "verb" 中的 "er",但不能匹配 "never" 中的 "er"。
, , 等. 匹配一個換行符。匹配一個制表符。等
1...9 匹配第n個分組的子表達式。
10 匹配第n個分組的子表達式,如果它經匹配。否則指的是八進制字符碼的表達式。
以上就是對python正則表達式基礎語法及re模塊的詳解內容,希望能幫助到大家。
abc ?
... ?
文章版權歸作者所有,未經允許請勿轉載,若此文章存在違規行為,您可以聯系管理員刪除。
轉載請注明本文地址:http://m.specialneedsforspecialkids.com/yun/37835.html
摘要:反斜杠的困擾與大多數編程語言相同,正則表達式里使用作為轉義字符,這就可能造成反斜杠困擾。文本中正則表達式結束搜索的索引。以元組形式返回全部分組截獲的字符串。用于指定最大分割次數,不指定將全部分割。 1. 正則表達式基礎 1.1. 簡單介紹 正則表達式并不是Python的一部分。正則表達式是用于處理字符串的強大工具,擁有自己獨特的語法以及一個獨立的處理引擎,效率上可能不如str自帶的方法...
摘要:準備工作初探,這個文章屬于自己的一個總結。所以教程面向新手,無技術含量。凡是報錯信息看到,就是表示縮進不一致。注由于原網址不方便公布,代碼中的網址全部替換為了。 準備工作 初探python,這個文章屬于自己的一個總結。所以教程面向新手,無技術含量。python環境Linux基本都有,Windows下官網也提供了便利的安裝包,怎么安裝配置網上有很多教程在此就不一一說明。我使用的pytho...
摘要:標記一個子表達式的開始和結束位置。用和進行搜索和替換二者幾乎是一樣的,都是將某字符串中所有匹配正則表達式模式的部分進行替換。 【未完成初稿】這周在工作中遇到很多需要從一段字符中增刪查改的工作,第一遍用自己寫的腳本去做,結果是可重用性不高,而且效率也不太好。其中也用到了python中的正則表達式部分re,后來就想能不能將我遇到的這類問題全部用正則去解決,具體就是python的re模塊。答...
摘要:今天來給大家分享一份關于比較詳細的正則表達式寶典,學會之后你將對正則表達式達到精通的狀態。正則表達式是用在方法當中,大多數的字符串檢索都可以通過來完成。導入模塊在使用正則表達式之前,需要導入模塊。 ...
摘要:今天就專門看看正則表達式。下面是一個正則表達式最簡單的使用例子。這個例子使用了正則表達式模塊的函數,它會返回所有符合模式的列表。查詢標志讓正則表達式具有不同的行為。,按給定正則表達式分割字符串。,正則表達式中捕獲組的數量。 最近研究Python爬蟲,很多地方用到了正則表達式,但是沒好好研究,每次都得現查文檔。今天就專門看看Python正則表達式。本文參考了官方文檔 re模塊。 模式 首...
閱讀 2226·2021-09-30 09:47
閱讀 989·2021-08-27 13:01
閱讀 2973·2019-08-30 15:54
閱讀 3696·2019-08-30 15:53
閱讀 837·2019-08-29 14:07
閱讀 726·2019-08-28 18:16
閱讀 813·2019-08-26 18:37
閱讀 1420·2019-08-26 13:27