您好,登錄后才能下訂單哦!
什么是Python 多行匹配模式?很多新手對此不是很清楚,為了幫助大家解決這個難題,下面小編將為大家詳細講解,有這方面需求的人可以來學習下,希望你能有所收獲。
問題
你正在試著使用正則表達式去匹配一大塊的文本,而你需要跨越多行去匹配。
解決方案
這個問題很典型的出現在當你用點(.)去匹配任意字符的時候,忘記了點(.)不能匹配換行符的事實。比如,假設你想試著去匹配C語言分割的注釋:
>>> comment = re.compile(r'/\*(.*?)\*/')
>>> text1 = '/* this is a comment */'
>>> text2 = '''/* this is a
... multiline comment */
... '''
>>>
>>> comment.findall(text1)
[' this is a comment ']
>>> comment.findall(text2)
[]
>>>
為了修正這個問題,你可以修改模式字符串,增加對換行的支持。比如:
>>> comment = re.compile(r'/\*((?:.|\n)*?)\*/')
>>> comment.findall(text2)
[' this is a\n multiline comment ']
>>>
在這個模式中,(?:.|\n) 指定了一個非捕獲組(也就是它定義了一個僅僅用來做匹配,而不能通過單獨捕獲或者編號的組)。
討論
re.compile()
函數接受一個標志參數叫 re.DOTALL
,在這里非常有用。它可以讓正則表達式中的.匹配包括換行符在內的任意字符。比如:
>>> comment = re.compile(r'/\*(.*?)\*/', re.DOTALL)
>>> comment.findall(text2)
[' this is a\n multiline comment ']
對于簡單的情況使用 re.DOTALL
標記參數工作的很好,但是如果模式非常復雜或者是為了構造字符串令牌而將多個模式合并起來(2.18節有詳細描述),這時候使用這個標記參數就可能出現一些問題。如果讓你選擇的話,最好還是定義自己的正則表達式模式,這樣它可以在不需要額外的標記參數下也能工作的很好。
看完上述內容是否對您有幫助呢?如果還想對相關知識有進一步的了解或閱讀更多相關文章,請關注億速云行業資訊頻道,感謝您對億速云的支持。
免責聲明:本站發布的內容(圖片、視頻和文字)以原創、轉載和分享為主,文章觀點不代表本網站立場,如果涉及侵權請聯系站長郵箱:is@yisu.com進行舉報,并提供相關證據,一經查實,將立刻刪除涉嫌侵權內容。