正規表示式基礎概念

特殊字元

所謂特殊字元，就是一些有特殊含義的字元，如上面說的"*.txt"中的*，簡單的說就是表示任何字串的意思。如果要查詢檔案名中有＊的檔案，則需要對＊進行轉義，即在其前加乙個\。ls \*.txt。正規表示式有以下特殊字元。

特別字元說明$

匹配輸入字串的結尾位置。如果設定了 regexp 物件的 multiline 屬性，則 $ 也匹配 '\n' 或 '\r'。要匹配 $ 字元本身，請使用 \$。

( )標記乙個子表示式的開始和結束位置。子表示式可以獲取供以後使用。要匹配這些字元，請使用 $ 和 $。

*匹配前面的子表示式零次或多次。要匹配 * 字元，請使用 \*。

+匹配前面的子表示式一次或多次。要匹配 + 字元，請使用 \+。

.匹配除換行符 \n之外的任何單字元。要匹配 .，請使用 \。

[標記乙個中括號表示式的開始。要匹配 [，請使用 \[。

?匹配前面的子表示式零次或一次，或指明乙個非貪婪限定符。要匹配 ? 字元，請使用 \?。

\將下乙個字元標記為或特殊字元、或原義字元、或向後引用、或八進位制轉義符。例如， 'n' 匹配字元 'n'。'\n' 匹配換行符。序列 '\\' 匹配 "\"，而 '\(' 則匹配 "("。

^匹配輸入字串的開始位置，除非在方括號表示式中使用，此時它表示不接受該字元集合。要匹配 ^ 字元本身，請使用 \^。

或或共6種。

*、+和?限定符都是貪婪的，因為它們會盡可能多的匹配文字，只有在它們的後面加上乙個?就可以實現非貪婪或最小匹配。

正規表示式的限定符有：

字元描述

匹配前面的子表示式零次或多次。例如，zo* 能匹配 "z" 以及 "zoo"。* 等價於。

匹配前面的子表示式一次或多次。例如，'zo+' 能匹配 "zo" 以及 "zoo"，但不能匹配 "z"。+ 等價於。

匹配前面的子表示式零次或一次。例如，"do(es)?" 可以匹配 "do" 或 "does" 中的"do" 。? 等價於。

n 是乙個非負整數。匹配確定的 n 次。例如，'o' 不能匹配 "bob" 中的 'o'，但是能匹配 "food" 中的兩個 o。

n 是乙個非負整數。至少匹配n 次。例如，'o' 不能匹配 "bob" 中的 'o'，但能匹配 "foooood" 中的所有 o。'o' 等價於 'o+'。'o' 則等價於 'o*'。

m 和 n 均為非負整數，其中n <= m。最少匹配 n 次且最多匹配 m 次。例如，"o" 將匹配 "fooooood" 中的前三個 o。'o' 等價於 'o?'。請注意在逗號和兩個數之間不能有空格。

定位符：

用來描述字串或者單詞的邊界，^和$ 分別指的是字串的開始和結束， \b 描述單詞的前或後邊界, \b表示非單詞邊界。不能對定位符使用限定符.

選擇用圓括號將所有選擇項括起來，相鄰的選擇項之間用|分隔。但用圓括號會有乙個***，是相關的匹配會被快取，此時可用?:放在第乙個選項前來消除這種***。

其中?:是非捕獲元之一，還有兩個非捕獲元是?=和?!，這兩個還有更多的含義，前者為正向預查，在任何開始匹配圓括號內的正規表示式模式的位置來匹配搜尋字串，後者為負向預查，在任何開始不匹配該正規表示式模式的位置來匹配搜尋字串。

後向引用

對乙個正規表示式模式或部分模式兩邊新增圓括號將導致相關匹配儲存到乙個臨時緩衝區中，所捕獲的每個子匹配都按照在正規表示式模式中從左至右所遇到的內容儲存。儲存子匹配的緩衝區編號從 1 開始，連續編號直至最大 99 個子表示式。每個緩衝區都可以使用 '\n' 訪問，其中 n 為乙個標識特定緩衝區的一位或兩位十進位制數。

可以使用非捕獲元字元 '?:', '?=', or '?!' 來忽略對相關匹配的儲存。

正規表示式 基礎概念

正規表示式 1 正規表示式基礎

正規表示式基礎

正規表示式基礎

相關推薦

正規表示式基礎概念