mysql中REGEXP正則表達式使用

MySQL採用Henry Spencer的正則表達式實施,其目標是符合POSIX 1003.2。MySQL採用了擴展的版本,以支持在SQL語句中與REGEXP操作符一起使用的模式匹配操作。

正則表達式描述了一組字符串。最簡單的正則表達式是不含任何特殊字符的正則表達式。例如,正則表達式hello匹配hello。

非平凡的正則表達式採用了特殊的特定結構,從而使得它們能夠與1個以上的字符串匹配。例如,正則表達式hello|word匹配字符串hello或字符串word。

作爲一個更爲複雜的示例,正則表達式B[an]*s匹配下述字符串中的任何一個:Bananas,Baaaaas,Bs,以及以B開始、以s結束、並在其中包含任意數目a或n字符的任何其他字符串。

以下是可用於隨REGEXP操作符的表的模式:

模式 什麼模式匹配
^ 字符串的開始
$ 字符串的結尾
. 任何單個字符
[. . . ] 在方括號內的字符列表
[^ . . . ] 非列在方括號內的任何字符
p1 | p2 | p3 交替匹配任何模式p1,p2或p3
* 零個或多個前面的元素
+ 前面的元素的一個或多個實例
{n} 前面的元素的n個實例
{m , n} m到n個實例前面的元素


應用示例,查找用戶表中Email格式錯誤的用戶記錄:

SELECT * 
FROM users
WHERE email NOT REGEXP '^[A-Z0-9._%-]+@[A-Z0-9.-]+.[A-Z]{2,4}$'
MySQL數據庫中正則表達式的語法,主要包括各種符號的含義。

(^)字符

匹配字符串的開始位置,如“^a”表示以字母a開頭的字符串。

select 'xxxyyy' regexp '^xx';

查詢xxxyyy字符串中是否以xx開頭,結果值爲1,表示值爲true,滿足條件。

($)字符

匹配字符串的結束位置,如“X$”表示以字母X結尾的字符串。

(.)字符

這個字符就是英文下的點,它匹配任何一個字符,包括回車、換行等。

(*)字符

星號匹配0個或多個字符,在它之前必須有內容。如:

select 'xxxyyy' regexp 'x*';

這個SQL語句,正則匹配爲true。

(+)字符

加號匹配1個或多個字符,在它之前也必須有內容。加號跟星號的用法類似,只是星號允許出現0次,加號則必須至少出現一次。

(?)字符

問號匹配0次或1次。

實例:

現在根據上面的表,可以裝置各種不同類型的SQL查詢以滿足要求。在這裏列出一些理解。考慮我們有一個表爲personl和有一個字段名爲name:

查詢找到所有的名字以'zh'開頭

SELECT name FROM person WHERE name REGEXP '^zh';
查詢找到所有的名字以'mm'結尾

SELECT name FROM person WHERE name REGEXP 'mm$';

查詢找到所有的名字包函'marin'的字符串

SELECT name FROM person WHERE name REGEXP 'marin';
查詢找到所有名稱以元音開始和'end'結束 的

SELECT name FROM person_tbl WHERE name REGEXP '^[aeiou]|end$';


一個正則表達式中的可以使用以下保留字 

^

所匹配的字符串以後面的字符串開頭

select "fonfo" REGEXP "^fo$"; -> 0(表示不匹配)
select "fofo" REGEXP "^fo"; -> 1(表示匹配)

$

所匹配的字符串以前面的字符串結尾

select "fono" REGEXP "^fono$"; -> 1(表示匹配)
select "fono" REGEXP "^fo$"; -> 0(表示不匹配)

.

匹配任何字符(包括新行)

select "fofo" REGEXP "^f.*"; -> 1(表示匹配)
select "fonfo" REGEXP "^f.*"; -> 1(表示匹配)

a*

匹配任意多個a(包括空串)

select "Ban" REGEXP "^Ba*n"; -> 1(表示匹配)
select "Baaan" REGEXP "^Ba*n"; -> 1(表示匹配)
select "Bn" REGEXP "^Ba*n"; -> 1(表示匹配)

a+

匹配任意多個a(不包括空串)

select "Ban" REGEXP "^Ba+n"; -> 1(表示匹配)
select "Bn" REGEXP "^Ba+n"; -> 0(表示不匹配)

a?

匹配一個或零個a

select "Bn" REGEXP "^Ba?n"; -> 1(表示匹配)
select "Ban" REGEXP "^Ba?n"; -> 1(表示匹配)
select "Baan" REGEXP "^Ba?n"; -> 0(表示不匹配)

de|abc

匹配de或abc

select "pi" REGEXP "pi|apa"; -> 1(表示匹配)
select "axe" REGEXP "pi|apa"; -> 0(表示不匹配)
select "apa" REGEXP "pi|apa"; -> 1(表示匹配)
select "apa" REGEXP "^(pi|apa)$"; -> 1(表示匹配)
select "pi" REGEXP "^(pi|apa)$"; -> 1(表示匹配) 
select "pix" REGEXP "^(pi|apa)$"; -> 0(表示不匹配)

(abc)*

匹配任意多個abc(包括空串)

select "pi" REGEXP "^(pi)*$"; -> 1(表示匹配) 
select "pip" REGEXP "^(pi)*$"; -> 0(表示不匹配)
select "pipi" REGEXP "^(pi)*$"; -> 1(表示匹配)

{1} 
{2,3}

這是一個更全面的方法,它可以實現前面好幾種保留字的功能

a*

可以寫成a{0,}

a+

可以寫成a{1,}

a?

可以寫成a{0,1}

在{}內只有一個整型參數i,表示字符只能出現i次;在{}內有一個整型參數i,後面跟一個“,”,表示字符可以出現i次或i次以上;在{}內只有一個整型參數i,後面跟一個“,”,再跟一個整型參數j,表示字符只能出現i次以上,j次以下(包括i次和j次)。其中的整型參數必須大於等於0,小於等於 RE_DUP_MAX(默認是255)。 如果有兩個參數,第二個必須大於等於第一個

a[a-dX]

匹配“a”、“b”、“c”、“d”或“X”

[^a-dX]

匹配除“a”、“b”、“c”、“d”、“X”以外的任何字符。

“[”、“]”必須成對使用

select "aXbc" REGEXP "[a-dXYZ]"; -> 1(表示匹配) 
select "aXbc" REGEXP "^[a-dXYZ]$"; -> 0(表示不匹配) 
select "aXbc" REGEXP "^[a-dXYZ]+$"; -> 1(表示匹配) 
select "aXbc" REGEXP "^[^a-dXYZ]+$"; -> 0(表示不匹配) 
select "gheis" REGEXP "^[^a-dXYZ]+$"; -> 1(表示匹配) 
select "gheisa" REGEXP "^[^a-dXYZ]+$"; -> 0(表示不匹配)
















































發佈了29 篇原創文章 · 獲贊 20 · 訪問量 18萬+
發表評論
所有評論
還沒有人評論,想成為第一個評論的人麼? 請在上方評論欄輸入並且點擊發布.
相關文章