mysql中REGEXP正則表達式使用

原創

_海豚湾_

2020-02-22 04:19

MySQL採用Henry Spencer的正則表達式實施，其目標是符合POSIX 1003.2。MySQL採用了擴展的版本，以支持在SQL語句中與REGEXP操作符一起使用的模式匹配操作。

正則表達式描述了一組字符串。最簡單的正則表達式是不含任何特殊字符的正則表達式。例如，正則表達式hello匹配hello。

非平凡的正則表達式採用了特殊的特定結構，從而使得它們能夠與1個以上的字符串匹配。例如，正則表達式hello|word匹配字符串hello或字符串word。

作爲一個更爲複雜的示例，正則表達式B[an]*s匹配下述字符串中的任何一個：Bananas，Baaaaas，Bs，以及以B開始、以s結束、並在其中包含任意數目a或n字符的任何其他字符串。

以下是可用於隨REGEXP操作符的表的模式：

模式	什麼模式匹配
^	字符串的開始
$	字符串的結尾
.	任何單個字符
[. . . ]	在方括號內的字符列表
[^ . . . ]	非列在方括號內的任何字符
p1 \| p2 \| p3	交替匹配任何模式p1，p2或p3
*	零個或多個前面的元素
+	前面的元素的一個或多個實例
{n}	前面的元素的n個實例
{m , n}	m到n個實例前面的元素

應用示例，查找用戶表中Email格式錯誤的用戶記錄：

SELECT * 
FROM users
WHERE email NOT REGEXP '^[A-Z0-9._%-]+@[A-Z0-9.-]+.[A-Z]{2,4}$'

MySQL數據庫中正則表達式的語法，主要包括各種符號的含義。

（^）字符

匹配字符串的開始位置，如“^a”表示以字母a開頭的字符串。

select 'xxxyyy' regexp '^xx';

查詢xxxyyy字符串中是否以xx開頭，結果值爲1，表示值爲true，滿足條件。

（$）字符

匹配字符串的結束位置，如“X$”表示以字母X結尾的字符串。

（.）字符

這個字符就是英文下的點，它匹配任何一個字符，包括回車、換行等。

（*）字符

星號匹配0個或多個字符，在它之前必須有內容。如：

select 'xxxyyy' regexp 'x*';

這個SQL語句，正則匹配爲true。

（+）字符

加號匹配1個或多個字符，在它之前也必須有內容。加號跟星號的用法類似，只是星號允許出現0次，加號則必須至少出現一次。

（?）字符

問號匹配0次或1次。

實例:

現在根據上面的表，可以裝置各種不同類型的SQL查詢以滿足要求。在這裏列出一些理解。考慮我們有一個表爲personl和有一個字段名爲name：

查詢找到所有的名字以'zh'開頭

SELECT name FROM person WHERE name REGEXP '^zh';

查詢找到所有的名字以'mm'結尾

SELECT name FROM person WHERE name REGEXP 'mm$';

查詢找到所有的名字包函'marin'的字符串

SELECT name FROM person WHERE name REGEXP 'marin';

查詢找到所有名稱以元音開始和'end'結束的

SELECT name FROM person_tbl WHERE name REGEXP '^[aeiou]|end$';

一個正則表達式中的可以使用以下保留字

所匹配的字符串以後面的字符串開頭

select "fonfo" REGEXP "^fo$"; -> 0（表示不匹配）

select "fofo" REGEXP "^fo"; -> 1（表示匹配）

所匹配的字符串以前面的字符串結尾

select "fono" REGEXP "^fono$"; -> 1（表示匹配）

select "fono" REGEXP "^fo$"; -> 0（表示不匹配）

匹配任何字符（包括新行）

select "fofo" REGEXP "^f.*"; -> 1（表示匹配）

select "fonfo" REGEXP "^f.*"; -> 1（表示匹配）

匹配任意多個a（包括空串)

select "Ban" REGEXP "^Ba*n"; -> 1（表示匹配）

select "Baaan" REGEXP "^Ba*n"; -> 1（表示匹配）

select "Bn" REGEXP "^Ba*n"; -> 1（表示匹配）

匹配任意多個a（不包括空串)

select "Ban" REGEXP "^Ba+n"; -> 1（表示匹配）

select "Bn" REGEXP "^Ba+n"; -> 0（表示不匹配）

匹配一個或零個a

select "Bn" REGEXP "^Ba?n"; -> 1（表示匹配）

select "Ban" REGEXP "^Ba?n"; -> 1（表示匹配）

select "Baan" REGEXP "^Ba?n"; -> 0（表示不匹配）

de|abc

匹配de或abc

select "pi" REGEXP "pi|apa"; -> 1（表示匹配）

select "axe" REGEXP "pi|apa"; -> 0（表示不匹配）

select "apa" REGEXP "pi|apa"; -> 1（表示匹配）

select "apa" REGEXP "^(pi|apa)$"; -> 1（表示匹配）

select "pi" REGEXP "^(pi|apa)$"; -> 1（表示匹配）

select "pix" REGEXP "^(pi|apa)$"; -> 0（表示不匹配）

(abc)*

匹配任意多個abc（包括空串)

select "pi" REGEXP "^(pi)*$"; -> 1（表示匹配）

select "pip" REGEXP "^(pi)*$"; -> 0（表示不匹配）

select "pipi" REGEXP "^(pi)*$"; -> 1（表示匹配）

{1}
{2,3}

這是一個更全面的方法，它可以實現前面好幾種保留字的功能

可以寫成a{0,}

可以寫成a{1,}

可以寫成a{0,1}

在{}內只有一個整型參數i，表示字符只能出現i次；在{}內有一個整型參數i，後面跟一個“，”，表示字符可以出現i次或i次以上；在{}內只有一個整型參數i，後面跟一個“，”，再跟一個整型參數j,表示字符只能出現i次以上，j次以下（包括i次和j次）。其中的整型參數必須大於等於0，小於等於 RE_DUP_MAX（默認是255）。如果有兩個參數，第二個必須大於等於第一個

a[a-dX]

匹配“a”、“b”、“c”、“d”或“X”

[^a-dX]

匹配除“a”、“b”、“c”、“d”、“X”以外的任何字符。

“[”、“]”必須成對使用

select "aXbc" REGEXP "[a-dXYZ]"; -> 1（表示匹配） 
select "aXbc" REGEXP "^[a-dXYZ]$"; -> 0（表示不匹配） 
select "aXbc" REGEXP "^[a-dXYZ]+$"; -> 1（表示匹配） 
select "aXbc" REGEXP "^[^a-dXYZ]+$"; -> 0（表示不匹配） 
select "gheis" REGEXP "^[^a-dXYZ]+$"; -> 1（表示匹配） 
select "gheisa" REGEXP "^[^a-dXYZ]+$"; -> 0（表示不匹配）