正則表達式——學習

.  [ ]   ^  $

上述四個字符是所有語言都支持的正則表達式,所以這四個是基礎的正則表達式。正則難理解因爲裏面有一個等價的概念,這個概念大大增加了理解難度,讓很多初學者看起來會懵,如果把等價都恢復成原始寫法,自己書寫正則就超級簡單了,就像說話一樣去寫你的正則了:


等價:

等價是等同於的意思,表示同樣的功能,用不同符號來書寫。

?,*,+,\d,\w 都是等價字符
?等價於匹配長度{0,1}
*等價於匹配長度{0,} 
+等價於匹配長度{1,}
\d等價於[0-9]

\D等價於[^0-9]
\w等價於[A-Za-z_0-9]

\W等價於[^A-Za-z_0-9]。

常用運算符與表達式:
^ 開始
() 域段
[] 包含,默認是一個字符長度
[^] 不包含,默認是一個字符長度
{n,m} 匹配長度 
. 任何單個字符(\. 字符點)
| 或
\ 轉義
$ 結尾
[A-Z] 26個大寫字母
[a-z] 26個小寫字母
[0-9] 0至9數字

[A-Za-z0-9] 26個大寫字母、26個小寫字母和0至9數字
  , 分割
.

分割語法:
[A,H,T,W] 包含A或H或T或W字母
[a,h,t,w] 包含a或h或t或w字母
[0,3,6,8] 包含0或3或6或8數字


語法與釋義:
基礎語法 "^([]{})([]{})([]{})$"
  正則字符串 = "開始([包含內容]{長度})([包含內容]{長度})([包含內容]{長度})結束" 

?,*,+,\d,\w 這些都是簡寫的,完全可以用[]和{}代替(?:)(?=)(?!)(?<=)(?<!)(?i)(*?)(+?) 這種特殊組合情況下除外。
  初學者可以忽略?,*,+,\d,\w一些簡寫標示符,學會了基礎使用再按表自己去等價替換


實例:
  字符串;tel:086-0666-88810009999
  原始正則:"^tel:[0-9]{1,3}-[0][0-9]{2,3}-[0-9]{8,11}$" 
  速記理解:開始 "tel:普通文本"[0-9數字]{1至3位}"-普通文本"[0數字][0-9數字]{2至3位}"-普通文本"[0-9數字]{8至11位} 結束"
  等價簡寫後正則寫法:"^tel:\d{1,3}-[0]\d{2,3}-\d{8,11}$" ,簡寫語法不是所有語言都支持。

發表評論
所有評論
還沒有人評論,想成為第一個評論的人麼? 請在上方評論欄輸入並且點擊發布.
相關文章