鍍金池/ 教程/ Java/ 正則表達(dá)式
LuaCjsonLibrary
抵制使用 module()函數(shù)來定義 Lua 模塊
點(diǎn)號(hào)與冒號(hào)操作符的區(qū)別
跨平臺(tái)的庫選擇
虛變量
pipeline 壓縮請(qǐng)求數(shù)量
灰度發(fā)布
如何安裝火焰圖生成工具
KeepAlive
正則表達(dá)式
稀疏數(shù)組
docker
下標(biāo)從 1 開始
sleep
使用動(dòng)態(tài) DNS 來完成 HTTP 請(qǐng)求
如何定位問題
調(diào)試
局部變量
如何對(duì) nginx lua module 添加新 api
動(dòng)態(tài)限速
變量的共享范圍
請(qǐng)求返回后繼續(xù)執(zhí)行
火焰圖
正確的記錄日志
判斷數(shù)組大小
select+set_keepalive 組合操作引起的數(shù)據(jù)讀寫錯(cuò)誤
ngx.shared.DICT 非隊(duì)列性質(zhì)
API 測(cè)試
編碼為 array 還是 object
執(zhí)行階段概念
Json 解析的異常捕獲
性能測(cè)試
TIME_WAIT
函數(shù)在調(diào)用代碼前定義
script 壓縮復(fù)雜請(qǐng)求
禁止某些終端訪問
什么時(shí)候使用
c10 k 編程
阻塞操作
單元測(cè)試
持續(xù)集成
緩存失效風(fēng)暴
調(diào)用其他 C 函數(shù)動(dòng)態(tài)庫
熱裝載代碼
緩存
Redis 接口的二次封裝(發(fā)布訂閱)
網(wǎng)上有大量對(duì) lua 調(diào)優(yōu)的推薦,我們應(yīng)該如何看待?
Redis 接口的二次封裝
非空判斷

正則表達(dá)式

OpenResty 中,同時(shí)存在兩套正則表達(dá)式規(guī)范:Lua 語言的規(guī)范和 Nginx 的規(guī)范,即使您對(duì) Lua 語言中的規(guī)范非常熟悉,我們?nèi)圆唤ㄗh使用 Lua 中的正則表達(dá)式。一是因?yàn)?Lua 中正則表達(dá)式的性能并不如 Nginx 中的正則表達(dá)式優(yōu)秀;二是 Lua 中的正則表達(dá)式并不符合 POSIX 規(guī)范,而 Nginx 中實(shí)現(xiàn)的是標(biāo)準(zhǔn)的 POSIX 規(guī)范,后者明顯更具備通用性。

Lua 中的正則表達(dá)式與 Nginx 中的正則表達(dá)式相比,有 5%-15%的性能損失,而且 Lua 將表達(dá)式編譯成 Pattern 之后,并不會(huì)將 Pattern 緩存,而是每此使用都重新編譯一遍,潛在地降低了性能。Nginx 中的正則表達(dá)式可以通過參數(shù)緩存編譯過后的 Pattern ,不會(huì)有類似的性能損失。

o 選項(xiàng)參數(shù)用于提高性能,指明該參數(shù)之后,被編譯的 Pattern 將會(huì)在 worker 進(jìn)程中緩存,并且被當(dāng)前 worker 進(jìn)程的每次請(qǐng)求所共享。 Pattern 緩存的上限值通過 lua_regex_cache_max_entries 來修改。

# nginx.conf
location /test {
    content_by_lua '
        local regex = [[\\d+]]

        -- 參數(shù)"o"是開啟緩存必須的
        local m = ngx.re.match("hello, 1234", regex, "o")  
        if m then
            ngx.say(m[0])
        else
            ngx.say("not matched!")
        end
    ';
}
# 在網(wǎng)址中輸入"yourURL/test",即會(huì)在網(wǎng)頁中顯示 1234 。

Lua 中正則表達(dá)式語法上最大的區(qū)別,Lua 使用'%' 來進(jìn)行轉(zhuǎn)義,而其他語言的正則表達(dá)式使用'\' 符號(hào)來進(jìn)行轉(zhuǎn)義。其次,Lua 中并不使用'?' 來表示非貪婪匹配,而是定義了不同的字符來表示是否是貪婪匹配。定義如下:

符號(hào) 匹配次數(shù) 匹配模式
+ 匹配前一字符 1 次或多次 非貪婪
* 匹配前一字符 0 次或多次 貪婪
- 匹配前一字符 0 次或多次 非貪婪
? 匹配前一字符 0 次或 1 次 僅用于此,不用于標(biāo)識(shí)是否貪婪
符號(hào) 匹配模式
. 任意字符
%a 字母
%c 控制字符
%d 數(shù)字
%l 小寫字母
%p 標(biāo)點(diǎn)字符
%s 空白符
%u 大寫字母
%w 字母和數(shù)字
%x 十六進(jìn)制數(shù)字
%z 代表 0 的字符

Lua 正則簡單匯總

  • string.find 的基本應(yīng)用是在目標(biāo)串內(nèi)搜索匹配指定的模式的串。函數(shù)如果找到匹配的串,就返回它的開始索引和結(jié)束索引,否則返回 nilfind 函數(shù)第三個(gè)參數(shù)是可選的:標(biāo)示目標(biāo)串中搜索的起始位置,例如當(dāng)我們想實(shí)現(xiàn)一個(gè)迭代器時(shí),可以傳進(jìn)上一次調(diào)用時(shí)的結(jié)束索引,如果返回了一個(gè) nil 值的話,說明查找結(jié)束了.
local s = "hello world"
local i, j = string.find(s, "hello")
print(i, j) --> 1 5
  • string.gmatch 我們也可以使用返回迭代器的方式
local s = "hello world from Lua"
for w in string.gmatch(s, "%a+") do  
    print(w)
end

-- output :
--    hello
--    world
--    from
--    Lua
  • string.gsub 用來查找匹配模式的串,并將使用替換串其替換掉,但并不修改原字符串,而是返回一個(gè)修改后的字符串的副本,函數(shù)有目標(biāo)串,模式串,替換串三個(gè)參數(shù),使用范例如下:
local a = "Lua is cute"
local b = string.gsub(a, "cute", "great")
print(a) --> Lua is cute
print(b) --> Lua is great
  • 還有一點(diǎn)值得注意的是,'%b' 用來匹配對(duì)稱的字符,而不是一般正則表達(dá)式中的單詞的開始、結(jié)束。 '%b' 用來匹配對(duì)稱的字符,而且采用貪婪匹配。常寫為 '%bxy' , x 和 y 是任意兩個(gè)不同的字符; x 作為匹配的開始, y 作為匹配的結(jié)束。比如,'%b()' 匹配以 '(' 開始,以 ')' 結(jié)束的字符串:
--> a line
print(string.gsub("a (enclosed (in) parentheses) line", "%b()", ""))
上一篇:調(diào)試下一篇:緩存