[日誌分析]在nginx日誌中,提取有效的request uri
最近在做公司的nginx log分析,其中一個需求是提取這個月每天被訪問Top10的頁面,及其訪問量。 做這個需求,首先要清洗出有效的頁面訪問。我採用排除法,去掉 .js .css之類的存取。但最初,我並不能全面的了解要去掉有哪些後綴的request。 經過清洗-> 抽樣-> 清洗-> 抽樣-> 清洗,最終需要過濾掉含有下列後綴的uri
.js .cs . gif .jpeg .jpg . xml .JPEG .PNG .JPG #python代码:
if re.search(r"(\.js|\.css|\.gif|\.jpe?g|\.png|\.ico|\.txt|\.swf|\.JPE?G|\.PNG|\.xml)", request[1]):
continue
登入後複製
不同公司的日誌可能存在一些特殊情況,這還需要抽樣分析
版權聲明:本文為部落客原創文章,未經博主轉載。
以上就介紹了[日誌分析]在nginx日誌中,提取有效的request uri,包括了方面的內容,希望對PHP教程有興趣的朋友有所幫助。
本網站聲明
本文內容由網友自願投稿,版權歸原作者所有。本站不承擔相應的法律責任。如發現涉嫌抄襲或侵權的內容,請聯絡admin@php.cn
作者最新文章
-
2024-10-22 09:46:29
-
2024-10-13 13:53:41
-
2024-10-12 12:15:51
-
2024-10-11 22:47:31
-
2024-10-11 19:36:51
-
2024-10-11 15:50:41
-
2024-10-11 15:07:41
-
2024-10-11 14:21:21
-
2024-10-11 12:59:11
-
2024-10-11 12:17:31