首頁 > 後端開發 > php教程 > [日誌分析]在nginx日誌中,提取有效的request uri

[日誌分析]在nginx日誌中,提取有效的request uri

WBOY
發布: 2016-08-08 09:19:23
原創
1196 人瀏覽過
最近在做公司的nginx log分析,其中一個需求是提取這個月每天被訪問Top10的頁面,及其訪問量。 做這個需求,首先要清洗出有效的頁面訪問。我採用排除法,去掉 .js .css之類的存取。但最初,我並不能全面的了解要去掉有哪些後綴的request。 經過清洗-> 抽樣-> 清洗-> 抽樣-> 清洗,最終需要過濾掉含有下列後綴的uri
.js  .cs . gif .jpeg  .jpg . xml .JPEG .PNG .JPG 
#python代码:
if re.search(r"(\.js|\.css|\.gif|\.jpe?g|\.png|\.ico|\.txt|\.swf|\.JPE?G|\.PNG|\.xml)", request[1]):
        continue
登入後複製

不同公司的日誌可能存在一些特殊情況,這還需要抽樣分析

版權聲明:本文為部落客原創文章,未經博主轉載。

以上就介紹了[日誌分析]在nginx日誌中,提取有效的request uri,包括了方面的內容,希望對PHP教程有興趣的朋友有所幫助。

相關標籤:
來源:php.cn
本網站聲明
本文內容由網友自願投稿,版權歸原作者所有。本站不承擔相應的法律責任。如發現涉嫌抄襲或侵權的內容,請聯絡admin@php.cn
熱門教學
更多>
最新下載
更多>
網站特效
網站源碼
網站素材
前端模板