首页 > Web开发 > 详细

工作中shell命令分析Apache网站日志大全

时间:2015-03-26 18:04:01      阅读:154      评论:0      收藏:0      [点我收藏+]

1.获得访问前10位的ip地址
cat access_log |awk ‘{print $1}‘|sort|uniq -c|sort -nr|head -10

2.访问次数最多的文件或页面,取前20

cat access.log|awk ‘{print $11}’|sort|uniq -c|sort -nr|head-20

3.列出传输最大的几个exe文件

cat access.log |awk ‘($7~/\.exe/){print $10 ” ” $1 ” ”$4 ” ” $7}’|sort -nr|head -20

4.列出输出大于200000byte(约200kb)的exe文件以及对应文件发生次数

cat access.log |awk ‘($10 > 200000 && $7~/\.exe/){print $7}’|sort -n|uniq -c|sort -nr|head -100

5.如果日志最后一列记录的是页面文件传输时间,则列出到客户端最耗时的页面

cat access.log |awk ‘($7~/\.php/){print $NF ” ” $1 ” ”$4 ” ” $7}’|sort -nr|head -100

6.列出最最耗时的页面(超过60秒的)的以及对应页面发生次数

cat access.log |awk ‘($NF > 60 && $7~/\.php/){print $7}’|sort -n|uniq -c|sort -nr|head -100

7.列出传输时间超过30 秒的文件

cat access.log |awk ‘($NF > 30){print $7}’|sort-n|uniq -c|sort -nr|head -20

8.统计网站流量(G)

cat access.log |awk ‘{sum+=$10} END {printsum/1024/1024/1024}’

9.统计404的连接

awk ‘($9 ~/404/)’ access.log | awk ‘{print $9,$7}’ |sort

10.统计http status.
cat access.log |awk ‘{counts[$(9)]+=1}; END {for(codein counts) print code, counts[code]}‘
cat access.log |awk ‘{print $9}‘|sort|uniq -c|sort -rn

11.蜘蛛分析

查看是哪些蜘蛛在抓取内容。
/usr/sbin/tcpdump -i eth0 -l -s 0 -w - dst port 80 | strings | grep -iuser-agent | grep -i -E ‘bot|crawler|slurp|spider‘

 若有不足之处,请多多指教!

本文出自 “小虾” 博客,请务必保留此出处http://liangey.blog.51cto.com/9097868/1625057

工作中shell命令分析Apache网站日志大全

原文:http://liangey.blog.51cto.com/9097868/1625057

(0)
(0)
   
举报
评论 一句话评论(0
关于我们 - 联系我们 - 留言反馈 - 联系我们:wmxa8@hotmail.com
© 2014 bubuko.com 版权所有
打开技术之扣,分享程序人生!