文章详情页
想写一个python分析统计apache 日志文件的脚本
浏览:120日期:2022-07-27 15:36:57
问题描述
想写一个python分析统计apache 网站日志文件并将统计后的数据存入mysql中的的脚本,有没有参考的,没有思路主要是统计 哪些url被爬取了 及 被爬取次数,以及IP这两个
问题解答
回答1:先把原始数据 规整化,然后 key 值自己定,然后用 collections 的 Counter 统计,然后再遍历写入 db, 大概代码如下:
data = [’/a 1.2.1.2’, ’/b 2.2.2.2’, ’/c 1.1.1.1’, ’/d 2.2.2.2’, ’/d 2.2.2.2’]from collections import Counterc = Counter(data)print c
Counter({’/d 2.2.2.2’: 2, ’/b 2.2.2.2’: 1, ’/a 1.2.1.2’: 1, ’/c 1.1.1.1’: 1})
你也可以自己维护字典,键为:/PATH:IP 或者什么,自己定,然后一边遍历,一边添加就好了
相关文章:
1. css3 隱藏文本2. Docker for Mac 创建的dnsmasq容器连不上/不工作的问题3. 在windows下安装docker Toolbox 启动Docker Quickstart Terminal 失败!4. dockerfile - [docker build image失败- npm install]5. javascript - react热加载的一段代码6. javascript - vue-router怎么不能实现跳转呢7. python 字符串匹配问题8. Python Tornado批量上传图片并显示功能9. javascript - js判断用户的网络能否上网?10. 请教python编码风格和异常处理问题
排行榜
