文章详情页
想写一个python分析统计apache 日志文件的脚本
浏览:192日期:2022-07-27 15:36:57
问题描述
想写一个python分析统计apache 网站日志文件并将统计后的数据存入mysql中的的脚本,有没有参考的,没有思路主要是统计 哪些url被爬取了 及 被爬取次数,以及IP这两个
问题解答
回答1:先把原始数据 规整化,然后 key 值自己定,然后用 collections 的 Counter 统计,然后再遍历写入 db, 大概代码如下:
data = [’/a 1.2.1.2’, ’/b 2.2.2.2’, ’/c 1.1.1.1’, ’/d 2.2.2.2’, ’/d 2.2.2.2’]from collections import Counterc = Counter(data)print c
Counter({’/d 2.2.2.2’: 2, ’/b 2.2.2.2’: 1, ’/a 1.2.1.2’: 1, ’/c 1.1.1.1’: 1})
你也可以自己维护字典,键为:/PATH:IP 或者什么,自己定,然后一边遍历,一边添加就好了
相关文章:
1. 微信公众号发送模板消息返回错误410002. javascript - 关于微信公众号开发的一个trouble!3. java - 用IDEA搭建SSM框架单元测试时候报错4. javascript - 微信jssdk ios下自定义onMenuShareAppMessage 分享失效,Android分享成功5. docker - MySQL 报错:Access denied for user ’xxx’@’localhost’6. java - HTML邮件有多出来的空白区域,如何处理?7. css3怎么限定文字字数8. 在windows下安装docker Toolbox 启动Docker Quickstart Terminal 失败!9. 如何用html5开发app?ide是netbeans10. Android明明可以直接分享,为什么还要用微信开放平台、微博开放平台的sdk?
排行榜
