文章详情页
python - 为什么感觉 pyspider 爬取的速度好慢
浏览:244日期:2022-08-08 09:43:03
问题描述
为什么感觉 pyspider 爬取的速度好慢(比自己直接用 requests 和 bs慢多了),是不是因为有些网页会 retry,不过成功率倒是比自己爬取的高多了。是不是我的使用方法不对?求解释
问题解答
回答1:这里可以设置 web ui 控制台上的 rate/burst 参数来调节速度,rate 是 每秒抓取的数量,burst 是并发的数量,默认是 1/3 所以比较慢,还是对这个工具了解不够呀
回答2:我没有用过框架来写爬虫,但是我在自己写爬虫的时候,并发写起来,模型越复杂(如线程控制,线程状态监控),效率是越低的。
相关文章:
1. css3 - CSS优先级问题2. dockerfile - [docker build image失败- npm install]3. javascript - avalon.js ms-on 事件绑定无效 ?4. dockerfile - 为什么docker容器启动不了?5. css - 如何讓圖片像雲一樣的行為?6. android - 微信的@功能如何实现的?7. font-family - 我引入CSS3自定义字体没有效果?8. javascript - 网页打印页另存为pdf的代码一个问题9. docker内创建jenkins访问另一个容器下的服务器问题10. docker - 各位电脑上有多少个容器啊?容器一多,自己都搞混了,咋办呢?
排行榜

网公网安备