文章详情页
python - 为什么感觉 pyspider 爬取的速度好慢
浏览:99日期:2022-08-08 09:43:03
问题描述
为什么感觉 pyspider 爬取的速度好慢(比自己直接用 requests 和 bs慢多了),是不是因为有些网页会 retry,不过成功率倒是比自己爬取的高多了。是不是我的使用方法不对?求解释
问题解答
回答1:这里可以设置 web ui 控制台上的 rate/burst 参数来调节速度,rate 是 每秒抓取的数量,burst 是并发的数量,默认是 1/3 所以比较慢,还是对这个工具了解不够呀
回答2:我没有用过框架来写爬虫,但是我在自己写爬虫的时候,并发写起来,模型越复杂(如线程控制,线程状态监控),效率是越低的。
相关文章:
1. javascript - iframe 为什么加载网页的时候滚动条这样显示?2. 后端开发 - mysql按时间分段统计的sql语句怎么写好?3. mysql - 在下刚入门sql 关于sql的语法询问4. 初来乍到,相对路径问题,新手求教5. 老师您好!我有一个问题、6. c++ - 如何在python的阻塞的函数中获取变量值7. python3.x - python lxml无法查找第一个tag有链接和没有内容tag的子tag的text?8. javascript - 请问为啥这个不能渲染成功?9. javascript - 根据不同数据显示不同内容10. 哭辽 求大佬解答 控制器的join方法怎么转模型方法
排行榜
