文章详情页
python - 爬取某网站时需要浏览器刷新一次才能返回真实的页面数据?
浏览:206日期:2022-08-10 17:31:34
问题描述
请求所需参数全部带上了,并且已带上cookies,已修改header,拿到的数据是提示刷新的HTML,如图:
原网页是动态加载的瀑布流,即往不断下拉就不断有内容呈现出来,静候大神,目前采用scrapy框架,暂时还不想上selenium+phantomjs,太重了
问题解答
回答1:动态加载的数据你应该找ajax api请求,而不是在网页找,工欲善其事必先利其器,善用 F12。
回答2:这种情况比抓取一个代理ip网页,使用cookie但是报错好解决多了==,你完全可以判断当前页面内容然后进行模拟刷新~ 重要的是保持会话。
如果还不行的话,可以加referer再试一试
相关文章:
1. javascript - 新组成的数组打印出来出现问题,里面有对象,但长度为空2. docker网络端口映射,没有方便点的操作方法么?3. docker绑定了nginx端口 外部访问不到4. Docker for Mac 创建的dnsmasq容器连不上/不工作的问题5. macos - mac下docker如何设置代理6. angular.js - angular内容过长展开收起效果7. dockerfile - 为什么docker容器启动不了?8. docker - 各位电脑上有多少个容器啊?容器一多,自己都搞混了,咋办呢?9. angular.js使用$resource服务把数据存入mongodb的问题。10. docker-compose 为何找不到配置文件?
排行榜

网公网安备