文章详情页
python - 用scrapy-splash爬取网站 为啥iframe下的内容没有被返回
浏览:261日期:2022-08-10 09:23:22
问题描述
用scrapy-splash爬取网站 为啥iframe下的内容没有被返回?
import scrapyfrom scrapy import Selectorclass Music163Spider(scrapy.Spider): name = 'music163' allowed_domains = ['music.163.com/#/discover/toplist'] start_urls = [’http://music.163.com/#/discover/toplist/’] def parse(self, response):print('parse:',response.text) def start_requests(self):for url in self.start_urls: yield scrapy.Request(url, self.parse, meta={’splash’: { ’endpoint’: ’render.html’, ’args’: {’wait’: 0.5, }} })
问题解答
回答1:你需要在parse中获取iframe的url再次请求内容。
相关文章:
1. golang - 用IDE看docker源码时的小问题2. 请问“由于 Cookie “PHPSESSID”的“SameSite”属性设置为“None”,但缺少“Secure”属性,此 Cookie 未来将被拒绝。”请问出现这个问题怎么办?3. Docker for Mac 创建的dnsmasq容器连不上/不工作的问题4. 前端 - 类到底该如何去命名 .newsList 这种的命名难道真的不是过度语义化吗?~5. docker images显示的镜像过多,狗眼被亮瞎了,怎么办?6. docker start -a dockername 老是卡住,什么情况?7. docker api 开发的端口怎么获取?8. docker容器呢SSH为什么连不通呢?9. 如何解决Centos下Docker服务启动无响应,且输入docker命令无响应?10. python小白,关于函数问题
排行榜

网公网安备