文章详情页
网页爬虫 - Python爬虫返回状态码与实际情况不符?
浏览:323日期:2022-09-03 18:57:11
问题描述
import urllib2opener = urllib2.build_opener()html = Noneresponse = Noneresponse = opener.open(’http://www.sxxrcs.com/was5/web/’)html = response.codeprint html
比如这个爬虫,输出状态码是200。

可是直接访问http://www.sxxrcs.com/was5/web/是404,抓包响应的也是404,请问这是为什么?

问题解答
回答1:用requests吧
import requestsr = requests.get(’http://www.sxxrcs.com/was5/web/’)print r.status_codeprint r.text回答2:
200正常啊,requests方便快捷。
相关文章:
1. 关docker hub上有些镜像的tag被标记““This image has vulnerabilities””2. debian - docker依赖的aufs-tools源码哪里可以找到啊?3. docker - 如何修改运行中容器的配置4. javascript - 关于js原生事件的绑定与解除绑定5. javascript - Js对象怎么通过value值拿到key值?6. 前端 - 怎样让scale缩小的元素不占据原来的空间?7. docker 下面创建的IMAGE 他们的 ID 一样?这个是怎么回事????8. docker-compose 为何找不到配置文件?9. javascript - [MUI 子webview定位]10. java - SSH 根据id字段不能更新数据问题
排行榜

网公网安备