文章详情页
python - 把<dl></dl>标签包含进去如何拿到我想要的内容
浏览:210日期:2022-07-21 08:07:19
问题描述
1.我把<dl>标签加进去拿到的是空内容,我该怎么写匹配规则,不加<dl>标签倒是可以拿到想要的内容2.问题代码
pattern = re.compile(r’<dl>.*?<dd><a href='https://www.haobala.com/wenda/(.*?)'>(.*?)</a></dd>.*?</dl>’)
3.不把<dl>标签加进去可以拿到想要的内容
4.附上网页源代码
<dl><dt>《明末工程师》正文</dt><dd><a href='https://www.haobala.com/book/1440/xx'>第一章 穿越后的窘境</a></dd></dl>
问题解答
回答1:# 你可能需要加个模式# re.S 使 . 匹配包括换行在内的所有字符pattern = re.compile(r’<dl>.*?<dd><a href='https://www.haobala.com/wenda/(.*?)'>(.*?)</a></dd>.*?</dl>’, re.S)print re.findall(pattern, a)回答2:
// /需要转义下<dl>.*?<dd><a href='https://www.haobala.com/wenda/(.*?)'>(.*?)</a></dd>.*?</dl>
相关文章:
1. mysql - 数据库中的引擎和表的引擎的区别在哪?2. css3 - 新版支付宝 账单页面滑动时月份栏被下一个月给顶上去是什么效果3. javascript - AJAX请求疑问句4. javascript - chart.js如何修改某个指定bar的颜色5. 网页爬虫 - python爬虫用BeautifulSoup爬取<s>元素并写入字典,但某些div下没有这一元素,导致自动写入下一条,如何解决?6. mysql - phpMyAdmin无法导入数据7. 超链接里的target问题8. javascript - 图片请求失败怎么去掉左上角的小图标?9. HTML源文件和引用文件在同一个目录里直接写引用文件名为什么还是打不开10. thinkphp3.2.3对接新版支付宝
排行榜

网公网安备